Назад
Искусственный интеллект и машинное обучение

Тест-драйв GigaChat 3.5: оценка возможностей модели в бизнес-задачах

Habr
Advertisement468 × 90
Тест-драйв GigaChat 3.5: оценка возможностей модели в бизнес-задачах

Модель GigaChat 3.5, выпущенная в июле и ставшая доступной с открытыми весами в сентябре, стала объектом масштабного тестирования. Авторы статьи провели сравнительный анализ производительности этой модели в реальных бизнес-кейсах, используя собственный бенчмарк для оценки работы ИИ-агентов. В ходе исследования возможности GigaChat 3.5 сопоставлялись с актуальными российскими и китайскими аналогами. Целью тестирования было определить пригодность модели для решения прикладных задач в корпоративной среде. Результаты «забегов» ИИ-агентов позволяют оценить конкурентоспособность отечественной разработки на фоне глобальных трендов в области больших языковых моделей. Подробные данные о производительности, точности и эффективности выполнения специфических задач представлены в полном тексте исследования, доступном по ссылке.

This is a summary. Read the full article at the original source:

Habr
Advertisement468 × 90
Share
Искусственный интеллект и машинное обучение

Похожие

Компания Co-op Legal Services внедрила систему мониторинга на базе искусственного интеллекта, которая записывает и оценивает все телефонные разговоры…

The Guardian Technology

Беженцы в лагере Какума в Кении, долгое время зависевшие от цифровой микроработы, такой как аннотирование данных и транскрипция, столкнулись с серьезн…

The Guardian Technology
Advertisement970 × 250