Ещё год назад открытые модели заметно отставали в задачах, требующих многошагового рассуждения. Новый релиз меняет это соотношение сил.

Что показал бенчмарк

По данным Reuters, независимая оценка на закрытом наборе математических и логических задач показала результат новой открытой модели в пределах нескольких процентных пунктов от лучших закрытых аналогов — при значительно меньшей стоимости инференса.

Разработчики опубликовали не только веса, но и подробный отчёт об обучающих данных, что редкость для моделей такого масштаба.

Почему это важно для рынка

Доступность мощной открытой модели снижает порог входа для стартапов и исследовательских групп, у которых нет бюджета на API закрытых лабораторий. Аналитики ожидают всплеск продуктов, построенных поверх дообученных версий модели уже в ближайшие месяцы.

✦ Кратко за 30 секунд

Новая открытая модель почти сравнялась с закрытыми лидерами в задачах логического рассуждения при заметно меньшей стоимости. Это может ускорить появление новых продуктов на её основе.

Источники брифинга