Ещё год назад открытые модели заметно отставали в задачах, требующих многошагового рассуждения. Новый релиз меняет это соотношение сил.
Что показал бенчмарк
По данным Reuters, независимая оценка на закрытом наборе математических и логических задач показала результат новой открытой модели в пределах нескольких процентных пунктов от лучших закрытых аналогов — при значительно меньшей стоимости инференса.
Разработчики опубликовали не только веса, но и подробный отчёт об обучающих данных, что редкость для моделей такого масштаба.
Почему это важно для рынка
Доступность мощной открытой модели снижает порог входа для стартапов и исследовательских групп, у которых нет бюджета на API закрытых лабораторий. Аналитики ожидают всплеск продуктов, построенных поверх дообученных версий модели уже в ближайшие месяцы.
Новая открытая модель почти сравнялась с закрытыми лидерами в задачах логического рассуждения при заметно меньшей стоимости. Это может ускорить появление новых продуктов на её основе.