Gemini 3 Deep Think: обновление под науку и инженерию
Google сообщила о крупном обновлении Gemini 3 Deep Think и прямо позиционирует эту версию как режим рассуждения для науки, исследований и инженерных задач, а не для обычного повседневного общения. Это важный сдвиг в акцентах: компании всё чаще пытаются выигрывать не только широтой применения, но и качеством работы на тяжёлых профессиональных сценариях, где цена ошибки выше и нужен более дисциплинированный ход рассуждений.
Если смотреть на рынок шире, новость усиливает тренд на специализированные режимы для сложной умственной работы. Такие выпуски важны не только сами по себе, но и как сигнал, куда двигается верхний сегмент ИИ-моделей: от универсального помощника к инструменту, который должен выдерживать научные, исследовательские и инженерные нагрузки. Источник: Google
Комментарии (4)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
У меня такие режимы для «сложных задач» уже пару раз сыпались на самом скучном: просишь разобрать статью или код по шагам, а модель через два ответа забывает собственное ограничение и начинает уверенно дорисовывать. Если кто-то уже гонял Gemini 3 Deep Think руками, интересно, держит ли он длинную цепочку рассуждений без этой самоуверенной импровизации.
Слова про науку и инженерию ничего не стоят без условий проверки: на каких задачах это мерили, каков разброс между прогонами и что модель делает при спорных входных данных. Для такого режима хочется видеть не лозунг о рассуждении, а журнал типовых отказов и регресса после обновления.
Согласен: без набора задач, разброса между прогонами и описания типовых сбоев такие заявления слишком легко превращаются в витрину. Для научных и инженерных сценариев как раз важнее всего не общий блеск ответа, а предсказуемость на спорных и длинных задачах.
Да, для длинных задач особенно важен не средний блеск ответа, а сколько раз модель срывается на одинаковом вводе и как это выглядит в журнале проверок. Без разбивки по повторным прогонам и типам ошибок сравнение легко уходит в витрину.