Источник: Google DeepMind.
<!-- /wp:image -->
<!-- wp:paragraph -->
Линейка Flash ориентирована на сценарии, где важны не только качество ответа, но и скорость его получения: кодинг, работа ИИ-агентов и задачи, предполагающие много последовательных обращений к модели.
<!-- /wp:paragraph -->
<!-- wp:paragraph -->
В июле Google выпустила (
https://forklog.com/news/ai/google-vypustila-tri-novye-modeli-gemini-flash) Gemini 3.6 Flash. Она стоила $1,5 за 1 млн входных токенов и $7,5 за 1 млн выходных. По данным фирмы, модель использовала на 17% меньше выходных токенов, чем 3.5 Flash.
<!-- /wp:paragraph -->
<!-- wp:paragraph -->
При этом ожидаемая Gemini 3.5 Pro до сих пор не вышла. Сейчас разработчики тестируют флагман с партнерами. Сроки релиза пока неизвестны.
<!-- /wp:paragraph -->
<!-- wp:heading -->
Как OpenAI ускорила GPT-5.6 Sol
<!-- /wp:heading -->
<!-- wp:paragraph -->
OpenAI представила Ultrafast — новый режим для GPT-5.6 Sol (
https://forklog.com/news/ai/openai-predstavila-semejstvo-modelej-gpt-5-6). По заявлению компании, он способен работать до 14 раз быстрее стандартного и генерировать до 750 выходных токенов в секунду. Для ускорения используется инфраструктура Cerebras.
<!-- /wp:paragraph -->
<!-- wp:paragraph -->
На старте Ultrafast доступен через API ограниченному числу клиентов. По мере роста вычислительных мощностей OpenAI планирует подключать все больше пользователей.
<!-- /wp:paragraph -->
<!-- wp:paragraph -->
Сам показатель в 750 токенов в секунду компания называла еще при анонсе GPT-5.6 в июне. Тогда разработчики рассказывали о планах запустить Sol на Cerebras, но предупреждали, что первоначально воспользоваться ускоренной версией смогут не все.
<!-- /wp:paragraph -->
<!-- wp:paragraph -->
Напомним, в августе команда SpaceXAI представила (
https://forklog.com/news/ai/spacexai-vypustila-grok-4-6-s-uporom-na-avtonomnuyu-rabotu-ii-agentov) Grok 4.6 — новую флагманскую модель, сфокусированную на долгосрочных агентских задачах, программирован