Google и OpenAI ускорили ИИ‑модели для кода и агентов
13 августа Google представила Gemini 3.7 Flash, а OpenAI включила режим Ultrafast для GPT‑5.6 Sol; OpenAI называет скорость до 750 выходных токенов в секунду.
13 августа Google и OpenAI представили версии своих моделей, ориентированные на ускорение задач с кодом и работой автономных агентов. Google анонсировала Gemini 3.7 Flash, OpenAI запустила режим Ultrafast для GPT‑5.6 Sol.
Google позиционирует Gemini 3.7 Flash как модель для программирования и автоматизации бизнес‑процессов с улучшенным многошаговым планированием, следованием инструкциям и генерацией кода. По данным Google DeepMind, стоимость использования новой версии снизилась вдвое по сравнению со стартовой ценой предшественницы. Линейка Flash нацелена на сценарии, где важна скорость ответа: кодинг, агентские системы и случаи с большим числом последовательных обращений к модели.
В июле Google выпустила Gemini 3.6 Flash. Тогда стартовая тарификация составляла $1,5 за 1 млн входных токенов и $7,5 за 1 млн выходных токенов. По информации компании, версия 3.6 использовала на 17% меньше выходных токенов по сравнению с версией 3.5 Flash. Одновременно компания продолжает тестирование флагманской версии Gemini 3.5 Pro с партнёрами; сроки широкого релиза пока не объявлены.
OpenAI представила режим Ultrafast для GPT‑5.6 Sol, который, по информации компании, работает до 14 раз быстрее стандартного режима и способен генерировать до 750 выходных токенов в секунду. Для ускорения используется инфраструктура Cerebras. На старте режим доступен через API ограниченному числу клиентов; расширение доступа планируется по мере наращивания вычислительных мощностей. Показатель 750 токенов в секунду упоминался при анонсе GPT‑5.6 в июне.
Google подчёркивает улучшения в многошаговом планировании и точности исполнения инструкций, OpenAI концентрируется на увеличении скорости генерации с использованием специализированной аппаратуры. Оба решения ориентированы на снижение задержки и повышение пропускной способности при генерации последовательных ответов для задач с кодом и агентами.
В августе также была представлена новая флагманская модель Grok 4.6 от SpaceXAI, рассчитанная на долгосрочные агентские задачи, программирование и интерактивные приложения. Появление нескольких новых продуктов расширяет выбор инструментов с разными показателями скорости, стоимости и качества вывода.
Материалы на GNcrypto предоставляются исключительно в информационных целях и не являются финансовой рекомендацией. Мы стремимся публиковать точные и актуальные данные, однако не можем гарантировать их абсолютную достоверность, полноту или надёжность. GNcrypto не несёт ответственности за возможные ошибки, упущения или финансовые потери, возникшие вследствие использования данной информации. Все действия вы совершаете на свой страх и риск. Всегда проводите собственный анализ и консультируйтесь с профессионалами. Подробнее см. в наших страницах Условия, Политика конфиденциальности и Отказ от ответственности.








