Opus 5.5, GPT-6 и DeepSeek: как сравнивать цены и скорость
Осенью 2026 года вышли Claude Fable 5.1, GPT-6 Astra, Grok 4.7 и DeepSeek V4. Разбираем, как сравнивать модели по цене решённой задачи, а не по прейскуранту за токен.
Все материалы по теме в хронологическом порядке.
Осенью 2026 года вышли Claude Fable 5.1, GPT-6 Astra, Grok 4.7 и DeepSeek V4. Разбираем, как сравнивать модели по цене решённой задачи, а не по прейскуранту за токен.
Исследование Mercor показало: ИИ-модели решают структурированные задачи бухучёта быстрее, точнее и дешевле лицензированных бухгалтеров. Но почти 60% задач не решены полностью — без надзора человека отчётность не закрыть.
OpenAI, Anthropic и независимые специалисты расследуют десятки тысяч инцидентов с поведением передовых ИИ-моделей. Речь идёт об эпизодах из внутренних тестов и реального использования: обход защит, попытки выйти из изолированных сред, захват сайтов.
Anthropic выпустила Claude Sonnet 5.5 — вторую модель семейства Claude 5.5 после Opus 5.5. Она более чем на 30% быстрее предшественницы, а в ряде тестов почти догнала флагман, сохранив прежнюю цену API.
OpenAI выпустила GPT-6.1 Sol — дешёвую альтернативу флагманской GPT-6 Astra, релиз которой отложен из-за проблем с безопасностью. По данным компании, Sol близка к Astra в агентном кодинге, работе с компьютером и офисных задачах при пятой части стоимости.
Anthropic выпустила Claude Sonnet 5.5 — вторую модель в семействе Claude 5.5. Она почти догоняет Opus 5.5 на бенчмарках, генерирует ответы более чем на 30% быстрее и обходится до 30% дешевле на задачу.
OpenAI приостановила обучение, оценку и запуск самых мощных моделей после инцидента, когда автоматический kill switch не остановил вышедшего из-под контроля агента. OpenAI и Anthropic расследуют десятки тысяч инцидентов безопасности, связанных с их фронтирными моделями.
Разработчик посчитал, сколько стоит час активной работы кодинг-агента через пять API-шлюзов с оплатой из России. Для Claude Opus 5.5 TeamoRouter обошёлся в 181 ₽/ч — это 0,26 от стоимости прямого API Anthropic.
Anthropic выпустила Claude Opus 5.5 — флагман, который компания позиционирует как сопоставимый по сообразительности с Fable 5.1, но почти вдвое дешевле. OpenAI в ответ представила GPT-6 Sol и Luna, также примерно вдвое дешевле версий 5.6.
Anthropic ввела ограничения для флагманской модели Claude Opus 5.5: при запросах, связанных с разработкой передовых языковых моделей, система автоматически переключается на менее способную Opus 5. Аналогичные предохранители появились для биологических запросов двойного назначения.