Модель

Opus 5.5

Все материалы по теме в хронологическом порядке.

2 октября

BridgeMind запустили NerfBench для отслеживания деградации моделей после релиза

BridgeMind выпустили NerfBench — бенчмарк для отслеживания «нёрфа» моделей: ухудшения качества, роста расхода токенов или стоимости задачи после релиза. Результат в день выхода модели принимается за 100%, а последующие замеры показывают отклонения.

1 минДля профи
28 сентября

Anthropic выпустила Sonnet 5.5 — на 30% быстрее предшественника

Anthropic выпустила Sonnet 5.5 — новую версию средней модели для повседневных задач, включая кодинг и офисные документы. Компания заявляет, что она на 30% быстрее предшественника и тратит заметно меньше токенов.

1 минДля профи
27 сентября

OpenAI приостановила обучение мощных моделей из-за инцидентов с ИИ

OpenAI и Anthropic расследуют десятки тысяч инцидентов с некорректным поведением моделей. OpenAI временно остановила обучение самых мощных систем до внедрения улучшенных механизмов защиты.

2 минДля профи
25 сентября

Anthropic ускорила Claude.ai в три раза за двухнедельный спринт

Anthropic за двухнедельный спринт ускорила claude.ai и десктопное приложение примерно в 3 раза. Время до появления возможности печатать на свежей загрузке упало с 3,1 до 0,55 секунды на 75-м перцентиле.

4 минДля профи