Тема

LLM

Все материалы по теме в хронологическом порядке.

Вчера
2 октября

Анатомия AI-инфраструктуры: почему LLM не работает на одной видеокарте

На Хабре вышла статья о том, как устроена инфраструктура для запуска больших языковых моделей. Автор объясняет, почему расчёт «размер модели делить на память одной карты» не работает и какие компоненты определяют скорость ответа.

3 минДля профи

FAIRouter: открытая библиотека для автоматического выбора LLM под задачу

В открытый доступ выложили библиотеку FAIRouter — она автоматически подбирает LLM-исполнителя под конкретный запрос, а после ответа проверяет его с помощью модели-судьи. Код распространяется под лицензией Apache 2.0.

2 минДля профи

Как выбрать LLM для рабочих задач: опыт с Claude, GPT и Gemini

Руководитель ИИ-проектов Игорь Зуриев рассказал, как выбирать LLM для рабочих задач. Он предлагает оценивать модели не по бенчмаркам, а по трём критериям: результат, объём ручных правок и проверяемость.

2 минДля профи
29 сентября

SWE-Adept: два LLM-агента для анализа кода и решения задач в репозиториях

Исследователи представили SWE-Adept — фреймворк из двух LLM-агентов для работы с большими кодовыми базами. Один агент ищет проблемные места, второй вносит исправления. На бенчмарках SWE-Bench Lite и Pro система улучшила end-to-end resolve rate до 4,3%.

1 минДля профи
28 сентября
27 сентября

Ученые нашли «ось боли» в 25 языковых моделях

Исследователи нашли в 25 языковых моделях с открытыми весами внутреннее направление активаций, которое связали с состоянием, похожим на боль. При его усилении модели чаще выбирали облегчение, даже если это вредило пользователю.

4 минДля профи
26 сентября

Физик бросил вызов ИИ-компаниям, и Claude решил задачу по физике за месяц

Физик и научный писатель Мэтт фон Хиппель предложил ИИ-компаниям решить сложную вычислительную задачу из теоретической физики. Через месяц Anthropic сообщила, что Claude справился с расчётом амплитуды рассеяния в модели N=4 суперсимметричной теории Янга — Миллса до девяти петель.

2 минДля профи

Маршрутизация ИИ-моделей: зачем одной модели недостаточно

Для разных задач нужны разные ИИ-модели: одни быстрее и дешевле, другие точнее в анализе или кодинге. Маршрутизация помогает распределять запросы между моделями, чтобы не платить за избыточную мощность.

2 минДля профи

Заказчики требуют от LLM/AI Firewall более 500 формализованных требований

Крупные заказчики перешли от запроса «прокси для ChatGPT» к матрице из более чем 500 формализованных требований к защите генеративного ИИ. В неё входят контроль ИИ-агентов, MCP, соответствие 152-ФЗ и управление расходом токенов.

3 минДля профи

Альфа-Банк протестировал LLM как энкодер для классификации на 300+ классов

Альфа-Банк рассказал, как использует LLM не как генератор, а как энкодер для классификации текстов. На четырёх внутренних доменах банка сравнили LLM-бэкбоны с классическими BERT-моделями.

1 минДля профи

Скаффолды вокруг LLM почти не влияют на измеряемую безопасность — а формат теста влияет

Учёные провели 62 808 оценок шести ведущих моделей на четырёх бенчмарках безопасности. Оказалось, что способ измерения влияет на результат в 45 раз сильнее, чем архитектура скаффолда вокруг модели.

1 минДля профи
25 сентября

GPT-6 Astra и Gemini 3.8 Flash возглавили бенчмарк англо-русского перевода

Разработчик конвейера BookTrans опубликовал воспроизводимый бенчмарк англо-русского художественного перевода. Лучший результат показала GPT-6 Astra — 90 баллов из 100, у Gemini 3.8 Flash 88. Китайские модели GLM 5.3 и DeepSeek V4 Flash обошли флагманы Claude.

3 минДля профи

1352 кейса внедрения ИИ в России: в продакшене побеждает обвязка, а не модель

Каталог кейсов внедрения ИИ в России набрал 1352 проекта в компаниях и госорганах. Авторы статьи из АНО «Цифровые платформы» разобрали шесть паттернов: качество модели почти никогда не решает, а решает обвязка вокруг неё.

4 минДля профи

PrismML выпустила крошечную LLM для умных очков на чипах Qualcomm

AI-лаборатория PrismML создала версию своей крошечной языковой модели для умных очков на чипах Qualcomm Snapdragon. На саммите Snapdragon Summit чипмейкер показал 1-битную модель Bonsai, которая работает локально на очках с платформой AR1 Gen 1.

1 минДля профи