Компания

arXiv

Все материалы по теме в хронологическом порядке.

2 октября

arXiv ограничил публикации: не больше двух статей в месяц

arXiv ввел лимит: с 1 октября пользователь может отправить не больше двух статей в месяц. Отклоненные модераторами работы тоже входят в лимит. Причиной называют резкий рост числа публикаций и злоупотребления с ИИ.

1 мин
1 октября

Вышла книга о создании автономных ИИ-агентов: от основ до продакшена

На arXiv вышло практическое руководство The Hitchhiker's Guide to Agentic AI. Книга описывает полный стек создания автономных ИИ-систем — от архитектуры трансформеров до продакшена и регулирования.

1 минДля профи
29 сентября

SWE-Adept: два LLM-агента для анализа кода и решения задач в репозиториях

Исследователи представили SWE-Adept — фреймворк из двух LLM-агентов для работы с большими кодовыми базами. Один агент ищет проблемные места, второй вносит исправления. На бенчмарках SWE-Bench Lite и Pro система улучшила end-to-end resolve rate до 4,3%.

1 минДля профи
28 сентября

Исследователи: результаты бенчмарков reasoning-моделей зависят от условий оценки

Исследование arXiv:2506.04734 выявило, что результаты бенчмарков reasoning-моделей сильно зависят от условий оценки. Это касается серии Deepseek-R1-Distill, моделей на её основе и QwQ-32B.

1 минДля профи
26 сентября

Скаффолды вокруг LLM почти не влияют на измеряемую безопасность — а формат теста влияет

Учёные провели 62 808 оценок шести ведущих моделей на четырёх бенчмарках безопасности. Оказалось, что способ измерения влияет на результат в 45 раз сильнее, чем архитектура скаффолда вокруг модели.

1 минДля профи