Исследования

Научные работы, бенчмарки и открытия

Сегодня

Исследование: половина источников AI Overviews на русских запросах не из топа Google

Аналитик собрал 1095 русскоязычных вопросов и проверил, как Google формирует AI Overviews. Обзор появился в 93% случаев, а из 446 источников 222 не было на первой странице обычной выдачи.

2 минДля профи

Хинтон, Бенджио и 20 исследователей выпустили статью об интеллектуальном взрыве

Джеффри Хинтон, Йошуа Бенджио и ещё два десятка исследователей опубликовали в Кембридже статью об «интеллектуальном взрыве». Они описывают, как ИИ может ускорить собственное развитие и почему к этому нужно готовиться заранее.

1 минДля профи

AI-агенты собирают 3D-сцены из фото, но не понимают своих ошибок

Метод LEGO-Anything заставляет кодинг-агента писать программу для Blender по одной фотографии. Агенты выдают рабочие сцены, но их геометрическая точность далека от идеала, а сами модели почти не способны оценить, стало ли лучше.

3 минДля профи

Anthropic показала, как Claude делает точные научные расчёты

Физик Мэтью Шварц из Гарварда описал в гостевом посте для Anthropic, как перестал использовать Claude как исследователя-человека и начал искать «задачи формы Claude». Результатом стал open-source-инструмент BootLoops для точных научных расчётов.

2 минДля профи

ИИ-лаборатория сама ставит опыты на дрожжах и находит новые связи

Учёные из Швеции и Великобритании построили замкнутую ИИ-систему для биологических исследований: она сама выдвигает гипотезы, планирует эксперименты и передаёт их роботам. На дрожжах система нашла ранее не описанные взаимодействия аминокислот и химических стрессоров.

2 минДля профи

Neuralink обучила ИИ на 50 000 часах сигналов мозга

Neuralink обучила базовую модель для интерфейсов мозг — компьютер на 50 000 часах сигналов мозга участников испытаний. Декодеры теперь работают неделями, а калибровка сократилась с 10 минут в день до 10 минут в неделю.

1 минДля профи

Muse Spark от Meta решила шесть открытых математических задач

Meta опубликовала шесть статей, написанных математиками совместно с моделью Muse Spark. Утверждается, что учёные использовали Muse Spark 1.1 и 1.2 в Thinking Mode через обычный чат meta.ai, без специального харнеса.

1 минДля профи

Brain-IT реконструирует увиденные изображения по fMRI точнее MindEye2

Учёные представили ИИ-модель Brain-IT, которая реконструирует увиденные человеком изображения по данным функциональной МРТ. Она обошла предыдущие методы по 7 из 8 метрик и показала качественные результаты при 15 минутах записи fMRI нового человека.

2 минДля профи
Вчера

BridgeMind запустили NerfBench для отслеживания деградации моделей после релиза

BridgeMind выпустили NerfBench — бенчмарк для отслеживания «нёрфа» моделей: ухудшения качества, роста расхода токенов или стоимости задачи после релиза. Результат в день выхода модели принимается за 100%, а последующие замеры показывают отклонения.

1 минДля профи

ИИ обходит бухгалтеров по скорости и точности, но не закрывает отчётность сам

Исследование Mercor показало: ИИ-модели решают структурированные задачи бухучёта быстрее, точнее и дешевле лицензированных бухгалтеров. Но почти 60% задач не решены полностью — без надзора человека отчётность не закрыть.

1 минДля профи

50 лет эволюции поиска по коду: что стоит за кодинговыми агентами

Кодинговые агенты вроде Claude Code, Codex и Cursor по-прежнему опираются на технологии поиска по коду, которым от пяти до пятидесяти лет. Об этом рассказывает большая статья на Хабре об эволюции инструментов поиска.

2 минДля профи
1 октября

GPT-6 Astra за 6 часов расшифровала письмо Наполеона, не поддававшееся 217 лет

GPT-6 Astra за 6 часов расшифровала письмо генерала Мармона от 1809 года, которое считалось нераскрытым 217 лет. Пользователь Картер Черч отправил модели только изображение скана и промпт.

1 мин

Meta предложила дать ИИ-агентам контроль над собственным контекстом

Исследователи из Meta предложили Context Language Models — подход, при котором модель сама переписывает собственную историю контекста через файл и Bash. Обучение через RL подняло Qwen3.5–9B на BrowseComp-Plus с 28.8% до 42.5%.

2 минДля профи

Вышла книга о создании автономных ИИ-агентов: от основ до продакшена

На arXiv вышло практическое руководство The Hitchhiker's Guide to Agentic AI. Книга описывает полный стек создания автономных ИИ-систем — от архитектуры трансформеров до продакшена и регулирования.

1 минДля профи

Память агента против окна в миллион токенов: тесты Радианта в Битрикс24

Инженер Битрикс24 Глеб Смольяков сравнил долговременную память агента Радиант с загрузкой истории в контекстное окно на миллион токенов. Радиант нашёл 15 из 15 старых сообщений, но на длинном контексте модель путает похожие факты.

2 минДля профи
30 сентября

Google DeepMind представила SynthID Bio для маркировки ИИ-белков

Google DeepMind представила SynthID Bio — технологию нанесения невидимых водяных знаков на белки, созданные генеративным ИИ. Маркировка сохраняется в физической молекуле и не влияет на её биологическую функцию.

3 минДля профи