Исследования · стр. 2

Научные работы, бенчмарки и открытия

30 сентября

Epoch AI: стоимость ИИ падает быстрее закона Мура

Исследовательская фирма Epoch AI выпустила отчёт, согласно которому стоимость использования искусственного интеллекта снижается почти на 50% каждый квартал и в 13 раз за год. Это быстрее, чем падение цен на литиевые батареи, секвенирование ДНК и вычислительные мощности.

2 минДля профи

GPT-6 Astra Pro помогла опровергнуть 59-летнюю гипотезу о стеллараторах

Физик Мэтт Ландреман из стартапа Type One Energy опубликовал на arXiv решения уравнений магнитогидродинамического равновесия, опровергающие гипотезу Гарольда Града 1967 года. В поиске решений использовалась LLM GPT-6 Astra Pro.

2 минДля профи
29 сентября

SWE-Adept: два LLM-агента для анализа кода и решения задач в репозиториях

Исследователи представили SWE-Adept — фреймворк из двух LLM-агентов для работы с большими кодовыми базами. Один агент ищет проблемные места, второй вносит исправления. На бенчмарках SWE-Bench Lite и Pro система улучшила end-to-end resolve rate до 4,3%.

1 минДля профи
28 сентября

Более 20 исследователей ИИ предупредили об «интеллектуальном взрыве»

Более 20 исследователей ИИ, включая Джеффри Хинтона, Йошуа Бенжио и руководителя исследований OpenAI Якуба Пачоцки, предупредили о возможном «интеллектуальном взрыве» из-за самоулучшающегося ИИ. В новой научной работе они призывают политиков получить больше информации о том, как автоматизируются исследования в области ИИ.

1 минДля профи

Учёный усомнился в «открытии» ИИ-биолаборатории Anthropic

Учёный из Копенгагенского университета заявил, что «открытие» ферментов ИИ-агентами Anthropic совпадает с его неопубликованной работой. Anthropic отрицает, что Claude обучался на пользовательских данных.

2 минДля профи

Исследователи: результаты бенчмарков reasoning-моделей зависят от условий оценки

Исследование arXiv:2506.04734 выявило, что результаты бенчмарков reasoning-моделей сильно зависят от условий оценки. Это касается серии Deepseek-R1-Distill, моделей на её основе и QwQ-32B.

1 минДля профи
27 сентября

Учёные дали ИИ-моделям порулить реальной Toyota: доехала только GPT-6 Astra

Исследователи подключили флагманские ИИ-модели к настоящей Toyota Corolla и предложили им проехать размеченный конусами маршрут. Полностью справилась только GPT-6 Astra — со второй попытки, на скорости около 1,5 км/ч.

2 минДля профи

Инженер собрал ML-пайплайн для ранжирования подозрительных транзакций

Старший инженер по данным Максим Коцюба собрал сквозной ML/MLOps-пайплайн для финмониторинга, который ранжирует операции по риску, а не делит их на два класса. Код и MVP опубликованы на GitHub.

2 минДля профи

ИИ-агенты выполняют больше работы, но решения принимают люди

Команда проекта Atria Dawn Preview выяснила, что ИИ-агенты всё чаще выполняют рутинные шаги в разработке моделей, но ключевые решения остаются за людьми. В 96,5% задач использовался ИИ, однако люди принимали 85,5% решений о методах и параметрах.

3 минДля профи

Теория возможностей как альтернатива теории вероятностей в ML

На Хабре разобрали доклад профессора Jeremie Houssineau о теории возможностей — альтернативе теории вероятностей для описания неопределённости в машинном обучении. Для неё уже есть аналог теоремы Байеса и алгоритм оптимизации uCBOpt.

2 минДля профи

Ученые нашли «ось боли» в 25 языковых моделях

Исследователи нашли в 25 языковых моделях с открытыми весами внутреннее направление активаций, которое связали с состоянием, похожим на боль. При его усилении модели чаще выбирали облегчение, даже если это вредило пользователю.

4 минДля профи
26 сентября

Доступ к ИИ почти отучил людей говорить «не знаю»

Пять экспериментов с 3 132 участниками показали: когда рядом есть языковая модель, люди почти перестают признавать незнание. Они отвечают чаще, но правильных ответов становится примерно втрое меньше.

4 минДля профи

Nvidia сократила расход токенов у кодинг-агентов почти вдвое

Исследователи Nvidia создали SoL-Pi — систему, которая автоматически оптимизирует обвязку (harness) кодинг-агентов. На бенчмарке EdgeBench она сокращает расход токенов почти вдвое по сравнению с оригинальной обвязкой Pi.

3 минДля профи

GPT-6 Astra расшифровала сообщение Enigma, хранившее тайну с 1941 года

ИИ-модель GPT-6 Astra расшифровала немецкое военное сообщение MVUEH, зашифрованное машиной Enigma в 1941 году. Шифровка была в открытом доступе с 2005 года, но исходный текст восстановили только сейчас — за два дня.

2 мин

Claude нашёл систему, похожую на CRISPR, но учёные сомневаются в открытии

ИИ-агенты Claude от Anthropic обнаружили в геномных данных бактериофагов неизвестную ферментную систему, напоминающую CRISPR. Учёные и фармкомпании отнеслись к заявлению с осторожностью: функция системы неизвестна, а работа не опубликована в рецензируемом журнале.

2 минДля профи