Почему зелёный пайплайн не гарантирует качество ML-модели
Зелёная галочка в CI не означает, что модель готова к проду. Автор на Хабре разобрал семь способов, которыми quality gate пропускает брак, — от утечек между train и test до shortcut learning.
Как пользоваться ИИ: инструкции и разборы
Зелёная галочка в CI не означает, что модель готова к проду. Автор на Хабре разобрал семь способов, которыми quality gate пропускает брак, — от утечек между train и test до shortcut learning.
Руководитель ИИ-проектов Игорь Зуриев рассказал, как выбирать LLM для рабочих задач. Он предлагает оценивать модели не по бенчмаркам, а по трём критериям: результат, объём ручных правок и проверяемость.
Автор развернул Gemma 4 26B A4B в Q4-кванте на облачном сервере с RTX 4090 и запустил её двумя способами — через Ollama и напрямую через llama.cpp. Он описал установку, настройку HTTP API и подготовку к замерам скорости.
Автор на Хабре собрал подборку из шести сервисов, где можно получить доступ к топовым моделям вроде Claude и GPT без привязки банковской карты. Часть площадок выдаёт стартовые кредиты, часть — суточные лимиты токенов.
На Хабре вышла статья о том, как делегирование ИИ-ассистентам не только рутины, но и самого процесса мышления ведёт к потере профессиональных навыков. Автор приводит три кейса: senior, DevOps и data scientist, которые разучились работать без подсказок модели.
Кодовый агент уверенно находит файл, меняет не тот счётчик и отчитывается о завершении задачи. Проблема не в модели, а в отсутствии переданного намерения. Разбор практики SDD для небольших проектов: четыре коротких файла, которые дают агенту рабочую модель репозитория.
Из 243 ссылок в ответах Алисы AI и Perplexity на 14 покупательских вопросов только 10 вели на карточки товаров. Чаще нейросети ссылаются на разделы каталога и страницы условий.
Для разных задач нужны разные ИИ-модели: одни быстрее и дешевле, другие точнее в анализе или кодинге. Маршрутизация помогает распределять запросы между моделями, чтобы не платить за избыточную мощность.
Энтузиаст разогнал локальную Qwen3.8–27B Q4 на двух RTX 3060 12 ГБ с 9 до 39,6 токенов/с в реальной сессии OpenCode при контексте 128K. Ключевым изменением стал переход с распределения по слоям на тензорное распараллеливание в llama.cpp.
Tech Lead Сергей Прощаев описал семь ошибок в eval-обвязке AI-агентов, из-за которых тесты показывают успех, а о деградации команда узнаёт от поддержки. Главная причина — проверка финального текста вместо состояния системы.
В Claude Code разобрали механику агентов: изоляция контекста, параллельный запуск и настройка постоянных агентов через файлы в ~/.claude/agents/. На живой задаче четыре агента параллельно разобрали 13 статей за 30 минут.
Ведущий ML-разработчик Магнита Стас Чернышев описал, как команда поиска MAGNIT OMNI задеплоила векторный поиск на NVIDIA Triton Inference Server без GPU. Python оставили только для токенизации, а тело модели вынесли в ONNX.
Разработчик сервиса дубляжа speeek описал, как Whisper ошибается в продакшене и какие костыли помогают это ловить. За 2026 год через его конвейер прошло 9 203 задачи.
Нейросети всё чаще отвечают на вопросы «кого выбрать», формируя готовую рекомендацию вместо списка ссылок. Разбираем, как работает generative engine optimization и какие шаги помогают бизнесу попасть в ответы ИИ.
При подключении GigaChat API к self-hosted n8n в Docker возникает ошибка SSL-верификации: Node.js не доверяет сертификатам Минцифры. Решение — добавить корневой сертификат через NODE_EXTRA_CA_CERTS, а не отключать проверку.