Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3493 LLM-as-a-judge: как оценивать RAG-системы и находить слабые места Глубокий разбор методов оценки RAG с помощью LLM-судьи. Пошаговый план, метрики, поиск слабых мест. Актуально на 2026 год. 9 мин чтения 3494 Self-Hosting LLM в 2026: кончились деньги на OpenAI, пора собирать свой инференс-сервер Пошаговое руководство по запуску своей LLM в продакшене. Выбор модели, квантование, подбор GPU и облачного инстанса, деплой. Экономия на API и полный контроль. 8 мин чтения 3495 Новые модели TheDrummer: обзор Skyfall 31B v4.1, Valkyrie 49B v2.1, Anubis 70B v1.2 и Anubis Mini 8B — как загрузить и использовать Полный обзор последних моделей TheDrummer от HuggingFace: Skyfall 31B v4.1, Valkyrie 49B v2.1, Anubis 70B v1.2 и Anubis Mini 8B. Инструкция по загрузке и исполь 6 мин чтения 3496 Open SWE: open-source фреймворк для внутренних coding агентов от LangChain — обзор и возможности Обзор Open SWE - open-source фреймворка LangChain для внутренних coding агентов. Возможности, сравнение с альтернативами, примеры использования в 2026 году. 4 мин чтения 3497 ИИ в космосе: как платформа Nvidia Vera Rubin и орбитальные дата-центры изменят спутниковую аналитику Как платформа Nvidia Vera Rubin и орбитальные дата-центры изменят спутниковую аналитику. Актуально на март 2026. 5 мин чтения 3498 LangSmith Sandboxes: Как запускать AI-агентов, не взрывая продакшен Изолированные среды выполнения для AI-агентов. Сравнение с Docker, gVisor, Firecracker. Примеры использования и рекомендации. 5 мин чтения 3499 Unsloth Studio: когда fine-tuning LLM становится простым как клик Полный обзор Unsloth Studio 2.0: новый веб-интерфейс для fine-tuning и запуска локальных LLM. Установка через pip, сравнение с LM Studio и Oobabooga, первые шаг 6 мин чтения 3500 Perch 2.0: Как Google учит нейросеть слушать китов, натренировав её на птицах Как модель Perch 2.0 использует transfer learning для распознавания китов по звуку, обучаясь на записях птиц. Новости AI и экологии от DeepMind. 4 мин чтения 3501 Тест мультимодальности Mistral Small 4: почему модель так плохо описывает изображения (с примерами промптов и ответов) Реальный тест мультимодальности Mistral Small 4: примеры промптов и абсурдных ответов модели. Почему модель плохо описывает изображения и кому она не подходит. 3 мин чтения 3502 AVP (латентный трансфер): как заставить агентов ИИ работать в 5 раз быстрее и писать код лучше Техника латентного трансфера для агентов ИИ: ускорение до 5.8x, +14.1% точности кода. Colab notebook, реализация на HuggingFace Transformers 5.0.0. 7 мин чтения 3503 Blackwell против Hopper: как новые GPU Nvidia переписывают правила игры в AI Полный разбор архитектуры Nvidia Blackwell: характеристики B100, B200, B300, поддержка FP4, HBM3e память. Сравнение с H100 для сборки AI-серверов в 2026. 5 мин чтения 3504 Код в долг: как Cursor AI загоняет open-source в техническую кабалу Новое исследование от Q1 2026 года показывает: AI-кодинг в Cursor IDE ускоряет написание кода, но катастрофически увеличивает технический долг в open-source про 4 мин чтения