Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3493
LLM-as-a-judge: как оценивать RAG-системы и находить слабые места
Глубокий разбор методов оценки RAG с помощью LLM-судьи. Пошаговый план, метрики, поиск слабых мест. Актуально на 2026 год.
3494
Self-Hosting LLM в 2026: кончились деньги на OpenAI, пора собирать свой инференс-сервер
Пошаговое руководство по запуску своей LLM в продакшене. Выбор модели, квантование, подбор GPU и облачного инстанса, деплой. Экономия на API и полный контроль.
3495
Новые модели TheDrummer: обзор Skyfall 31B v4.1, Valkyrie 49B v2.1, Anubis 70B v1.2 и Anubis Mini 8B — как загрузить и использовать
Полный обзор последних моделей TheDrummer от HuggingFace: Skyfall 31B v4.1, Valkyrie 49B v2.1, Anubis 70B v1.2 и Anubis Mini 8B. Инструкция по загрузке и исполь
3496
Open SWE: open-source фреймворк для внутренних coding агентов от LangChain — обзор и возможности
Обзор Open SWE - open-source фреймворка LangChain для внутренних coding агентов. Возможности, сравнение с альтернативами, примеры использования в 2026 году.
3497
ИИ в космосе: как платформа Nvidia Vera Rubin и орбитальные дата-центры изменят спутниковую аналитику
Как платформа Nvidia Vera Rubin и орбитальные дата-центры изменят спутниковую аналитику. Актуально на март 2026.
3498
LangSmith Sandboxes: Как запускать AI-агентов, не взрывая продакшен
Изолированные среды выполнения для AI-агентов. Сравнение с Docker, gVisor, Firecracker. Примеры использования и рекомендации.
3499
Unsloth Studio: когда fine-tuning LLM становится простым как клик
Полный обзор Unsloth Studio 2.0: новый веб-интерфейс для fine-tuning и запуска локальных LLM. Установка через pip, сравнение с LM Studio и Oobabooga, первые шаг
3500
Perch 2.0: Как Google учит нейросеть слушать китов, натренировав её на птицах
Как модель Perch 2.0 использует transfer learning для распознавания китов по звуку, обучаясь на записях птиц. Новости AI и экологии от DeepMind.
3501
Тест мультимодальности Mistral Small 4: почему модель так плохо описывает изображения (с примерами промптов и ответов)
Реальный тест мультимодальности Mistral Small 4: примеры промптов и абсурдных ответов модели. Почему модель плохо описывает изображения и кому она не подходит.
3502
AVP (латентный трансфер): как заставить агентов ИИ работать в 5 раз быстрее и писать код лучше
Техника латентного трансфера для агентов ИИ: ускорение до 5.8x, +14.1% точности кода. Colab notebook, реализация на HuggingFace Transformers 5.0.0.
3503
Blackwell против Hopper: как новые GPU Nvidia переписывают правила игры в AI
Полный разбор архитектуры Nvidia Blackwell: характеристики B100, B200, B300, поддержка FP4, HBM3e память. Сравнение с H100 для сборки AI-серверов в 2026.
3504
Код в долг: как Cursor AI загоняет open-source в техническую кабалу
Новое исследование от Q1 2026 года показывает: AI-кодинг в Cursor IDE ускоряет написание кода, но катастрофически увеличивает технический долг в open-source про