Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3385
Widemem: open-source память для агентов с оценкой достоверности, чтобы ИИ говорил «Не знаю»
Обзор Widemem — open-source библиотеки для борьбы с галлюцинациями AI-агентов. Векторный поиск с SQLite, оценка confidence score, интеграция с Ollama. Установка
3386
acestep.cpp: как установить и использовать портируемую реализацию ACE-Step 1.5 для генерации музыки на GGML
Пошаговое руководство по установке и использованию acestep.cpp — портируемой реализации ACE-Step 1.5 для локальной генерации музыки на CPU, CUDA и Metal.
3387
ИИ в геймдеве: как нейросети взорвали индустрию и почему разработчики в ярости
Разбор скандалов с ИИ в геймдеве в 2026 году: мнения Josh Sawyer, Larian, этические дилеммы генерации контента. Актуальные данные на март 2026.
3388
Nemotron-3-Super-120B дистиллирована от Claude 4.6: когда 120 миллиардов параметров помещаются в ваш ноутбук
Практический обзор дистиллированной Nemotron-3-Super-120B от Claude 4.6. Сравнение форматов BF16, FP8, GGUF и инструкция по локальному запуску мощной модели.
3389
SPEED-Bench: когда спекулятивное декодирование перестает быть магией и становится цифрами
Полный обзор SPEED-Bench — нового стандарта для оценки скорости спекулятивного декодирования в больших языковых моделях. Примеры использования и сравнения.
3390
Кейс Т-Банка: как умный фильтр поднял качество AI Code Completion
Как Т-Банк увеличил Acceptance Rate AI-подсказок с 20% до 65% с помощью умного фильтра. Реальный кейс из продакшена.
3391
Автоматизация CRM: пайплайн из YandexGPT и МТС Exolve для Bitrix24 на Python
Пошаговый гайд по созданию пайплайна для автоматической обработки звонков и анализа лидов в Bitrix24 с помощью YandexGPT и МТС Exolve на Python. BANT анализ, ве
3392
AFM MLX: как ускорить локальные LLM на Mac с помощью нативного Swift-инструмента
Узнайте, как AFM MLX ускоряет локальные LLM на Apple Silicon с помощью нативного Swift, batch mode и prefix cache. Сравнение с альтернативами и примеры использо
3393
Гибридное квантование Qwen3.5 27B: сравнение Steampunque Q6_K_H и Unsloth K_XL
Подробный разбор гибридного квантования Qwen3.5 27B. Сравнение производительности, точности и памяти между Steampunque Q6_K_H и Unsloth K_XL. Практический гайд
3394
Виртуальные двойники в медицине: как цифровые копии пациентов спасают жизни
Как Boston Children's Hospital использует виртуальные копии сердца для планирования операций. Технологии, риски и будущее на 19 марта 2026.
3395
Оптимизация AI-агентов для Raspberry Pi: как заменить тяжёлые фреймворки на детерминированный роутинг и LLM
Пошаговый гайд по замене LangChain на легковесную гибридную архитектуру для AI-агентов на Raspberry Pi. Увеличьте скорость в 5 раз и уменьшите потребление памят
3396
Fine-tuning Qwen2-0.5B для автоматизации задач: полный гайд с LoRA, квантованием GGUF и запуском на CPU
Пошаговый гайд по fine-tuning Qwen2-0.5B с помощью LoRA, квантованию в формат GGUF и запуску на обычном CPU для автоматизации задач. Актуально на март 2026.