Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3385 Widemem: open-source память для агентов с оценкой достоверности, чтобы ИИ говорил «Не знаю» Обзор Widemem — open-source библиотеки для борьбы с галлюцинациями AI-агентов. Векторный поиск с SQLite, оценка confidence score, интеграция с Ollama. Установка 5 мин чтения 3386 acestep.cpp: как установить и использовать портируемую реализацию ACE-Step 1.5 для генерации музыки на GGML Пошаговое руководство по установке и использованию acestep.cpp — портируемой реализации ACE-Step 1.5 для локальной генерации музыки на CPU, CUDA и Metal. 6 мин чтения 3387 ИИ в геймдеве: как нейросети взорвали индустрию и почему разработчики в ярости Разбор скандалов с ИИ в геймдеве в 2026 году: мнения Josh Sawyer, Larian, этические дилеммы генерации контента. Актуальные данные на март 2026. 4 мин чтения 3388 Nemotron-3-Super-120B дистиллирована от Claude 4.6: когда 120 миллиардов параметров помещаются в ваш ноутбук Практический обзор дистиллированной Nemotron-3-Super-120B от Claude 4.6. Сравнение форматов BF16, FP8, GGUF и инструкция по локальному запуску мощной модели. 5 мин чтения 3389 SPEED-Bench: когда спекулятивное декодирование перестает быть магией и становится цифрами Полный обзор SPEED-Bench — нового стандарта для оценки скорости спекулятивного декодирования в больших языковых моделях. Примеры использования и сравнения. 5 мин чтения 3390 Кейс Т-Банка: как умный фильтр поднял качество AI Code Completion Как Т-Банк увеличил Acceptance Rate AI-подсказок с 20% до 65% с помощью умного фильтра. Реальный кейс из продакшена. 3 мин чтения 3391 Автоматизация CRM: пайплайн из YandexGPT и МТС Exolve для Bitrix24 на Python Пошаговый гайд по созданию пайплайна для автоматической обработки звонков и анализа лидов в Bitrix24 с помощью YandexGPT и МТС Exolve на Python. BANT анализ, ве 8 мин чтения 3392 AFM MLX: как ускорить локальные LLM на Mac с помощью нативного Swift-инструмента Узнайте, как AFM MLX ускоряет локальные LLM на Apple Silicon с помощью нативного Swift, batch mode и prefix cache. Сравнение с альтернативами и примеры использо 4 мин чтения 3393 Гибридное квантование Qwen3.5 27B: сравнение Steampunque Q6_K_H и Unsloth K_XL Подробный разбор гибридного квантования Qwen3.5 27B. Сравнение производительности, точности и памяти между Steampunque Q6_K_H и Unsloth K_XL. Практический гайд 7 мин чтения 3394 Виртуальные двойники в медицине: как цифровые копии пациентов спасают жизни Как Boston Children's Hospital использует виртуальные копии сердца для планирования операций. Технологии, риски и будущее на 19 марта 2026. 5 мин чтения 3395 Оптимизация AI-агентов для Raspberry Pi: как заменить тяжёлые фреймворки на детерминированный роутинг и LLM Пошаговый гайд по замене LangChain на легковесную гибридную архитектуру для AI-агентов на Raspberry Pi. Увеличьте скорость в 5 раз и уменьшите потребление памят 9 мин чтения 3396 Fine-tuning Qwen2-0.5B для автоматизации задач: полный гайд с LoRA, квантованием GGUF и запуском на CPU Пошаговый гайд по fine-tuning Qwen2-0.5B с помощью LoRA, квантованию в формат GGUF и запуску на обычном CPU для автоматизации задач. Актуально на март 2026. 7 мин чтения