Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2089
AI-агент для код-ревью: как мы строили на LangGraph и что пошло не так
Реальный опыт построения AI-агента для автоматического код-ревью с LangGraph и GPT-4. Разбираем архитектуру, ошибки и решения. Практические советы и примеры код
2090
Ошибки в пайплайне FLUX-LoRA: как ablation на 75 картинках выявил leak и коллапс
Разбор типичных проблем при обучении LoRA на FLUX.2: training-set leakage, коллапс при scale 2.0 и как single-pass спас пайплайн. Эксперименты, код и советы.
2091
DGX Spark + M3 Ultra: собираем распределённый инференс с разделением prefill/decode на llama.cpp
Эксперимент: разъединяем prefill и decode между DGX Spark и M3 Ultra на llama.cpp. Результаты, команды, узкие места — для тех, кто хочет выжать максимум из гете
2092
Проклятие длинного контекста: как и почему AI-агенты деградируют на длинных сессиях
Разбираем три главные причины деградации AI-агентов на длинных сессиях: цепочка рассуждений, размывание внимания и смещение alignment. Решения из практики инжен
2093
LLMSearchIndex: 200 миллионов страниц для локального RAG — Tavily и Perplexity больше не нужны?
LLMSearchIndex — open-source библиотека с 200 млн проиндексированных страниц для локального веб-поиска в RAG-пайплайнах. Сравнение с альтернативами, примеры код
2094
Llama.cpp MTP: как включить Multi-Token Prediction в бета-версии для ускорения инференса
Как активировать MTP в бета-сборке llama.cpp? Инструкция, тесты скорости на Qwen и Llama, сравнение с mlx-lm и vLLM. Ускорение до 2x на слабом железе.
2095
Когда IoT встречает AI: скрытый технический долг, который взорвет вашу инфраструктуру
AI-инструменты ускоряют разработку IoT, но создают неуправляемый технический долг. Разбираем причины, реальные кейсы и методы борьбы — чтобы ваша экосистема не
2096
Как избежать галлюцинаций LLM-бота в саппорте: паттерн Triage → Gate → Voice
Разбираем архитектурный паттерн, который спасёт ваш AI-саппорт от выдуманных политик. Кейсы Air Canada, Chevrolet и пошаговый план внедрения.
2097
WebMCP: новый стандарт для AI-агентов, меняющий веб-взаимодействие без скриншотов
Разбор WebMCP — протокола, который радикально ускоряет AI-агентов, заменяя скриншоты структурированными данными. Цифры, примеры, потенциал для разработчиков.
2098
Ryzen AI Max+ 495 с 192GB VRAM: прорыв для локальных LLM или только для богатых?
AMD представила Ryzen AI Max+ 495 с невероятными 192 ГБ унифицированной памяти. Выясняем, что это даёт для локального запуска LLM и кому такой процессор реально
2099
Умный анализатор алертов Zabbix на локальной LLM: архитектура, выбор модели и полная реализация
Пошаговое руководство: как интегрировать локальную LLM с Zabbix для автоматического анализа алертов. Архитектура, выбор модели (2026), код вебхука и промпты.
2100
5 структурных ошибок AI-агентов в проде: как не повторить (ни одна не про LLM)
Разбираем 5 фатальных инфраструктурных ошибок AI-агентов: circuit breaker, retry loops, rate limiting, timeouts, синхронная архитектура. Реальные инциденты и ка