Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2089 AI-агент для код-ревью: как мы строили на LangGraph и что пошло не так Реальный опыт построения AI-агента для автоматического код-ревью с LangGraph и GPT-4. Разбираем архитектуру, ошибки и решения. Практические советы и примеры код 6 мин чтения 2090 Ошибки в пайплайне FLUX-LoRA: как ablation на 75 картинках выявил leak и коллапс Разбор типичных проблем при обучении LoRA на FLUX.2: training-set leakage, коллапс при scale 2.0 и как single-pass спас пайплайн. Эксперименты, код и советы. 6 мин чтения 2091 DGX Spark + M3 Ultra: собираем распределённый инференс с разделением prefill/decode на llama.cpp Эксперимент: разъединяем prefill и decode между DGX Spark и M3 Ultra на llama.cpp. Результаты, команды, узкие места — для тех, кто хочет выжать максимум из гете 8 мин чтения 2092 Проклятие длинного контекста: как и почему AI-агенты деградируют на длинных сессиях Разбираем три главные причины деградации AI-агентов на длинных сессиях: цепочка рассуждений, размывание внимания и смещение alignment. Решения из практики инжен 4 мин чтения 2093 LLMSearchIndex: 200 миллионов страниц для локального RAG — Tavily и Perplexity больше не нужны? LLMSearchIndex — open-source библиотека с 200 млн проиндексированных страниц для локального веб-поиска в RAG-пайплайнах. Сравнение с альтернативами, примеры код 5 мин чтения 2094 Llama.cpp MTP: как включить Multi-Token Prediction в бета-версии для ускорения инференса Как активировать MTP в бета-сборке llama.cpp? Инструкция, тесты скорости на Qwen и Llama, сравнение с mlx-lm и vLLM. Ускорение до 2x на слабом железе. 7 мин чтения 2095 Когда IoT встречает AI: скрытый технический долг, который взорвет вашу инфраструктуру AI-инструменты ускоряют разработку IoT, но создают неуправляемый технический долг. Разбираем причины, реальные кейсы и методы борьбы — чтобы ваша экосистема не 6 мин чтения 2096 Как избежать галлюцинаций LLM-бота в саппорте: паттерн Triage → Gate → Voice Разбираем архитектурный паттерн, который спасёт ваш AI-саппорт от выдуманных политик. Кейсы Air Canada, Chevrolet и пошаговый план внедрения. 8 мин чтения 2097 WebMCP: новый стандарт для AI-агентов, меняющий веб-взаимодействие без скриншотов Разбор WebMCP — протокола, который радикально ускоряет AI-агентов, заменяя скриншоты структурированными данными. Цифры, примеры, потенциал для разработчиков. 5 мин чтения 2098 Ryzen AI Max+ 495 с 192GB VRAM: прорыв для локальных LLM или только для богатых? AMD представила Ryzen AI Max+ 495 с невероятными 192 ГБ унифицированной памяти. Выясняем, что это даёт для локального запуска LLM и кому такой процессор реально 5 мин чтения 2099 Умный анализатор алертов Zabbix на локальной LLM: архитектура, выбор модели и полная реализация Пошаговое руководство: как интегрировать локальную LLM с Zabbix для автоматического анализа алертов. Архитектура, выбор модели (2026), код вебхука и промпты. 7 мин чтения 2100 5 структурных ошибок AI-агентов в проде: как не повторить (ни одна не про LLM) Разбираем 5 фатальных инфраструктурных ошибок AI-агентов: circuit breaker, retry loops, rate limiting, timeouts, синхронная архитектура. Реальные инциденты и ка 4 мин чтения