Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3349
Математика сбоя AI-агентов: почему 85% точности - это катастрофа (разбор инцидента с Replit)
Анализ инцидента с удалением БД в Replit. Математика вероятности сбоя AI-агентов. Почему 85% точности недостаточно для продакшена на 20.03.2026.
3350
Inline Visualizer: Интерактивные графики в чате с локальными LLM без облаков
Обзор Inline Visualizer — open-source инструмента для создания интерактивных диаграмм в чате с локальными LLM. Работает с любыми моделями, поддерживающими tool
3351
LMStudio вводит аккаунты: угроза приватности или шаг вперёд?
LMStudio вводит обязательные аккаунты. Разбираем, чем это грозит приватности и какие есть альтернативы для локальных LLM в 2026 году.
3352
Промышленная транскрибация на Whisper: как ЮMoney масштабировали сервис для тысяч часов аудио
Разбираем архитектуру сервиса транскрибации ЮMoney. Чанкование, диаризация, голосовые эмбеддинги на Whisper v3. Технический гайд по обработке тысяч часов звонко
3353
Физический ИИ 2026: как китайский демпинг и платформы Nvidia меняют робототехнику
Китайские роботы падают в цене вдвое, а Nvidia Isaac становится стандартом. Как демпинг и платформенная война переделывают физический ИИ в 2026 году.
3354
Сравнение Mistral Small 4 и Qwen3.5-9B в понимании документов: детальный разбор бенчмарков
Полный разбор IDP leaderboard, OlmOCR и OmniDocBench. Какая модель — Mistral Small 4 или Qwen3.5-9B — реально работает с документами, а где вас обманут. Данные
3355
Тихая машина мнений NemotronH: как Nvidia встроила скрытое переписывание запросов и что это значит для будущего AI
Исследователи обнаружили скрытый механизм цензуры в NemotronH от Nvidia. Как переписывание промптов ставит под вопрос доверие к генеративному ИИ в 2026 году.
3356
Инструкции забываются, запреты работают: почему LLM игнорируют ваши указания в длинных контекстах
Почему инструкции забываются в длинных контекстах LLM и как запреты решают проблему. Практическое руководство по промпт-инжинирингу на 2026 год.
3357
OpenAI обещает автономного AI-исследователя к 2028. Это конец науки или её новая эра?
Разбираем амбициозный план OpenAI по созданию AI-учёного к 2028 году. Reasoning-модели, агенты и интерпретируемость на 20.03.2026.
3358
Как запустить TinyLlama на PowerBook G4 2002 года: разбор платформы MacinAI Local, оптимизация AltiVec и квантование
Подробное руководство по запуску TinyLlama на PowerBook G4 2002 года с использованием MacinAI Local, оптимизацией AltiVec и квантованием Q8. Актуально на 20.03.
3359
Три провальные ловушки Agentic RAG: Retrieval Thrash, Tool Storms, Context Bloat — диагностика и защита
Глубокий разбор трех опасных failure modes Agentic RAG: как диагностировать и защититься от Retrieval Thrash, Tool Storms и Context Bloat в production-системах
3360
KV cache vs. весовая квантизация: Как экономить VRAM для параллельных запросов в Qwen 35B
Практическое руководство по экономии памяти для параллельных запросов в Qwen 35B. Сравниваем KV cache quantization и Q4_K_M, разбираем настройку Ollama и Open W