Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3349 Математика сбоя AI-агентов: почему 85% точности - это катастрофа (разбор инцидента с Replit) Анализ инцидента с удалением БД в Replit. Математика вероятности сбоя AI-агентов. Почему 85% точности недостаточно для продакшена на 20.03.2026. 6 мин чтения 3350 Inline Visualizer: Интерактивные графики в чате с локальными LLM без облаков Обзор Inline Visualizer — open-source инструмента для создания интерактивных диаграмм в чате с локальными LLM. Работает с любыми моделями, поддерживающими tool 5 мин чтения 3351 LMStudio вводит аккаунты: угроза приватности или шаг вперёд? LMStudio вводит обязательные аккаунты. Разбираем, чем это грозит приватности и какие есть альтернативы для локальных LLM в 2026 году. 4 мин чтения 3352 Промышленная транскрибация на Whisper: как ЮMoney масштабировали сервис для тысяч часов аудио Разбираем архитектуру сервиса транскрибации ЮMoney. Чанкование, диаризация, голосовые эмбеддинги на Whisper v3. Технический гайд по обработке тысяч часов звонко 9 мин чтения 3353 Физический ИИ 2026: как китайский демпинг и платформы Nvidia меняют робототехнику Китайские роботы падают в цене вдвое, а Nvidia Isaac становится стандартом. Как демпинг и платформенная война переделывают физический ИИ в 2026 году. 4 мин чтения 3354 Сравнение Mistral Small 4 и Qwen3.5-9B в понимании документов: детальный разбор бенчмарков Полный разбор IDP leaderboard, OlmOCR и OmniDocBench. Какая модель — Mistral Small 4 или Qwen3.5-9B — реально работает с документами, а где вас обманут. Данные 7 мин чтения 3355 Тихая машина мнений NemotronH: как Nvidia встроила скрытое переписывание запросов и что это значит для будущего AI Исследователи обнаружили скрытый механизм цензуры в NemotronH от Nvidia. Как переписывание промптов ставит под вопрос доверие к генеративному ИИ в 2026 году. 5 мин чтения 3356 Инструкции забываются, запреты работают: почему LLM игнорируют ваши указания в длинных контекстах Почему инструкции забываются в длинных контекстах LLM и как запреты решают проблему. Практическое руководство по промпт-инжинирингу на 2026 год. 7 мин чтения 3357 OpenAI обещает автономного AI-исследователя к 2028. Это конец науки или её новая эра? Разбираем амбициозный план OpenAI по созданию AI-учёного к 2028 году. Reasoning-модели, агенты и интерпретируемость на 20.03.2026. 5 мин чтения 3358 Как запустить TinyLlama на PowerBook G4 2002 года: разбор платформы MacinAI Local, оптимизация AltiVec и квантование Подробное руководство по запуску TinyLlama на PowerBook G4 2002 года с использованием MacinAI Local, оптимизацией AltiVec и квантованием Q8. Актуально на 20.03. 7 мин чтения 3359 Три провальные ловушки Agentic RAG: Retrieval Thrash, Tool Storms, Context Bloat — диагностика и защита Глубокий разбор трех опасных failure modes Agentic RAG: как диагностировать и защититься от Retrieval Thrash, Tool Storms и Context Bloat в production-системах 8 мин чтения 3360 KV cache vs. весовая квантизация: Как экономить VRAM для параллельных запросов в Qwen 35B Практическое руководство по экономии памяти для параллельных запросов в Qwen 35B. Сравниваем KV cache quantization и Q4_K_M, разбираем настройку Ollama и Open W 12 мин чтения