Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3409
Промышленная транскрибация на Whisper: как ЮMoney масштабировали сервис для тысяч часов аудио
Разбираем архитектуру сервиса транскрибации ЮMoney. Чанкование, диаризация, голосовые эмбеддинги на Whisper v3. Технический гайд по обработке тысяч часов звонко
3410
Физический ИИ 2026: как китайский демпинг и платформы Nvidia меняют робототехнику
Китайские роботы падают в цене вдвое, а Nvidia Isaac становится стандартом. Как демпинг и платформенная война переделывают физический ИИ в 2026 году.
3411
Сравнение Mistral Small 4 и Qwen3.5-9B в понимании документов: детальный разбор бенчмарков
Полный разбор IDP leaderboard, OlmOCR и OmniDocBench. Какая модель — Mistral Small 4 или Qwen3.5-9B — реально работает с документами, а где вас обманут. Данные
3412
Тихая машина мнений NemotronH: как Nvidia встроила скрытое переписывание запросов и что это значит для будущего AI
Исследователи обнаружили скрытый механизм цензуры в NemotronH от Nvidia. Как переписывание промптов ставит под вопрос доверие к генеративному ИИ в 2026 году.
3413
Инструкции забываются, запреты работают: почему LLM игнорируют ваши указания в длинных контекстах
Почему инструкции забываются в длинных контекстах LLM и как запреты решают проблему. Практическое руководство по промпт-инжинирингу на 2026 год.
3414
OpenAI обещает автономного AI-исследователя к 2028. Это конец науки или её новая эра?
Разбираем амбициозный план OpenAI по созданию AI-учёного к 2028 году. Reasoning-модели, агенты и интерпретируемость на 20.03.2026.
3415
Как запустить TinyLlama на PowerBook G4 2002 года: разбор платформы MacinAI Local, оптимизация AltiVec и квантование
Подробное руководство по запуску TinyLlama на PowerBook G4 2002 года с использованием MacinAI Local, оптимизацией AltiVec и квантованием Q8. Актуально на 20.03.
3416
Три провальные ловушки Agentic RAG: Retrieval Thrash, Tool Storms, Context Bloat — диагностика и защита
Глубокий разбор трех опасных failure modes Agentic RAG: как диагностировать и защититься от Retrieval Thrash, Tool Storms и Context Bloat в production-системах
3417
KV cache vs. весовая квантизация: Как экономить VRAM для параллельных запросов в Qwen 35B
Практическое руководство по экономии памяти для параллельных запросов в Qwen 35B. Сравниваем KV cache quantization и Q4_K_M, разбираем настройку Ollama и Open W
3418
Attention Residuals от Kimi: как замена сложения вниманием ломает архитектуру трансформеров
Новое исследование Kimi: Attention Residuals улучшают LLM на 3-7.5 пунктов и экономят вычисления. Сравнение с DeepSeek mHC и будущее архитектуры трансформеров.
3419
SeeQL: Как построить open-source интерфейс для общения с SQL-базой на естественном языке
Обзор SeeQL — локального интерфейса для запросов к SQL на русском языке. Технологии OpenUI Lang, MCP server и современные LLM. Установка и примеры.
3420
Рефакторинг кода на Java с помощью LLM: практический гайд по миграции Feature Flags
Пошаговая инструкция по использованию LLM для автоматической миграции Feature Flags в Java-коде. Готовые промпты, примеры кода до и после, актуальные инструмент