Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3409 Промышленная транскрибация на Whisper: как ЮMoney масштабировали сервис для тысяч часов аудио Разбираем архитектуру сервиса транскрибации ЮMoney. Чанкование, диаризация, голосовые эмбеддинги на Whisper v3. Технический гайд по обработке тысяч часов звонко 9 мин чтения 3410 Физический ИИ 2026: как китайский демпинг и платформы Nvidia меняют робототехнику Китайские роботы падают в цене вдвое, а Nvidia Isaac становится стандартом. Как демпинг и платформенная война переделывают физический ИИ в 2026 году. 4 мин чтения 3411 Сравнение Mistral Small 4 и Qwen3.5-9B в понимании документов: детальный разбор бенчмарков Полный разбор IDP leaderboard, OlmOCR и OmniDocBench. Какая модель — Mistral Small 4 или Qwen3.5-9B — реально работает с документами, а где вас обманут. Данные 7 мин чтения 3412 Тихая машина мнений NemotronH: как Nvidia встроила скрытое переписывание запросов и что это значит для будущего AI Исследователи обнаружили скрытый механизм цензуры в NemotronH от Nvidia. Как переписывание промптов ставит под вопрос доверие к генеративному ИИ в 2026 году. 5 мин чтения 3413 Инструкции забываются, запреты работают: почему LLM игнорируют ваши указания в длинных контекстах Почему инструкции забываются в длинных контекстах LLM и как запреты решают проблему. Практическое руководство по промпт-инжинирингу на 2026 год. 7 мин чтения 3414 OpenAI обещает автономного AI-исследователя к 2028. Это конец науки или её новая эра? Разбираем амбициозный план OpenAI по созданию AI-учёного к 2028 году. Reasoning-модели, агенты и интерпретируемость на 20.03.2026. 5 мин чтения 3415 Как запустить TinyLlama на PowerBook G4 2002 года: разбор платформы MacinAI Local, оптимизация AltiVec и квантование Подробное руководство по запуску TinyLlama на PowerBook G4 2002 года с использованием MacinAI Local, оптимизацией AltiVec и квантованием Q8. Актуально на 20.03. 7 мин чтения 3416 Три провальные ловушки Agentic RAG: Retrieval Thrash, Tool Storms, Context Bloat — диагностика и защита Глубокий разбор трех опасных failure modes Agentic RAG: как диагностировать и защититься от Retrieval Thrash, Tool Storms и Context Bloat в production-системах 8 мин чтения 3417 KV cache vs. весовая квантизация: Как экономить VRAM для параллельных запросов в Qwen 35B Практическое руководство по экономии памяти для параллельных запросов в Qwen 35B. Сравниваем KV cache quantization и Q4_K_M, разбираем настройку Ollama и Open W 12 мин чтения 3418 Attention Residuals от Kimi: как замена сложения вниманием ломает архитектуру трансформеров Новое исследование Kimi: Attention Residuals улучшают LLM на 3-7.5 пунктов и экономят вычисления. Сравнение с DeepSeek mHC и будущее архитектуры трансформеров. 4 мин чтения 3419 SeeQL: Как построить open-source интерфейс для общения с SQL-базой на естественном языке Обзор SeeQL — локального интерфейса для запросов к SQL на русском языке. Технологии OpenUI Lang, MCP server и современные LLM. Установка и примеры. 5 мин чтения 3420 Рефакторинг кода на Java с помощью LLM: практический гайд по миграции Feature Flags Пошаговая инструкция по использованию LLM для автоматической миграции Feature Flags в Java-коде. Готовые промпты, примеры кода до и после, актуальные инструмент 7 мин чтения