Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3781 Разбор Mechanistic Interpretability на практике: как трансформер в 1М параметров жульничает в арифметике Hands-on разбор механистической интерпретируемости: обучаем трансформер на 1М параметров сложению и ловим его на жульничестве. Код на PyTorch, трюки с weight de 7 мин чтения 3782 Скорость генерации LLM: почему 5 токен/с - не предел, и когда токены в секунду действительно важны Глубокий разбор скорости генерации LLM: когда токен/с важен, как выжать максимум из железа и софта, и почему вы измеряете скорость неправильно. Актуально на мар 8 мин чтения 3783 От OCR к ADE: полный гайд по автоматическому пониманию документов с помощью AI Глубокий разбор эволюции обработки документов: от распознавания текста до понимания смысла AI. Практические шаги, актуальные модели и подводные камни. 8 мин чтения 3784 Асинхронное обучение с подкреплением: сравнительный анализ 16 open-source библиотек и оптимизация пайплайна Глубокий технический гайд по асинхронному обучению с подкреплением. Сравниваем 16 open-source библиотек, разбираем управление rollout buffer, staleness manageme 9 мин чтения 3785 Распознавание рукописного текста на Qwen3.5-4B: полное руководство по настройке в llama.cpp Пошаговое руководство по настройке Qwen3.5-4B для OCR рукописного текста в llama.cpp. Квантование GGUF, оптимизация скорости, решение ошибок. 8 мин чтения 3786 Экономика AI: как считать реальную стоимость запроса к LLM с учётом кэша (формула effective cost) Как считать реальную стоимость запроса к LLM с учетом кэширования. Формула effective cost, примеры расчетов для GPT-4.5 и Claude 3.7 на 2026 год. 5 мин чтения 3787 Борьба с галлюцинациями Vision-моделей: как добавить Computer Vision для проверки геометрии (кейс PhotoMentor) Кейс PhotoMentor: как мы победили галлюцинации Gemini в оценке композиции, добавив проверку геометрии через Computer Vision. Пошаговый план и код на 2026 год. 8 мин чтения 3788 Как собрать no-code ИИ-агента для аудита процессов на n8n, Qdrant и Docker: кейс Woyax Соберите локального ИИ-агента для аудита процессов без кода. Практический разбор стека Woyax: n8n для workflow, Qdrant для RAG и Docker для развертывания. 6 мин чтения 3789 Как заставить Qwen 3.5 0.8B играть в DOOM: пошаговый туториал по созданию VLM-агента Полный гайд по созданию VLM-агента на Qwen 3.5 0.8B для игры в DOOM через VizDoom. Установка, код, настройка LM Studio и решение ошибок. 9 мин чтения 3790 Embedding-модели для малоресурсных языков: почему OpenAI и Cohere проигрывают бесплатным LaBSE и E5 (тест на армянском) Почему коммерческие embedding-модели OpenAI и Cohere плохо работают на малоресурсных языках? Тест на армянском показывает преимущество бесплатных LaBSE и E5. 6 мин чтения 3791 Гонка за памятью: как разогнать Gemma-3 на AMD Strix Halo с помощью распределенного финтюнинга Пошаговое руководство по ускорению финтюнинга Gemma-3 на AMD Strix Halo с Unsloth 2026. Распределенное обучение, оптимизация памяти и настройка multi-node трени 7 мин чтения 3792 1-битное квантование — прорыв или провал? Реальные тесты Qwen3.5 и MiniMax в 2026 году Проверяем миф об ультра-низкобитном квантовании. Сравниваем производительность и экономию памяти на моделях Qwen3.5 397B и MiniMax-M2.5. Практическое руководств 8 мин чтения