Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2617
RT-ядра NVIDIA ускоряют MoE в 218 раз: как заставить трассировку лучей работать на AI
Подробный разбор метода ускорения маршрутизации в Mixture-of-Experts моделях с помощью RT-ядер NVIDIA. Практическая настройка на RTX 5070 Ti, код, ошибки и срав
2618
Hugging Face Kernels: репозитории, которые наконец-то объединили код и модель
Что такое Hugging Face Kernels, как они меняют рабочий процесс Data Science и кому стоит переходить на них прямо сейчас. Обзор актуальный на апрель 2026.
2619
Конец эры LLM-оберток: почему будущее за специализированными и распределенными AI-системами
Инвесторы массово отказываются от стартапов-оберток поверх GPT. Анализ архитектурного сдвига к распределенным и специализированным системам AI. Что ждет рынок в
2620
Тихая смена лицензии OpenWork: как защититься от рисков с open-source AI проектами
Скандальная тихая смена лицензии OpenWork с MIT на коммерческую в марте 2026. Как защитить свои проекты от рисков перелицензирования.
2621
Off Grid: полный гайд по запуску Gemma 4 на смартфоне без облака и интернета
Полное руководство по установке и использованию Off Grid для запуска Gemma 4 на Android и iOS без интернета. Работа с документами и кодом оффлайн в 2026 году.
2622
Как обновить Mamba 1 и 2 до Mamba 3: методология переноса весов и экономия VRAM
Практическое руководство по переносу весов между архитектурами Mamba без обучения с нуля. Экономия времени и VRAM до 12 GB.
2623
Провал Opus 4.6: как локальная Gemma 4 31B UD выигрывает в carwash-тесте на видеокарте NVIDIA
Сравнение Opus 4.6 и Gemma 4 31B UD в carwash-тесте показывает удивительную деградацию коммерческой модели Anthropic. Локальная Gemma с IQ3 XXS квантованием поб
2624
Как обработать 940 000 PDF за день: разгон OCR, обход PaddleOCR и настройка Turbo-OCR
Подробный гайд по обработке 940000 PDF за 24 часа. Решаем проблемы PaddleOCR, настраиваем Turbo-OCR на RTX 5090, достигаем 15 img/s. Актуально на 2026 год.
2625
Как Qwen 3.5-27B автоматически строит backend-системы: разбор AutoBe и экономия до 25 раз
Как инструмент AutoBe с моделью Qwen 3.5-27B автоматически создает backend. Разбор возможностей, сравнение с аналогами и реальная экономия до 25 раз на разработ
2626
Семантический поиск по аудио: глубокий разбор работы с Amazon Nova Embeddings
Полное руководство по семантическому поиску по аудио с использованием Amazon Nova Multimodal Embeddings. Как искать по тону, эмоциям и звукам. Актуально на 2026
2627
Почему топовые модели Opus, Gemini и ChatGPT пропали из LMSys Arena: разбор скандала и последствия для бенчмарков
Внезапное исчезновение топовых AI-моделей из рейтинга LMSys Arena вызвало скандал. Разбираем причины и последствия для будущего бенчмарков.
2628
Как запустить трансформерную модель на Commodore 64: от безумия к рабочему прототипу
Пошаговое руководство по запуску трансформерной модели на Commodore 64. Техники сжатия, квантования и ассемблерной оптимизации для экстремально ограниченных рес