Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2617 RT-ядра NVIDIA ускоряют MoE в 218 раз: как заставить трассировку лучей работать на AI Подробный разбор метода ускорения маршрутизации в Mixture-of-Experts моделях с помощью RT-ядер NVIDIA. Практическая настройка на RTX 5070 Ti, код, ошибки и срав 7 мин чтения 2618 Hugging Face Kernels: репозитории, которые наконец-то объединили код и модель Что такое Hugging Face Kernels, как они меняют рабочий процесс Data Science и кому стоит переходить на них прямо сейчас. Обзор актуальный на апрель 2026. 6 мин чтения 2619 Конец эры LLM-оберток: почему будущее за специализированными и распределенными AI-системами Инвесторы массово отказываются от стартапов-оберток поверх GPT. Анализ архитектурного сдвига к распределенным и специализированным системам AI. Что ждет рынок в 5 мин чтения 2620 Тихая смена лицензии OpenWork: как защититься от рисков с open-source AI проектами Скандальная тихая смена лицензии OpenWork с MIT на коммерческую в марте 2026. Как защитить свои проекты от рисков перелицензирования. 4 мин чтения 2621 Off Grid: полный гайд по запуску Gemma 4 на смартфоне без облака и интернета Полное руководство по установке и использованию Off Grid для запуска Gemma 4 на Android и iOS без интернета. Работа с документами и кодом оффлайн в 2026 году. 6 мин чтения 2622 Как обновить Mamba 1 и 2 до Mamba 3: методология переноса весов и экономия VRAM Практическое руководство по переносу весов между архитектурами Mamba без обучения с нуля. Экономия времени и VRAM до 12 GB. 7 мин чтения 2623 Провал Opus 4.6: как локальная Gemma 4 31B UD выигрывает в carwash-тесте на видеокарте NVIDIA Сравнение Opus 4.6 и Gemma 4 31B UD в carwash-тесте показывает удивительную деградацию коммерческой модели Anthropic. Локальная Gemma с IQ3 XXS квантованием поб 4 мин чтения 2624 Как обработать 940 000 PDF за день: разгон OCR, обход PaddleOCR и настройка Turbo-OCR Подробный гайд по обработке 940000 PDF за 24 часа. Решаем проблемы PaddleOCR, настраиваем Turbo-OCR на RTX 5090, достигаем 15 img/s. Актуально на 2026 год. 9 мин чтения 2625 Как Qwen 3.5-27B автоматически строит backend-системы: разбор AutoBe и экономия до 25 раз Как инструмент AutoBe с моделью Qwen 3.5-27B автоматически создает backend. Разбор возможностей, сравнение с аналогами и реальная экономия до 25 раз на разработ 5 мин чтения 2626 Семантический поиск по аудио: глубокий разбор работы с Amazon Nova Embeddings Полное руководство по семантическому поиску по аудио с использованием Amazon Nova Multimodal Embeddings. Как искать по тону, эмоциям и звукам. Актуально на 2026 9 мин чтения 2627 Почему топовые модели Opus, Gemini и ChatGPT пропали из LMSys Arena: разбор скандала и последствия для бенчмарков Внезапное исчезновение топовых AI-моделей из рейтинга LMSys Arena вызвало скандал. Разбираем причины и последствия для будущего бенчмарков. 5 мин чтения 2628 Как запустить трансформерную модель на Commodore 64: от безумия к рабочему прототипу Пошаговое руководство по запуску трансформерной модели на Commodore 64. Техники сжатия, квантования и ассемблерной оптимизации для экстремально ограниченных рес 9 мин чтения