Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7441
PaddleOCR в полностью офлайн-режиме: как отключить загрузку моделей и использовать локальные файлы
Пошаговое руководство по настройке PaddleOCR для работы без интернета. Учимся загружать модели локально, отключать автоматические загрузки и настраивать конфигу
7442
Январь 2026: Три модели, которые изменят всё. MiniMax-M2.1, LTX-2 и Qwen-Image
Что нового в AI в январе 2026? Разбираем MiniMax-M2.1 для кода, LTX-2 для мультимодальности и Qwen-Image для изображений. Как их запустить.
7443
ИИ против UGC: как AI-ассистенты убьют ваш трафик и что делать уже сейчас
Почему AI-ассистенты поиска уничтожат традиционный трафик сайтов. Стратегии для B2B контента и UGC платформ в новой реальности.
7444
Как настроить локальную LLM для долгой памяти: практическое руководство по оптимизации контекста
Пошаговое руководство по настройке локальной LLM для работы с длинным контекстом. Оптимизация памяти, производительности и настройка Qwen 3 30B для долгих диало
7445
PlexMCP: универсальный шлюз для подключения локальных LLM к любым инструментам (MCP)
Обзор PlexMCP — универсального шлюза для подключения локальных LLM (ollama, llama.cpp) к любым MCP-серверам. Установка через Docker, сравнение с альтернативами.
7446
Поиск для AI-агентов: сжимаем латентность с 3500 мс до 700 мс
Практическое руководство по ускорению поиска для AI-агентов: распределённые прокси, параллельный скрейпинг, кастомная экстракция Markdown. Реальные цифры и гото
7447
Держите свой JSON: как заставить Mistral и Llama 3.1 перестать болтать и начать парсить
Практическое сравнение методов получения стабильного JSON из локальных моделей. Промпты, настройки температуры и реальные тесты.
7448
Claude Code: от промпта до продакшена без иллюзий
Разбираем Claude Code на косточки: реальные кейсы автоматизации, конвейеры данных, браузерное тестирование и хуки безопасности. Не теория, а практика.
7449
WebSearch AI: как запустить локальную модель с поиском в интернете на слабом железе
Обзор WebSearch AI - инструмента для запуска локальной LLM с доступом в интернет на слабом железе. Llama.cpp, PySide6, низкое потребление памяти.
7450
MoE на T4: как найти и устранить узкие места в обучении
Подробный гайд по профилированию и оптимизации MoE-моделей на T4: от CUDA kernel анализа до настройки gradient accumulation.
7451
Почему кастомные CUDA-ядра не дают ускорения в реальном обучении: разбор типичных ошибок
Разбираем, почему кастомные CUDA-ядра PyTorch не дают ускорения в реальных задачах. Silent fallback, микробенчмарки, ошибки интеграции и оптимизации.
7452
NVIDIA Cosmos Reason 2: робот, который думает физикой, а не текстом
Обзор NVIDIA Cosmos Reason 2 - модели для физического ИИ с 2B и 8B параметрами. Возможности, сравнение с альтернативами, примеры использования в робототехнике.