Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7441 PaddleOCR в полностью офлайн-режиме: как отключить загрузку моделей и использовать локальные файлы Пошаговое руководство по настройке PaddleOCR для работы без интернета. Учимся загружать модели локально, отключать автоматические загрузки и настраивать конфигу 11 мин чтения 7442 Январь 2026: Три модели, которые изменят всё. MiniMax-M2.1, LTX-2 и Qwen-Image Что нового в AI в январе 2026? Разбираем MiniMax-M2.1 для кода, LTX-2 для мультимодальности и Qwen-Image для изображений. Как их запустить. 6 мин чтения 7443 ИИ против UGC: как AI-ассистенты убьют ваш трафик и что делать уже сейчас Почему AI-ассистенты поиска уничтожат традиционный трафик сайтов. Стратегии для B2B контента и UGC платформ в новой реальности. 5 мин чтения 7444 Как настроить локальную LLM для долгой памяти: практическое руководство по оптимизации контекста Пошаговое руководство по настройке локальной LLM для работы с длинным контекстом. Оптимизация памяти, производительности и настройка Qwen 3 30B для долгих диало 6 мин чтения 7445 PlexMCP: универсальный шлюз для подключения локальных LLM к любым инструментам (MCP) Обзор PlexMCP — универсального шлюза для подключения локальных LLM (ollama, llama.cpp) к любым MCP-серверам. Установка через Docker, сравнение с альтернативами. 4 мин чтения 7446 Поиск для AI-агентов: сжимаем латентность с 3500 мс до 700 мс Практическое руководство по ускорению поиска для AI-агентов: распределённые прокси, параллельный скрейпинг, кастомная экстракция Markdown. Реальные цифры и гото 8 мин чтения 7447 Держите свой JSON: как заставить Mistral и Llama 3.1 перестать болтать и начать парсить Практическое сравнение методов получения стабильного JSON из локальных моделей. Промпты, настройки температуры и реальные тесты. 7 мин чтения 7448 Claude Code: от промпта до продакшена без иллюзий Разбираем Claude Code на косточки: реальные кейсы автоматизации, конвейеры данных, браузерное тестирование и хуки безопасности. Не теория, а практика. 6 мин чтения 7449 WebSearch AI: как запустить локальную модель с поиском в интернете на слабом железе Обзор WebSearch AI - инструмента для запуска локальной LLM с доступом в интернет на слабом железе. Llama.cpp, PySide6, низкое потребление памяти. 5 мин чтения 7450 MoE на T4: как найти и устранить узкие места в обучении Подробный гайд по профилированию и оптимизации MoE-моделей на T4: от CUDA kernel анализа до настройки gradient accumulation. 7 мин чтения 7451 Почему кастомные CUDA-ядра не дают ускорения в реальном обучении: разбор типичных ошибок Разбираем, почему кастомные CUDA-ядра PyTorch не дают ускорения в реальных задачах. Silent fallback, микробенчмарки, ошибки интеграции и оптимизации. 7 мин чтения 7452 NVIDIA Cosmos Reason 2: робот, который думает физикой, а не текстом Обзор NVIDIA Cosmos Reason 2 - модели для физического ИИ с 2B и 8B параметрами. Возможности, сравнение с альтернативами, примеры использования в робототехнике. 6 мин чтения