Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7753
Карта инвестиций Nvidia: в какие стартапы вкладывает $4.6 трлн компания и почему
Анализ 67 инвестиционных сделок Nvidia в 2025 году. В какие AI-стартапы вкладывает $4.6 трлн компания и как это меняет индустрию.
7754
Grok в Индии: как один глупый промпт отправил ИИ в блок нацию
Разбор индийского скандала с Grok: как вредоносные промпты привели к блокировке ИИ, IT-законодательство и будущее генеративных моделей.
7755
Медицинские записи в JSON за 15 минут: как заставить локальные LLM читать почерк врачей
Практический гайд по обработке медицинских записей локальными LLM. Сравнение моделей (Llama 3.2, Meditron), OCR для рукописного текста, структурирование в JSON/
7756
DGX Spark: Обучение Llama 3.2 на практике оказалось в 5 раз медленнее рекламы. Вот как это исправить
Реальный бенчмарк DGX Spark для Llama 3.2. Разбираемся, почему скорость в 2 раза ниже заявленной и как настроить PyTorch окружение.
7757
Тёмная цепочка мыслей: как заставить Gemma 3 4B думать как 70B модель
Эксперимент с тонкой настройкой Gemma 3 4B на уникальном наборе данных для прокачки стратегического мышления. Технические детали, метрики, код.
7758
Llama.cpp больше не мучает: веб-центр с мозгом, который сам подбирает параметры
Обзор инструмента для автоматизации llama.cpp: веб-интерфейс, умный подбор n_gpu_layers и n_ctx, мониторинг и управление процессами через FastAPI.
7759
MiniMax M2.1 и Q6_K: как квантование ломает логику модели и что с этим делать
Почему квантованный Q6_K MiniMax M2.1 генерирует бредовый код и странные ответы. Детальный разбор проблемы и практическое решение для llama.cpp и LM Studio.
7760
Конвертация .pth в GGUF и настройка GPU в Ollama/LM Studio: полный разбор для новичков
Пошаговое руководство по конвертации моделей .pth в GGUF и настройке GPU ускорения в Ollama и LM Studio. Работаем с Llama 3.2-11b, RX 9070 XT и Vulkan.
7761
GRPO + LoRA на нескольких GPU: инженерный гайд по выжиманию последних мегабайтов из VRAM
Практическое руководство по настройке GRPO с LoRA на нескольких GPU. Конкретные параметры, метрики, экономия 33% времени, решение проблем VRAM.
7762
mHC в DeepSeek: Как гипер-соединения убивают нестабильность обучения (и почему это не магия)
Полный разбор метода mHC от DeepSeek с кодом на PyTorch. Узнайте, как гипер-соединения стабилизируют обучение глубоких сетей без взрыва градиентов.
7763
Обзор Seline: приватный AI-ассистент с векторами, пайплайнами и локальной установкой
Обзор Seline - приватного AI-ассистента с векторной БД, пайплайнами LLM и установкой в один клик. Сравнение с альтернативами, примеры использования.
7764
Maincoder-1B: как запустить новую 1-миллиардную модель для кодинга через llama.cpp
Пошаговая инструкция по запуску легкой модели Maincoder-1B для программирования через llama.cpp. Скачивание GGUF, настройка, примеры кода и сравнение.