Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7753 Карта инвестиций Nvidia: в какие стартапы вкладывает $4.6 трлн компания и почему Анализ 67 инвестиционных сделок Nvidia в 2025 году. В какие AI-стартапы вкладывает $4.6 трлн компания и как это меняет индустрию. 7 мин чтения 7754 Grok в Индии: как один глупый промпт отправил ИИ в блок нацию Разбор индийского скандала с Grok: как вредоносные промпты привели к блокировке ИИ, IT-законодательство и будущее генеративных моделей. 5 мин чтения 7755 Медицинские записи в JSON за 15 минут: как заставить локальные LLM читать почерк врачей Практический гайд по обработке медицинских записей локальными LLM. Сравнение моделей (Llama 3.2, Meditron), OCR для рукописного текста, структурирование в JSON/ 9 мин чтения 7756 DGX Spark: Обучение Llama 3.2 на практике оказалось в 5 раз медленнее рекламы. Вот как это исправить Реальный бенчмарк DGX Spark для Llama 3.2. Разбираемся, почему скорость в 2 раза ниже заявленной и как настроить PyTorch окружение. 10 мин чтения 7757 Тёмная цепочка мыслей: как заставить Gemma 3 4B думать как 70B модель Эксперимент с тонкой настройкой Gemma 3 4B на уникальном наборе данных для прокачки стратегического мышления. Технические детали, метрики, код. 11 мин чтения 7758 Llama.cpp больше не мучает: веб-центр с мозгом, который сам подбирает параметры Обзор инструмента для автоматизации llama.cpp: веб-интерфейс, умный подбор n_gpu_layers и n_ctx, мониторинг и управление процессами через FastAPI. 6 мин чтения 7759 MiniMax M2.1 и Q6_K: как квантование ломает логику модели и что с этим делать Почему квантованный Q6_K MiniMax M2.1 генерирует бредовый код и странные ответы. Детальный разбор проблемы и практическое решение для llama.cpp и LM Studio. 8 мин чтения 7760 Конвертация .pth в GGUF и настройка GPU в Ollama/LM Studio: полный разбор для новичков Пошаговое руководство по конвертации моделей .pth в GGUF и настройке GPU ускорения в Ollama и LM Studio. Работаем с Llama 3.2-11b, RX 9070 XT и Vulkan. 3 мин чтения 7761 GRPO + LoRA на нескольких GPU: инженерный гайд по выжиманию последних мегабайтов из VRAM Практическое руководство по настройке GRPO с LoRA на нескольких GPU. Конкретные параметры, метрики, экономия 33% времени, решение проблем VRAM. 8 мин чтения 7762 mHC в DeepSeek: Как гипер-соединения убивают нестабильность обучения (и почему это не магия) Полный разбор метода mHC от DeepSeek с кодом на PyTorch. Узнайте, как гипер-соединения стабилизируют обучение глубоких сетей без взрыва градиентов. 10 мин чтения 7763 Обзор Seline: приватный AI-ассистент с векторами, пайплайнами и локальной установкой Обзор Seline - приватного AI-ассистента с векторной БД, пайплайнами LLM и установкой в один клик. Сравнение с альтернативами, примеры использования. 4 мин чтения 7764 Maincoder-1B: как запустить новую 1-миллиардную модель для кодинга через llama.cpp Пошаговая инструкция по запуску легкой модели Maincoder-1B для программирования через llama.cpp. Скачивание GGUF, настройка, примеры кода и сравнение. 5 мин чтения