Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5245
Почему квантование ломает модели Mamba: анализ проблемы и поиск решений для Mamba-2/Mamba-3
Глубокий анализ чувствительности Mamba к квантованию. Практические решения для Mamba-2/Mamba-3, гибридные подходы, инструменты. Актуально на февраль 2026.
5246
PATCH: сжатие длинного контекста в 4.6 раза — революция или очередной хак?
Обзор PATCH — метода сжатия длинного контекста LLM в латентные токены с ускорением обработки в 4.6 раза. Технический разбор на февраль 2026.
5247
Как собрать локальную LLM-систему для обработки конфиденциальных документов: сравнение Mac vs PC и выбор железа
Полное руководство по сборке локальной LLM-системы для конфиденциальных данных. Сравнение M5 MacBook и PC с 24GB VRAM, выбор модели Qwen 3.5 8B, пошаговая настр
5248
Собери свою LM на коленках: rust-bpe, PyTorch Lightning и Trackio
Полный стек для предобучения маленькой языковой модели с нуля в 2026: rust-bpe токенизатор, PyTorch Lightning для обучения, Trackio для мониторинга.
5249
WhatModelsCanIRun.com: калькулятор совместимости моделей с вашей видеокартой
Обзор WhatModelsCanIRun.com - инструмент для расчета совместимости AI-моделей с видеокартами. Узнайте, какие LLM запустить на вашем GPU в 2026 году.
5250
StepFun 3.5 Flash против MiniMax 2.1: когда «быстрая» модель думает медленнее
Практическое сравнение производительности StepFun 3.5 Flash и MiniMax 2.1 на AMD Ryzen с IQ4_XS и Q3_K_XL. Анализ VRAM, времени генерации и феномена «передумыва
5251
Coder-link: один конфиг на всех AI-ассистентов вместо хаоса в dotfiles
Обзор coder-link — CLI для синхронизации конфигов Cursor, Warp, Claude Code и других AI-инструментов программирования
5252
Ubuntu не видит Radeon 9070XT: как вытащить видеокарту из чёрного списка amdgpu
Пошаговое решение проблемы, когда Ubuntu не видит видеокарту Radeon 9070XT после обновления. Чёрный список amdgpu, диагностика и исправление за 10 минут.
5253
Почему ваша LoRA не учится: иллюзия потерь и как её сломать
Технический аудит проблемы стагнации LoRA при 4-bit квантовании. Практическое руководство по диагностике и исправлению иллюзии потерь при тонкой настройке.
5254
Промпт-инжиниринг 2026: Как заставить ChatGPT и Midjourney работать за вас, а не против
Самые эффективные техники промпт-инжиниринга для ChatGPT 4.5 и Midjourney v8. Готовые шаблоны, структура промптов и скрытые фичи.
5255
Как запустить Qwen3-4B на Intel NPU: полный гайд по драйверам, OpenVINO и производительности
Подробное руководство по установке драйверов Intel NPU, настройке OpenVINO и запуску Qwen3-4B с реальными тестами производительности до 16 токенов в секунду.
5256
AI Terminal: когда ИИ становится операционной системой
Обзор AI Terminal - Electron-приложения, где ИИ управляет код-редактором, браузером и создает интерактивных аватаров. Альтернативы и примеры использования на 20