Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2701
Fine-tuning Gemma 2B для структурированного извлечения JSON: полный разбор кода и 432 примера
Полное руководство по тонкой настройке Gemma 2B для извлечения структурированных данных из регуляторных документов. Код, датасет и рост точности с 75% до 94%.
2702
Gemma 4 Uncensored: что известно о моделях без цензуры и как их использовать
Все об uncensored версиях Gemma 4 на 05.04.2026: как сообщество создает модели без ограничений, этические риски и практическое применение.
2703
Голосовой умный дом на локальном AI: бесшовная интеграция Ollama и Whisper
Пошаговая инструкция по развертыванию локальной системы голосового управления умным домом с использованием Ollama и Whisper. Решаем проблемы с VRAM, ошибкой Unk
2704
Сравнение Fused MoE ядра на Triton: 5 запусков против 24 и прирост 4.9x на Mixtral
Новое fused MoE ядро на Triton сокращает запуски с 24 до 5, ускоряя inference Mixtral и DeepSeek MoE в 4.9 раза. Сравнение с PyTorch и Megablocks на 2026 год.
2705
Как запустить GPT-OSS-120B на Mac с 64GB памяти: эксперименты с 3-битным квантованием и Lloyd-Max
Детальный гайд по запуску 120B модели на Mac с 64GB ОЗУ. Используем 3-битное квантование Lloyd–Max, Hadamard rotations и оптимизацию доступа MoE.
2706
Proxy-Pointer RAG: пошаговое руководство по гибридному методу для масштабируемого и точного поиска
Полное руководство по Proxy-Pointer RAG на 2026 год. Узнайте, как совместить векторный и лексический поиск для масштабируемых RAG-систем с минимальными затратам
2707
От вайбкодинга к продакшену: как я создал шахматный сервис с ИИ (3300 промптов, 100k строк кода)
Практический кейс: как с помощью 3300 промптов и AI-кодинга я создал production-сервис для игры в шахматы с ИИ. Этапы, ошибки, метрики и инструменты 2026 года.
2708
Fastest QWEN Coder 80B: Apex Quantization для 3x ускорения inference
Полное руководство по ускорению QWEN Coder 80B с помощью Apex Quantization. Увеличьте скорость inference в 3 раза с минимальной потерей точности. Актуально на 0
2709
Claude против Codex: как устроить баттл ИИ в VS Code и выжать из них максимум
Как организовать интеллектуальные дебаты между Claude Code 4.2 и OpenAI Codex 3.9 в VS Code. Практический обзор плагина для улучшения решений через спор ИИ.
2710
Конец эйфории: почему Сэм Альтман признаёт сдувание ИИ-пузыря и что это значит для разработчиков и инвесторов
Сэм Альтман заявил о сдувании ИИ-пузыря. Анализ причин: AGI откладывается, расходы OpenAI зашкаливают, магия масштабирования закончилась. Что делать разработчик
2711
TurboQuant и per-layer outlier-aware K: как выжать из Gemma 4 и Qwen максимум на слабом железе
Детальный разбор TurboQuant и per-layer outlier-aware K - новых методов квантования KV-кэша для Gemma 4 и Qwen. Сравнение с RotorQuant и Attn-rot, примеры испол
2712
Как подключить ИИ-агента к Renga API для автоматизации BIM-проектирования
Глубокий технический гайд по интеграции ИИ-агентов с Renga API через COM-интерфейс. Python скрипты, сравнение с Revit, архитектура автоматизации BIM-проектирова