Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2701 Fine-tuning Gemma 2B для структурированного извлечения JSON: полный разбор кода и 432 примера Полное руководство по тонкой настройке Gemma 2B для извлечения структурированных данных из регуляторных документов. Код, датасет и рост точности с 75% до 94%. 8 мин чтения 2702 Gemma 4 Uncensored: что известно о моделях без цензуры и как их использовать Все об uncensored версиях Gemma 4 на 05.04.2026: как сообщество создает модели без ограничений, этические риски и практическое применение. 5 мин чтения 2703 Голосовой умный дом на локальном AI: бесшовная интеграция Ollama и Whisper Пошаговая инструкция по развертыванию локальной системы голосового управления умным домом с использованием Ollama и Whisper. Решаем проблемы с VRAM, ошибкой Unk 7 мин чтения 2704 Сравнение Fused MoE ядра на Triton: 5 запусков против 24 и прирост 4.9x на Mixtral Новое fused MoE ядро на Triton сокращает запуски с 24 до 5, ускоряя inference Mixtral и DeepSeek MoE в 4.9 раза. Сравнение с PyTorch и Megablocks на 2026 год. 6 мин чтения 2705 Как запустить GPT-OSS-120B на Mac с 64GB памяти: эксперименты с 3-битным квантованием и Lloyd-Max Детальный гайд по запуску 120B модели на Mac с 64GB ОЗУ. Используем 3-битное квантование Lloyd–Max, Hadamard rotations и оптимизацию доступа MoE. 7 мин чтения 2706 Proxy-Pointer RAG: пошаговое руководство по гибридному методу для масштабируемого и точного поиска Полное руководство по Proxy-Pointer RAG на 2026 год. Узнайте, как совместить векторный и лексический поиск для масштабируемых RAG-систем с минимальными затратам 11 мин чтения 2707 От вайбкодинга к продакшену: как я создал шахматный сервис с ИИ (3300 промптов, 100k строк кода) Практический кейс: как с помощью 3300 промптов и AI-кодинга я создал production-сервис для игры в шахматы с ИИ. Этапы, ошибки, метрики и инструменты 2026 года. 7 мин чтения 2708 Fastest QWEN Coder 80B: Apex Quantization для 3x ускорения inference Полное руководство по ускорению QWEN Coder 80B с помощью Apex Quantization. Увеличьте скорость inference в 3 раза с минимальной потерей точности. Актуально на 0 7 мин чтения 2709 Claude против Codex: как устроить баттл ИИ в VS Code и выжать из них максимум Как организовать интеллектуальные дебаты между Claude Code 4.2 и OpenAI Codex 3.9 в VS Code. Практический обзор плагина для улучшения решений через спор ИИ. 6 мин чтения 2710 Конец эйфории: почему Сэм Альтман признаёт сдувание ИИ-пузыря и что это значит для разработчиков и инвесторов Сэм Альтман заявил о сдувании ИИ-пузыря. Анализ причин: AGI откладывается, расходы OpenAI зашкаливают, магия масштабирования закончилась. Что делать разработчик 6 мин чтения 2711 TurboQuant и per-layer outlier-aware K: как выжать из Gemma 4 и Qwen максимум на слабом железе Детальный разбор TurboQuant и per-layer outlier-aware K - новых методов квантования KV-кэша для Gemma 4 и Qwen. Сравнение с RotorQuant и Attn-rot, примеры испол 6 мин чтения 2712 Как подключить ИИ-агента к Renga API для автоматизации BIM-проектирования Глубокий технический гайд по интеграции ИИ-агентов с Renga API через COM-интерфейс. Python скрипты, сравнение с Revit, архитектура автоматизации BIM-проектирова 7 мин чтения