Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5737 Как запустить автономный AI-агент на смартфоне: полный гайд по Termux, llama.cpp и Git-якорям Полное руководство по развертыванию автономного AI агента на Android через Termux с llama.cpp, GGUF моделями и криптографическими Git якорями. Работает без обла 12 мин чтения 5738 LM Studio не видит Nemotron 3 Nano NVFP4? Вот как загрузить модель вручную через Hugging Face Пошаговый гайд по ручной загрузке Nemotron 3 Nano NVFP4 в LM Studio. Исправляем проблему с Hugging Face, скачиваем модель и настраиваем форматы. Работает на 01. 7 мин чтения 5739 Налоговый рай для AI: как Индия переманивает глобальные AI-нагрузки до 2047 года Индия предлагает 20+ лет налоговых каникул для AI-инфраструктуры. Google уже вложил $15 млрд. Как это изменит глобальную карту вычислений к 2047 году? 4 мин чтения 5740 Слой исполнения правил ИИ на JSON: как сделать поведение LLM наблюдаемым, а не просто промпт-инжиниринг Практический wrapper для управления LLM через JSON-правила. Решает проблему наблюдаемости, сравнения моделей и контроля дрейфа поведения на 01.02.2026. 7 мин чтения 5741 Как генерировать NSFW-изображения локально: сравнение Stable Diffusion, ComfyUI и AMD-оптимизация Полный гайд по локальной генерации NSFW-изображений без цензуры. Сравнение Stable Diffusion и ComfyUI, оптимизация для AMD Radeon. Пошаговая установка, настройк 6 мин чтения 5742 SHA-256 хеш-цепочка для LLM-дискурса в Termux: как создать криптографический аудит multi-agent диалога на телефоне Пошаговый гайд по созданию криптографически верифицируемого лога дискуссии между агентами ИИ на Android через Termux. Ollama, llama3.2:3b, SHA-256 хеширование. 10 мин чтения 5743 Топ-10 компактных LLM для 8 ГБ ОЗУ: подборка моделей под кодинг, математику, RAG и креатив 10 оптимизированных LLM, которые реально работают на 8 ГБ ОЗУ. Квантизованные модели для программирования, математических задач, RAG-систем и креатива. Подробно 8 мин чтения 5744 ChatLLM.cpp + Qwen3-ASR: Запустите распознавание и выравнивание речи локально без облаков Пошаговый гайд по установке и запуску связки ChatLLM.cpp и Qwen3-ASR для локального распознавания и выравнивания аудио. Работает без интернета на CPU и GPU. 7 мин чтения 5745 Nano Banana Pro: дизайн интерьера за 5 минут вместо 5 дней Обзор Nano Banana Pro: как бесплатный ИИ-инструмент генерирует концепт-дизайн интерьеров за секунды. Примеры, сравнение с аналогами, инструкция. 6 мин чтения 5746 Ультра-разреженные MoE: как дистилляция GPT-OSS-120B в 7B модель запускает гигантов на ноутбуке Полный гайд по ультра-разреженным MoE-архитектурам. Как дистилляция 120B модели в 7B решает проблему VRAM. MXFP4, A3B квантование, практический запуск. 7 мин чтения 5747 Архитектура и фреймворк для локальных голосовых агентов: как создать систему с несколькими агентами и контекстами Полное руководство по созданию self-hosted фреймворка для локальных голосовых агентов с несколькими контекстами. Архитектура, инструменты 2026 года, пошаговый п 8 мин чтения 5748 MLX-Video и LTX-2: как запустить видео-модель на Mac и почему она весит 314 ГБ Практический гайд по запуску LTX-2 через MLX-Video на Mac. Разбираемся, почему модель весит 314 ГБ и как её оптимизировать под Apple Silicon. 9 мин чтения