Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5209 Interactions API от Google: как заменить «мега-промпты» на структурированных агентов Полный гайд по Google Interactions API для создания stateful AI-агентов с оркестрацией инструментов. Сравнение с generateContent, примеры long-running tasks. 9 мин чтения 5210 BitNet b1.58 и bitnet.cpp: когда 1-битные LLM перестали быть шуткой и начали работать Полное руководство по Microsoft BitNet b1.58 и bitnet.cpp. Запускаем 2B-модели на слабом железе, сравниваем с альтернативами и тестируем реальную производительн 8 мин чтения 5211 Голосовой AI-ассистент на Python: от Telegram до автокоммитов в Git Полное руководство по production-голосовому ассистенту: Telegram бот, GigaASR, Gemini Flash, Claude Code, SileroTTS, автоматизация разработки, автокоммиты Git. 12 мин чтения 5212 GLM-5: что скрывается в PR к Hugging Face и почему это не просто очередная LLM Технический разбор PR для GLM-5 в Hugging Face Transformers. Детали архитектуры, параметры модели и что это значит для разработчиков в 2026. 6 мин чтения 5213 LTX-2 19B на Jetson Thor: как заставить 19-миллиардную модель генерировать видео в 32 ГБ единой памяти Практическое руководство по запуску LTX-2 19B на Jetson Thor. Оптимизация памяти, пайплайн диффузии и open-source код для генерации видео на embedded-устройства 8 мин чтения 5214 Пишем inference engine на чистом C: разбор кода и бенчмарки для LFM2-350M Пошаговое руководство по созданию легкого inference engine на чистом C для модели LFM2-350M. Разбор реализации RoPE, оптимизаций CBLAS и сравнение производитель 9 мин чтения 5215 RRAM против «стены памяти» ИИ: как новая архитектура ускорит нейросети в 2025 году Как резистивная память RRAM решает проблему «стены памяти» ИИ, ускоряя нейросети в 1000 раз. Анализ аналоговых вычислений и нейроморфных чипов на IEEE IEDM. 5 мин чтения 5216 Exogram: как создать агента с "процедурной памятью", который выживает после любого редизайна сайта Пошаговый гайд по созданию AI-агента с процедурной памятью, который переживает изменения UI. Используем workflow-use, browser-use, DeepSeek-V3 и LangChain. 8 мин чтения 5217 Ошибка распределения VRAM: почему Llama Server на Ryzen + RTX не видит всю память и как это исправить Почему Llama Server не использует всю VRAM на гибридной системе Ryzen+RTX и как заставить его видеть все 16ГБ. Пошаговое решение проблемы Windows GPU. 10 мин чтения 5218 Вайбкодинг на практике: как с помощью ИИ создать сайт-резюме в стиле Fallout 2 (разбор кейса) Разбор реального кейса: как с помощью GPT-4.5 и Midjourney v7 создать креативное резюме-сайт в стиле Fallout 2. Промпты, код, трудности и решения. 5 мин чтения 5219 Qwen-Image-Layered: ИИ, который режет картинки как Photoshop, но без ваших нервов Практический тест модели Qwen-Image-Layered для семантического разделения изображений на слои. Сравнение с альтернативами, примеры работы и кому подойдет в 2026 5 мин чтения 5220 Qwen3.5 в llama.cpp: как запустить плотные и MoE-модели на своём ПК Полное руководство по запуску Qwen3.5 в llama.cpp b7973 на своём компьютере. Настройка плотных и MoE-моделей, сравнение производительности, оптимизация. 6 мин чтения