Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5209
Interactions API от Google: как заменить «мега-промпты» на структурированных агентов
Полный гайд по Google Interactions API для создания stateful AI-агентов с оркестрацией инструментов. Сравнение с generateContent, примеры long-running tasks.
5210
BitNet b1.58 и bitnet.cpp: когда 1-битные LLM перестали быть шуткой и начали работать
Полное руководство по Microsoft BitNet b1.58 и bitnet.cpp. Запускаем 2B-модели на слабом железе, сравниваем с альтернативами и тестируем реальную производительн
5211
Голосовой AI-ассистент на Python: от Telegram до автокоммитов в Git
Полное руководство по production-голосовому ассистенту: Telegram бот, GigaASR, Gemini Flash, Claude Code, SileroTTS, автоматизация разработки, автокоммиты Git.
5212
GLM-5: что скрывается в PR к Hugging Face и почему это не просто очередная LLM
Технический разбор PR для GLM-5 в Hugging Face Transformers. Детали архитектуры, параметры модели и что это значит для разработчиков в 2026.
5213
LTX-2 19B на Jetson Thor: как заставить 19-миллиардную модель генерировать видео в 32 ГБ единой памяти
Практическое руководство по запуску LTX-2 19B на Jetson Thor. Оптимизация памяти, пайплайн диффузии и open-source код для генерации видео на embedded-устройства
5214
Пишем inference engine на чистом C: разбор кода и бенчмарки для LFM2-350M
Пошаговое руководство по созданию легкого inference engine на чистом C для модели LFM2-350M. Разбор реализации RoPE, оптимизаций CBLAS и сравнение производитель
5215
RRAM против «стены памяти» ИИ: как новая архитектура ускорит нейросети в 2025 году
Как резистивная память RRAM решает проблему «стены памяти» ИИ, ускоряя нейросети в 1000 раз. Анализ аналоговых вычислений и нейроморфных чипов на IEEE IEDM.
5216
Exogram: как создать агента с "процедурной памятью", который выживает после любого редизайна сайта
Пошаговый гайд по созданию AI-агента с процедурной памятью, который переживает изменения UI. Используем workflow-use, browser-use, DeepSeek-V3 и LangChain.
5217
Ошибка распределения VRAM: почему Llama Server на Ryzen + RTX не видит всю память и как это исправить
Почему Llama Server не использует всю VRAM на гибридной системе Ryzen+RTX и как заставить его видеть все 16ГБ. Пошаговое решение проблемы Windows GPU.
5218
Вайбкодинг на практике: как с помощью ИИ создать сайт-резюме в стиле Fallout 2 (разбор кейса)
Разбор реального кейса: как с помощью GPT-4.5 и Midjourney v7 создать креативное резюме-сайт в стиле Fallout 2. Промпты, код, трудности и решения.
5219
Qwen-Image-Layered: ИИ, который режет картинки как Photoshop, но без ваших нервов
Практический тест модели Qwen-Image-Layered для семантического разделения изображений на слои. Сравнение с альтернативами, примеры работы и кому подойдет в 2026
5220
Qwen3.5 в llama.cpp: как запустить плотные и MoE-модели на своём ПК
Полное руководство по запуску Qwen3.5 в llama.cpp b7973 на своём компьютере. Настройка плотных и MoE-моделей, сравнение производительности, оптимизация.