Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6565
Когда 48GB VRAM не хватает: какие локальные модели реально работают с промптами как у Claude Code
Эмпирическое исследование: какие модели на 48GB VRAM справляются с системными промптами в 20k токенов. Тесты Qwen3, GLM 4.6v, реальные показатели памяти.
6566
Differential Transformer V2: как работает новая архитектура внимания от Microsoft и где взять код
Обзор Differential Transformer V2 (DiffAttnV2) от Microsoft Research. Как работает, сравнение с предыдущей версией, примеры использования и где скачать код.
6567
Когда 70B слишком много: лучшие модели 7-14B для админа и пентестера в 2026
Обзор и тестирование компактных LLM для Linux-администрирования, кибербезопасности и DevSecOps в 2026 году. DeepSeek-Coder, Qwen2.5-Coder, CodeLlama и другие.
6568
Strix Halo vs RTX 5080: строим персональную AI-лабораторию для обучения LoRA и инференса больших моделей
Подробный гайд по выбору железа для персональной AI-лаборатории: Strix Halo с 128 ГБ ОЗУ против RTX 5080 для обучения LoRA, инференса Qwen 235B и экспериментов
6569
Почему модель спорит с пользователем: разбираем «цензуру» dolphin-2.9-llama3-8b и как её исправить
Гайд по исправлению цензуры в локальной модели dolphin-2.9-llama3-8b: меняем системный промпт, параметры, ставим uncensored версии. Работаем в Ollama, LM Studio
6570
RLM: практическое руководство по созданию LLM-агентов без контекстного дрейфа и потери цели
Полное практическое руководство по созданию LLM-агентов на архитектуре RLM. Устраняем контекстный дрейф и потерю цели с помощью рекурсивных вызовов. Примеры код
6571
Тестирование Deep Agents: single-step, full-turn и multiple-turn — что работает в 2026
Полное руководство по тестированию Deep Agents в 2026. Single-step, full-turn и multiple-turn методологии, практические примеры и инструменты для оценки.
6572
Умный биндаж a-Heal: как ИИ, камера и электричество ускоряют заживление ран на 50%
DARPA представила умный биндаж a-Heal с ИИ и камерой. Ускоряет заживление на 50% через электростимуляцию. Испытания на свиньях, алгоритм ML Physician.
6573
Дроны против пожаров: как XPrize заставил алгоритмы видеть огонь сквозь дым
Как технологии ИИ и автономные дроны побеждают лесные пожары. Разбираем алгоритмы компьютерного зрения из конкурса XPrize и их реальное применение в 2026 году.
6574
Catalog AI от Amazon: как нейросети переписывают правила e-commerce изнутри
Технический разбор системы Amazon Catalog AI: какие модели, архитектуры и данные стоят за умным поиском и генерацией описаний товаров на 20.01.2026.
6575
Jimdo: как одинокий фрилансер получает советы от AI-консультанта на LangChain
Как Jimdo использует LangChain.js и GPT-4o для создания персонализированных AI-консультантов, которые заменяют дорогих экспертов для сольных предпринимателей.
6576
Почему мультимодальные модели не могут определить время на часах: разбор фундаментального сбоя
GPT-4o, Gemini 2.0 и Claude 3.5 Sonnet не могут определить время на аналоговых часах. Новое исследование IEEE показывает, почему это не баг, а системная проблем