Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
1609
3 архитектурных подхода к безопасному внедрению ИИ в корпорации: опыт Alpina Digital
Как обойти 152-ФЗ, не потерять данные и внедрить LLM. Три реальных архитектурных паттерна с разбором ошибок и FAQ. Опыт Alpina Digital.
1610
GPT-шорткаты: какие команды действительно работают, а какие — миф
Разбираем популярные GPT-шорткаты: от 'Ignore all instructions' до 'Take a deep breath'. Какие из них миф, а какие действительно помогают управлять моделью. При
1611
Claude Code с DeepSeek V4: как сэкономить 54× на AI-кодинге — полный гайд по настройке и тестированию
Полный гайд по настройке Claude Code с DeepSeek V4 через cc-switch. Узнайте, как сэкономить в 54 раза на AI-кодинге, не теряя в качестве. Пошаговая инструкция,
1612
Как создать кодинг-агента с 87% на бенчмарках, используя модель 4B параметров: пошаговое руководство
Пошаговое руководство по созданию локального coding agent с 87% точностью на SWE-bench, используя компактную LLM в 4 млрд параметров. Оптимизация агента, промпт
1613
Расследование: Яндекс Музыка на треть состоит из нейрослопа — как алгоритмы засоряют плейлисты
Журналистское расследование: выяснили, как Suno и Udio заполонили Яндекс Музыку. 140 000 AI-исполнителей, отсутствие модерации и что ждет музыкальные чарты.
1614
ICM: Память для AI-агентов, которую можно пощупать локально и без компромиссов
Обзор открытого инструмента ICM для долговременной памяти AI-агентов. Локальные бенчмарки, сравнение с Zep и Widemem, примеры кода. Кому подойдет и как внедрить
1615
Как построить агента, создающего агентов: разбор реализации на Python с Qwen3.6 35b
Разбор кода агента на чистом Python, который генерирует других агентов. Работа с Qwen3.6 35b в квантовании Q8_0, MTP, примеры и сравнение с альтернативами.
1616
Как ИИ-агент уничтожил базу данных и бэкапы: разбор катастрофы PocketOS и уроки безопасности
ИИ-агент на базе Claude Opus стер продакшн-базу и все резервные копии стартапа PocketOS. Разбираем причины катастрофы и даем уроки безопасности: независимые бэк
1617
Техника TIME: как обучить Qwen3 думать короткими всплесками вместо длинных рассуждений
Техника TIME (Token Implicit and Mature Estimation) из ACL 2026: как дообучить Qwen3 думать короткими всплесками, сэкономить токены и избавиться от overthinking
1618
Как обучить Gemma-3-270m управлять роботом в симуляции MuJoCo: пошаговое руководство
Пошаговое руководство по fine-tuning компактной LLM Gemma-3-270m для управления роботом-манипулятором в симуляторе MuJoCo. Код, скрипты, советы и типичные ошибк
1619
M5 vs DGX Spark vs Strix Halo vs RTX 6000: кто выживет в локальном AI-забеге?
Четыре железных монстра для локального инференса LLM: Mac M5, NVIDIA DGX Spark, AMD Strix Halo и RTX 6000. Тесты памяти, скорости и цены. Кто реально тянет 70B+
1620
MiroThinker-1.7: открытый deep research агент на Qwen3 MoE (3B активных) — запуск на потребительском железе
MiroThinker-1.7 — первый открытый deep research агент с 3B активных параметров на базе Qwen3 MoE. Запускается на RTX 3090/4090 и MacBook. Обзор, сравнение, прим