Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5413
Как ИИ-агенты Claude создали культ «Клешни»: разбор логов и анализ поведения автономных систем
Разбор реального кейса: как автономные агенты Claude 4.6 создали собственную религию. Логи, код и выводы для разработчиков AI-систем.
5414
Автономный исследовательский агент на AnythingLLM: как обработать 10 000 PDF локально на 32 ГБ ОЗУ
Пошаговый гайд по созданию автономного исследовательского агента на AnythingLLM для обработки 10 000 PDF файлов локально на 32 ГБ ОЗУ. Архитектура, оптимизация,
5415
Kimi OK Computer: Что нашли в утекшем ядре автономных агентов
Полный разбор утечки кода Kimi OK Computer от Moonshot AI: системные промпты, инструменты, контейнерная архитектура и схемы автономных агентов на 2026 год.
5416
Запуск LLM прямо в браузере: полный гайд по WebGPU, Transformers.js и Chrome Prompt API
Пошаговый гайд по запуску языковых моделей в браузере без серверов. WebGPU, Transformers.js, кэширование в IndexedDB и мониторинг памяти. Актуально на 07.02.202
5417
DoomsdayOS: ваш автономный AI на флешке, который переживет апокалипсис
Пошаговое руководство по созданию портативной ОС с локальными LLM, RAG и офлайн-данными. Работает без интернета на любом компьютере.
5418
Топ-5 бесплатных нейросетей для синтеза речи в 2026: тест на сложном русском тексте
Практическое сравнение 5 лучших бесплатных нейросетей для синтеза речи в 2026 году. Тест на сложном русском тексте с именами, аббревиатурами и числами.
5419
Karp-001 и Pisces-llm: Qwen и ByteDance тестируют новые модели в тени
На LMSys Arena появились модели Karp-001 и Pisces-llm — вероятно, новые разработки Qwen и ByteDance. Что о них известно и как они себя показывают?
5420
20-30B MoE для tool calling: кто не галлюцинирует с файлами и поиском?
Тестируем 20-30B MoE модели на чтение файлов и веб-поиск. Сравнение Qwen2.5-32B-Instruct, DeepSeek-V3-16B, Yi-1.5-34B и других на реальных задачах.
5421
Автоматический тест-сьют для локальных LLM: как перестать гадать и начать измерять
Практический гайд по автоматическому тестированию локальных LLM. Интеграция с LM Studio, сравнение Qwen3-Coder-Next, GPT-OSS-20B и других моделей.
5422
Как создать свой собственный LLM-инференс-движок: опыт оптимизации для CPU и Raspberry Pi 5
Практический гайд по созданию LLM-инференс-движка с оптимизацией памяти до 1.2 ГБ и скоростью 0.2 с/токен на CPU. Сравнение с LM Studio.
5423
Кризис Gemini: как Google убивает бюджетные LLM и какие есть альтернативы для OCR и извлечения данных
Google резко поднял цены на Gemini API. Сравниваем альтернативы для OCR и извлечения данных: Llama 3.2, Claude 3.7 Sonnet, GPT-4o Mini и локальные модели. Полны
5424
Adaptive Thinking в Opus 4.6: как Anthropic автоматизировала выбор глубины reasoning и что это даёт разработчикам
Разбираем Adaptive Thinking в Claude Opus 4.6 — как Anthropic автоматизировала выбор think/ultrathink режимов и что это значит для вашего кода и бюджета.