Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5413 Как ИИ-агенты Claude создали культ «Клешни»: разбор логов и анализ поведения автономных систем Разбор реального кейса: как автономные агенты Claude 4.6 создали собственную религию. Логи, код и выводы для разработчиков AI-систем. 6 мин чтения 5414 Автономный исследовательский агент на AnythingLLM: как обработать 10 000 PDF локально на 32 ГБ ОЗУ Пошаговый гайд по созданию автономного исследовательского агента на AnythingLLM для обработки 10 000 PDF файлов локально на 32 ГБ ОЗУ. Архитектура, оптимизация, 9 мин чтения 5415 Kimi OK Computer: Что нашли в утекшем ядре автономных агентов Полный разбор утечки кода Kimi OK Computer от Moonshot AI: системные промпты, инструменты, контейнерная архитектура и схемы автономных агентов на 2026 год. 5 мин чтения 5416 Запуск LLM прямо в браузере: полный гайд по WebGPU, Transformers.js и Chrome Prompt API Пошаговый гайд по запуску языковых моделей в браузере без серверов. WebGPU, Transformers.js, кэширование в IndexedDB и мониторинг памяти. Актуально на 07.02.202 8 мин чтения 5417 DoomsdayOS: ваш автономный AI на флешке, который переживет апокалипсис Пошаговое руководство по созданию портативной ОС с локальными LLM, RAG и офлайн-данными. Работает без интернета на любом компьютере. 8 мин чтения 5418 Топ-5 бесплатных нейросетей для синтеза речи в 2026: тест на сложном русском тексте Практическое сравнение 5 лучших бесплатных нейросетей для синтеза речи в 2026 году. Тест на сложном русском тексте с именами, аббревиатурами и числами. 7 мин чтения 5419 Karp-001 и Pisces-llm: Qwen и ByteDance тестируют новые модели в тени На LMSys Arena появились модели Karp-001 и Pisces-llm — вероятно, новые разработки Qwen и ByteDance. Что о них известно и как они себя показывают? 4 мин чтения 5420 20-30B MoE для tool calling: кто не галлюцинирует с файлами и поиском? Тестируем 20-30B MoE модели на чтение файлов и веб-поиск. Сравнение Qwen2.5-32B-Instruct, DeepSeek-V3-16B, Yi-1.5-34B и других на реальных задачах. 7 мин чтения 5421 Автоматический тест-сьют для локальных LLM: как перестать гадать и начать измерять Практический гайд по автоматическому тестированию локальных LLM. Интеграция с LM Studio, сравнение Qwen3-Coder-Next, GPT-OSS-20B и других моделей. 7 мин чтения 5422 Как создать свой собственный LLM-инференс-движок: опыт оптимизации для CPU и Raspberry Pi 5 Практический гайд по созданию LLM-инференс-движка с оптимизацией памяти до 1.2 ГБ и скоростью 0.2 с/токен на CPU. Сравнение с LM Studio. 10 мин чтения 5423 Кризис Gemini: как Google убивает бюджетные LLM и какие есть альтернативы для OCR и извлечения данных Google резко поднял цены на Gemini API. Сравниваем альтернативы для OCR и извлечения данных: Llama 3.2, Claude 3.7 Sonnet, GPT-4o Mini и локальные модели. Полны 7 мин чтения 5424 Adaptive Thinking в Opus 4.6: как Anthropic автоматизировала выбор глубины reasoning и что это даёт разработчикам Разбираем Adaptive Thinking в Claude Opus 4.6 — как Anthropic автоматизировала выбор think/ultrathink режимов и что это значит для вашего кода и бюджета. 9 мин чтения