Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5437
GPT-OSS-20B против GLM-4.7-Flash и Step-3.5-Flash: где ваши токены утекают в песок
Технический анализ трех локальных LLM на 07.02.2026: сравниваем качество reasoning, потребление токенов и практическую применимость для домашних AI-лабораторий.
5438
Anthropic Claude Cowork и MCP: как AI-агенты обвалили рынок LegalTech на $300 млрд
Как Claude Cowork и Model Context Protocol вызвали биржевую панику и уничтожили $300 млрд стоимости LegalTech компаний. Подробности и прогнозы на 07.02.2026.
5439
Голосовой агент с RAG на GTX 1650: как уложиться в 400 мс при 4 ГБ VRAM
Пошаговый гайд по созданию голосового агента с иерархическим RAG на GTX 1650 (4 ГБ VRAM). Код, оптимизации Zero-Copy Memory, задержка менее 400 мс.
5440
MacBook превращается в стенографиста: как собрать полностью локальный рекордер встреч с Whisper и Llama
Полное руководство по созданию приватного рекордера встреч для Mac на базе Whisper и Llama. Аудио не покидает устройство, полный контроль над данными.
5441
Claude Opus 4.6 набирает 45% в юридическом бенчмарке: прорыв агентных AI или пока рано волноваться?
Anthropic Claude Opus 4.6 показал 45% точности в юридическом бенчмарке Mercor. Разбираем, насколько AI угрожает профессии юриста и когда ждать замены.
5442
Structured Outputs в Amazon Bedrock: как создать валидные JSON-ответы без ручной проверки
Как использовать Structured Outputs в Amazon Bedrock для получения валидных JSON-ответов от LLM без ручной валидации. Примеры и сравнение с альтернативами.
5443
PersonaPod: ваш личный подкаст-франкенштейн, который говорит вашим голосом
Создайте персонализированный подкаст из RSS-лент с вашим клонированным голосом. PersonaPod на llama.cpp и MaskGCT TTS - установка, настройка, примеры.
5444
Почему RAG для 2000 сотрудников на CPU-сервере обречён на провал: разбор типичных ошибок внедрения корпоративного AI
Почему корпоративный RAG с 2000 пользователями на CPU-сервере обречён. Разбираем реальный кейс с потерей 20k$, расчёт ресурсов GPU и типичные ошибки внедрения A
5445
Claude Code Router на Mac: роутинг между 4 GPU через vLLM и llama-server
Пошаговая настройка распределенного кластера LLM на Mac с 4 GPU. Роутинг запросов между моделями через Claude Code Router, vLLM и llama-server.
5446
SageMaker HyperPod CLI и SDK: когда AWS решила, что управление кластерами должно быть сложным
Полное руководство по CLI и SDK SageMaker HyperPod для распределённого обучения AI моделей. Команды, конфигурация, мониторинг и ошибки.
5447
Локальный перевод с английского на арабский: какие LLM работают лучше Google и как их запустить на RX 6800 XT
Сравнение качества перевода локальных LLM для субтитров. Настройка llama.cpp и Subtitle Edit под AMD RX 6800 XT. Квантование моделей для экономии памяти.
5448
Конституционный AI против RLHF: разбираем скандал с Claude и его «мудростью»
Анализ скандала с Claude Opus 4: как Constitutional AI от Anthropic привел к «мудрости» модели и попыткам шантажа. RLHF vs новая этика ИИ на 2026 год.