Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4981 Лёгкие coding-агенты для локальных LLM: когда 4K контекста — это роскошь Сравнение PocketCoder, TinyAgent и других инструментов для автономного программирования на локальных LLM с ограниченным контекстом. Практические примеры и реком 6 мин чтения 4982 BitNet в браузере: разбор PoC на WebGPU и WGSL для запуска 1-битных моделей на iPad Технический разбор PoC BitNet b1.58 на WebGPU и WGSL для запуска 1-битных LLM на iPad M4 в 2026 году. WGSL шейдеры, оптимизации, реальные тесты. 7 мин чтения 4983 Свой голос из ничего: как я тренировал TTS-модель с нуля на KaniTTS2 и не сошел с ума Полное руководство по обучению своей TTS-модели с нуля на основе KaniTTS2 Pretrain Code. FSDP multi-GPU, Flash Attention 2, подготовка датасета, YAML-конфиги. 8 мин чтения 4984 KaniTTS2: локальная TTS с качеством ElevenLabs и скоростью 0.2 RTF Полный гайд по установке KaniTTS2, квантованию модели для 3GB VRAM и сравнению с ElevenLabs. Тесты скорости, качества и практическое применение. 8 мин чтения 4985 Проблема 3-го хода в RLHF: как аттракторы убивают честность ИИ и что с этим делать Глубокий разбор проблемы потери эпистемической честности в RLHF после 3-го хода. Конкретные метрики, техника подавления аттракторов и пошаговый план исправления 8 мин чтения 4986 Claude Code глючит кэш? Отключаем x-anthropic-billing-header и возвращаем скорость Пошаговое решение проблемы полной переобработки промпта в Claude Code. Отключаем заголовок x-anthropic-billing-header через переменные окружения и settings.json 4 мин чтения 4987 ARIA Protocol: запуск BitNet b1.58 на CPU через P2P-сеть — бенчмарки AMD vs Intel с AVX-512 Тестирование ARIA Protocol — P2P-сети для запуска 1-битных LLM на CPU. Сравнение производительности AMD Ryzen и Intel Xeon с AVX-512, энергопотребление, задержк 9 мин чтения 4988 Парадокс fine-tuning: почему модель на 3% английских данных может быть лучше, чем на 97% корейских Практический кейс с Gemma 3 270M: как 3% английских данных дали лучший результат, чем 97% корейских. Объяснение парадокса и гайд по работе с low-resource языкам 6 мин чтения 4989 Челлендж: как создать P2P-мессенджер в браузере без сервера с помощью AI-кодера Пошаговый гайд по созданию децентрализованного P2P-мессенджера в браузере без серверов. Используем WebRTC, STUN и AI-кодеры. Практический челлендж для разработч 9 мин чтения 4990 QLoRA лжет: почему график лосса падает, а модель не учится Разбираем скрытые баги QLoRA: адаптер замораживается, лосс врет, модель не учится. Конкретные фиксы, тест Purple Banana и настройки на 2026 год. 7 мин чтения 4991 Браузер агента в Bedrock AgentCore: прокси, профили и расширения, которые наконец-то работают Практическое руководство по настройке прокси, профилей и расширений для браузера агента в Amazon Bedrock AgentCore. Решаем проблемы сессий и аутентификации. 6 мин чтения 4992 GLM-5-744B: первый локальный LLM, впечатливший опытного разработчика (тест на создание игры) Личный тест GLM-5-744B на создание игры с vLLM и квантованием IQ2_M. Сравнение с Qwen-72B и GPT-OSS, оценка скорости и практические выводы для разработчиков. 6 мин чтения