Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4981
Лёгкие coding-агенты для локальных LLM: когда 4K контекста — это роскошь
Сравнение PocketCoder, TinyAgent и других инструментов для автономного программирования на локальных LLM с ограниченным контекстом. Практические примеры и реком
4982
BitNet в браузере: разбор PoC на WebGPU и WGSL для запуска 1-битных моделей на iPad
Технический разбор PoC BitNet b1.58 на WebGPU и WGSL для запуска 1-битных LLM на iPad M4 в 2026 году. WGSL шейдеры, оптимизации, реальные тесты.
4983
Свой голос из ничего: как я тренировал TTS-модель с нуля на KaniTTS2 и не сошел с ума
Полное руководство по обучению своей TTS-модели с нуля на основе KaniTTS2 Pretrain Code. FSDP multi-GPU, Flash Attention 2, подготовка датасета, YAML-конфиги.
4984
KaniTTS2: локальная TTS с качеством ElevenLabs и скоростью 0.2 RTF
Полный гайд по установке KaniTTS2, квантованию модели для 3GB VRAM и сравнению с ElevenLabs. Тесты скорости, качества и практическое применение.
4985
Проблема 3-го хода в RLHF: как аттракторы убивают честность ИИ и что с этим делать
Глубокий разбор проблемы потери эпистемической честности в RLHF после 3-го хода. Конкретные метрики, техника подавления аттракторов и пошаговый план исправления
4986
Claude Code глючит кэш? Отключаем x-anthropic-billing-header и возвращаем скорость
Пошаговое решение проблемы полной переобработки промпта в Claude Code. Отключаем заголовок x-anthropic-billing-header через переменные окружения и settings.json
4987
ARIA Protocol: запуск BitNet b1.58 на CPU через P2P-сеть — бенчмарки AMD vs Intel с AVX-512
Тестирование ARIA Protocol — P2P-сети для запуска 1-битных LLM на CPU. Сравнение производительности AMD Ryzen и Intel Xeon с AVX-512, энергопотребление, задержк
4988
Парадокс fine-tuning: почему модель на 3% английских данных может быть лучше, чем на 97% корейских
Практический кейс с Gemma 3 270M: как 3% английских данных дали лучший результат, чем 97% корейских. Объяснение парадокса и гайд по работе с low-resource языкам
4989
Челлендж: как создать P2P-мессенджер в браузере без сервера с помощью AI-кодера
Пошаговый гайд по созданию децентрализованного P2P-мессенджера в браузере без серверов. Используем WebRTC, STUN и AI-кодеры. Практический челлендж для разработч
4990
QLoRA лжет: почему график лосса падает, а модель не учится
Разбираем скрытые баги QLoRA: адаптер замораживается, лосс врет, модель не учится. Конкретные фиксы, тест Purple Banana и настройки на 2026 год.
4991
Браузер агента в Bedrock AgentCore: прокси, профили и расширения, которые наконец-то работают
Практическое руководство по настройке прокси, профилей и расширений для браузера агента в Amazon Bedrock AgentCore. Решаем проблемы сессий и аутентификации.
4992
GLM-5-744B: первый локальный LLM, впечатливший опытного разработчика (тест на создание игры)
Личный тест GLM-5-744B на создание игры с vLLM и квантованием IQ2_M. Сравнение с Qwen-72B и GPT-OSS, оценка скорости и практические выводы для разработчиков.