Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5401
AIME 2026: результаты тестов и анализ стоимости DeepSeek V3.2 за $0.09
Анализ результатов тестов AIME 2026 для DeepSeek V3.2: цена $0.09 за тест, сравнение с другими моделями и экономическая эффективность.
5402
LTX-2 против Kling/Veo3: что выбрать для кастомизации видео в 2026 году
Практическое сравнение LTX-2, Kling Video O1 и Veo 3.1 для тонкой настройки. Какая модель лучше подходит для кастомизации в 2026 году — технический разбор.
5403
Как я с нуля обучил модель на 1.8M параметров: архитектура Strawberry, датасет и код
Полное руководство по обучению языковой модели на 1.8M параметров: архитектура Strawberry, сбор датасета 40M токенов, код и гиперпараметры.
5404
Системный промпт Gemini Pro утек в сеть: вот что Google скрывает от пользователей
Разбор утекшего системного промпта Gemini Pro от Google. Сравнение с OpenAI, Anthropic. Как создавать эффективные system prompts на основе анализа.
5405
Почему RAG-системы не проходят аудит безопасности: реальные кейсы и решения для SOC2/HIPAA
Почему 80% RAG-систем не проходят аудит безопасности. Реальные кейсы утечек данных, prompt injection и решения для SOC2, HIPAA, GDPR в 2026 году.
5406
Защита от prompt injection в продакшне: практические методы для self-hosted LLM
Полное руководство по защите self-hosted LLM от prompt injection в продакшне. Многослойная защита, инструменты и реальные кейсы на 2026 год.
5407
Скорость LLM: Почему pp/tg вас обманывает и как тестировать реальное время ожидания
Полное руководство по тестированию реальной скорости LLM: как измерить время ожидания, автоматизировать бенчмаркинг и избежать ошибок pp/tg. Инструменты и метод
5408
Гибридный метод QAT+LoRA: скрытая альтернатива QLoRA, о которой никто не говорит
Сравниваем QAT+LoRA с QLoRA для тонкой настройки больших моделей. Практические тесты, когда гибридный метод выигрывает и стоит ли переходить на полный QAT.
5409
Легковесные TTS-модели 2026: KokoroTTS против Qwen и других. Кто реально работает на RTX 3060?
Тестируем легковесные TTS-модели для локального запуска на RTX 3060. Сравнение скорости, качества и требований KokoroTTS, Qwen, Piper и других на 07.02.2026.
5410
Проблема деградации интеллекта в дистиллированных моделях: как отличить качественный дистиллят от вредного
Почему дистиллированные модели теряют reasoning способности и как проверить качество дистилляции перед использованием. Практические советы на 2026 год.
5411
Как настроить мониторинг локальной LLM-фермы с Grafana и Prometheus: полный гайд с Docker
Пошаговый гайд по настройке мониторинга локальной LLM-фермы с Grafana, Prometheus и DCGM-exporter. Мониторинг GPU, VRAM, температуры и производительности моделе
5412
11 маленьких LLM на CPU: какой размер действительно работает для tool-calling?
Практическое исследование: 11 локальных LLM на CPU для tool-calling. Qwen 2.5, BitNet, LLaMA — кто справляется с задачей, а кто галлюцинирует?