Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5401 AIME 2026: результаты тестов и анализ стоимости DeepSeek V3.2 за $0.09 Анализ результатов тестов AIME 2026 для DeepSeek V3.2: цена $0.09 за тест, сравнение с другими моделями и экономическая эффективность. 4 мин чтения 5402 LTX-2 против Kling/Veo3: что выбрать для кастомизации видео в 2026 году Практическое сравнение LTX-2, Kling Video O1 и Veo 3.1 для тонкой настройки. Какая модель лучше подходит для кастомизации в 2026 году — технический разбор. 7 мин чтения 5403 Как я с нуля обучил модель на 1.8M параметров: архитектура Strawberry, датасет и код Полное руководство по обучению языковой модели на 1.8M параметров: архитектура Strawberry, сбор датасета 40M токенов, код и гиперпараметры. 10 мин чтения 5404 Системный промпт Gemini Pro утек в сеть: вот что Google скрывает от пользователей Разбор утекшего системного промпта Gemini Pro от Google. Сравнение с OpenAI, Anthropic. Как создавать эффективные system prompts на основе анализа. 7 мин чтения 5405 Почему RAG-системы не проходят аудит безопасности: реальные кейсы и решения для SOC2/HIPAA Почему 80% RAG-систем не проходят аудит безопасности. Реальные кейсы утечек данных, prompt injection и решения для SOC2, HIPAA, GDPR в 2026 году. 8 мин чтения 5406 Защита от prompt injection в продакшне: практические методы для self-hosted LLM Полное руководство по защите self-hosted LLM от prompt injection в продакшне. Многослойная защита, инструменты и реальные кейсы на 2026 год. 6 мин чтения 5407 Скорость LLM: Почему pp/tg вас обманывает и как тестировать реальное время ожидания Полное руководство по тестированию реальной скорости LLM: как измерить время ожидания, автоматизировать бенчмаркинг и избежать ошибок pp/tg. Инструменты и метод 7 мин чтения 5408 Гибридный метод QAT+LoRA: скрытая альтернатива QLoRA, о которой никто не говорит Сравниваем QAT+LoRA с QLoRA для тонкой настройки больших моделей. Практические тесты, когда гибридный метод выигрывает и стоит ли переходить на полный QAT. 7 мин чтения 5409 Легковесные TTS-модели 2026: KokoroTTS против Qwen и других. Кто реально работает на RTX 3060? Тестируем легковесные TTS-модели для локального запуска на RTX 3060. Сравнение скорости, качества и требований KokoroTTS, Qwen, Piper и других на 07.02.2026. 8 мин чтения 5410 Проблема деградации интеллекта в дистиллированных моделях: как отличить качественный дистиллят от вредного Почему дистиллированные модели теряют reasoning способности и как проверить качество дистилляции перед использованием. Практические советы на 2026 год. 6 мин чтения 5411 Как настроить мониторинг локальной LLM-фермы с Grafana и Prometheus: полный гайд с Docker Пошаговый гайд по настройке мониторинга локальной LLM-фермы с Grafana, Prometheus и DCGM-exporter. Мониторинг GPU, VRAM, температуры и производительности моделе 9 мин чтения 5412 11 маленьких LLM на CPU: какой размер действительно работает для tool-calling? Практическое исследование: 11 локальных LLM на CPU для tool-calling. Qwen 2.5, BitNet, LLaMA — кто справляется с задачей, а кто галлюцинирует? 10 мин чтения