Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6889
Fused kernels на Triton: как снизить память LLM на 84% и победить logit bottleneck
Глубокое руководство по созданию fused kernel на Triton для Cross Entropy. Решение проблемы памяти с большими словарями в LLM. Код, математика, практика.
6890
DroPE: хак, который ломает фундамент LLM и заставляет их читать в 10 раз больше
Революционный метод DroPE из arXiv 2512.12167: как заставить LLM читать длинные тексты без дообучения, просто удалив позиционные эмбеддинги. Практическое руково
6891
Провалы A/B-тестов на маркетплейсах: как учесть сетевые эффекты и конкуренцию в экспериментах
Почему классические A/B-тесты врут на маркетплейсах. Практическое руководство по кластерным тестам, учету конкуренции и сетевых эффектов. Реальные кейсы и решен
6892
Документы в свалке? Сделайте из них интерактивную базу знаний за два вечера
Пошаговый гайд по созданию интерактивной базы знаний из документов за 2 вечера. ИИ для структурирования, RAG для поиска, Docker для развертывания.
6893
Автоматизация иллюстрации книг: полный пайплайн с Llama, Mistral и Qwen3-VL для генерации и оценки изображений
Пошаговое руководство по автоматизации иллюстраций книг с помощью LLM и VLM. Генерация промптов, создание и оценка изображений в одном пайплайне.
6894
GLM-Image: китайский монстр для текста в картинках, который игнорирует NVIDIA
Как GLM-Image с гибридной AR+Diffusion архитектурой работает на Huawei Ascend, обходит Stable Diffusion в CVTG-2K и доступен с MIT-лицензией.
6895
Разметка данных: автоматизируй, экономь, избегай ошибок
Практическое руководство по автоматизации разметки данных для ML-проектов. Как снизить стоимость, избежать ошибок и ускорить подготовку датасетов с помощью Labe
6896
Убиваем цветовые артефакты: Lab-пространство и трёхуровневая стратегия для чистого композитинга
Пошаговое руководство по устранению цветовых артефактов при наложении изображений. Переход из RGB в Lab, работа с масками BiRefNet и трёхуровневая стратегия бле
6897
Как добавить AI-поиск в логах на естественном языке: промпт-инжиниринг для генерации regex
Пошаговый гайд по добавлению AI-поиска в логи. Заменяем сложные regex на естественный язык с помощью промпт-инжиниринга и Vercel AI SDK. Безопасность Extension
6898
Полное руководство по локальному запуску Llama 3.1: Ollama + Open WebUI + Docker для приватного AI
Пошаговый гайд по развертыванию приватного AI на Llama 3.1 с помощью Ollama и Open WebUI в Docker. Полная изоляция, никаких облачных API.
6899
SWE-bench 2025: GPT-5.2, GLM-4.7 и DeepSeek v3.2 дерутся за титул лучшего кодера
Свежие данные с SWE-bench лидерборда: кто из языковых моделей лучше пишет код в 2025 году. GPT-5.2 против GLM-4.7 против DeepSeek v3.2.
6900
RTX PRO 4000 SFF Blackwell: 24 ГБ VRAM в корпусе размером с книгу. Стоит ли игра свеч для домашнего AI?
Подробный разбор RTX PRO 4000 SFF Blackwell для компактного AI-сервера. Производительность в LLM, RAG и Stable Diffusion, сравнение с RTX 5090 и ProArt 4060.