Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6889 Fused kernels на Triton: как снизить память LLM на 84% и победить logit bottleneck Глубокое руководство по созданию fused kernel на Triton для Cross Entropy. Решение проблемы памяти с большими словарями в LLM. Код, математика, практика. 10 мин чтения 6890 DroPE: хак, который ломает фундамент LLM и заставляет их читать в 10 раз больше Революционный метод DroPE из arXiv 2512.12167: как заставить LLM читать длинные тексты без дообучения, просто удалив позиционные эмбеддинги. Практическое руково 8 мин чтения 6891 Провалы A/B-тестов на маркетплейсах: как учесть сетевые эффекты и конкуренцию в экспериментах Почему классические A/B-тесты врут на маркетплейсах. Практическое руководство по кластерным тестам, учету конкуренции и сетевых эффектов. Реальные кейсы и решен 8 мин чтения 6892 Документы в свалке? Сделайте из них интерактивную базу знаний за два вечера Пошаговый гайд по созданию интерактивной базы знаний из документов за 2 вечера. ИИ для структурирования, RAG для поиска, Docker для развертывания. 9 мин чтения 6893 Автоматизация иллюстрации книг: полный пайплайн с Llama, Mistral и Qwen3-VL для генерации и оценки изображений Пошаговое руководство по автоматизации иллюстраций книг с помощью LLM и VLM. Генерация промптов, создание и оценка изображений в одном пайплайне. 11 мин чтения 6894 GLM-Image: китайский монстр для текста в картинках, который игнорирует NVIDIA Как GLM-Image с гибридной AR+Diffusion архитектурой работает на Huawei Ascend, обходит Stable Diffusion в CVTG-2K и доступен с MIT-лицензией. 3 мин чтения 6895 Разметка данных: автоматизируй, экономь, избегай ошибок Практическое руководство по автоматизации разметки данных для ML-проектов. Как снизить стоимость, избежать ошибок и ускорить подготовку датасетов с помощью Labe 7 мин чтения 6896 Убиваем цветовые артефакты: Lab-пространство и трёхуровневая стратегия для чистого композитинга Пошаговое руководство по устранению цветовых артефактов при наложении изображений. Переход из RGB в Lab, работа с масками BiRefNet и трёхуровневая стратегия бле 7 мин чтения 6897 Как добавить AI-поиск в логах на естественном языке: промпт-инжиниринг для генерации regex Пошаговый гайд по добавлению AI-поиска в логи. Заменяем сложные regex на естественный язык с помощью промпт-инжиниринга и Vercel AI SDK. Безопасность Extension 9 мин чтения 6898 Полное руководство по локальному запуску Llama 3.1: Ollama + Open WebUI + Docker для приватного AI Пошаговый гайд по развертыванию приватного AI на Llama 3.1 с помощью Ollama и Open WebUI в Docker. Полная изоляция, никаких облачных API. 8 мин чтения 6899 SWE-bench 2025: GPT-5.2, GLM-4.7 и DeepSeek v3.2 дерутся за титул лучшего кодера Свежие данные с SWE-bench лидерборда: кто из языковых моделей лучше пишет код в 2025 году. GPT-5.2 против GLM-4.7 против DeepSeek v3.2. 5 мин чтения 6900 RTX PRO 4000 SFF Blackwell: 24 ГБ VRAM в корпусе размером с книгу. Стоит ли игра свеч для домашнего AI? Подробный разбор RTX PRO 4000 SFF Blackwell для компактного AI-сервера. Производительность в LLM, RAG и Stable Diffusion, сравнение с RTX 5090 и ProArt 4060. 9 мин чтения