Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4407
материалов
01
Как избежать катастрофы с ИИ-агентом: уроки из случая удаления продакшена Claude Code
Полное руководство по безопасности ИИ-агентов: принцип наименьших прав, резервные копии AWS, изоляция сред и мониторинг на основе реального инцидента с Claude C
02
State Flow Machine: как замена трансформеров добивается 79% удержания длины контекста
Глубокий разбор архитектуры State Flow Machine. Как FlashLM и SlotMemoryAttention решают проблему квадратичной сложности трансформеров и дают 79% retention на д
03
Круши цензуру: как собрать свою uncensored LLM из Qwen и знаний Claude Opus за один вечер
Пошаговый гайд по созданию uncensored LLM. Слияние тензоров Qwen3.5 9B, дистилляция знаний Claude Opus, готовый код на Google Colab для моделей без цензуры.
04
Разоблачение TB2: как задача db-wal-recovery ломает бенчмарки и как её правильно решить
Глубокий разбор задачи db-wal-recovery из Terminal Bench 2.0. Почему стандартные бенчмарки пасуют перед SQLite WAL и XOR шифрованием. Пошаговое решение.
05
Homelab для LLM: как окупить сервер на H100 за счёт экспериментов с большими моделями
Реальный кейс: как собрать домашний сервер на H100 для экспериментов с LLM и окупить его, сэкономив на облачных вычислениях. Расчёты, настройка Grafana, выбор ж
06
Тест производительности: ik_llama.cpp против llama.cpp на Qwen3/3.5 MoE - 40% прирост или оптимизация под копирку?
Полный бенчмарк ik_llama.cpp и llama.cpp на Qwen3/3.5 MoE. Команды, настройки, реальный прирост скорости до 40%. Аппаратная конфигурация, квантование Q4_K_M, ан
07
Практическое руководство по разработке AI-агентов: критика MCP, безопасность и архитектурные принципы
Глубокий разбор ошибок в создании AI-агентов: почему MCP и терминал опасны. Практические принципы безопасности и архитектуры для надежных систем на 15.03.2026.
08
Как ускорить long context диалоги на Apple Silicon в 200 раз: эксперимент с KV cache в MLX
Подробный эксперимент с KV cache в MLX: как добиться ускорения в 200 раз для long context диалогов на Mac, разбор ошибок с thinking tokens, практическое руковод
09
Kotlin HumanEval: 14B-модель громит 70B-гигантов, и вот почему ваши бенчмарки врут
Результаты бенчмарка Kotlin HumanEval на 15.03.2026: маленькая локальная LLM обогнала гигантов. Анализ pass@1, pass@3 и почему размер не главное.
10
Как выбрать бюджетный ноутбук для локального запуска Qwen 3.5-35B-A3B: анализ железа, тесты и лайфхаки
Подробное руководство по выбору бюджетного ноутбука для локального запуска Qwen 3.5-35B-A3B. Анализ требований к железу, тесты производительности и практические
11
Как построить мультиагентный AI-прогнозатор событий: архитектура Seldon Vault на Python
Пошаговый гайд по созданию мультиагентного AI-прогнозатора событий с архитектурой Seldon Vault. Анализ новостей, DeepSeek-V3, координация агентов.
12
Как Peacock создал AI-аватара Энди Коэна: компьютерное зрение и агенты для генерации персонализированных видео
Разбираем архитектуру системы Peacock для генерации персонализированных видео с AI-аватаром Энди Коэна. Компьютерное зрение, анализ 5000 часов контента, рекомен