Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4407 материалов
01 Как избежать катастрофы с ИИ-агентом: уроки из случая удаления продакшена Claude Code Полное руководство по безопасности ИИ-агентов: принцип наименьших прав, резервные копии AWS, изоляция сред и мониторинг на основе реального инцидента с Claude C 9 мин чтения 02 State Flow Machine: как замена трансформеров добивается 79% удержания длины контекста Глубокий разбор архитектуры State Flow Machine. Как FlashLM и SlotMemoryAttention решают проблему квадратичной сложности трансформеров и дают 79% retention на д 6 мин чтения 03 Круши цензуру: как собрать свою uncensored LLM из Qwen и знаний Claude Opus за один вечер Пошаговый гайд по созданию uncensored LLM. Слияние тензоров Qwen3.5 9B, дистилляция знаний Claude Opus, готовый код на Google Colab для моделей без цензуры. 8 мин чтения 04 Разоблачение TB2: как задача db-wal-recovery ломает бенчмарки и как её правильно решить Глубокий разбор задачи db-wal-recovery из Terminal Bench 2.0. Почему стандартные бенчмарки пасуют перед SQLite WAL и XOR шифрованием. Пошаговое решение. 5 мин чтения 05 Homelab для LLM: как окупить сервер на H100 за счёт экспериментов с большими моделями Реальный кейс: как собрать домашний сервер на H100 для экспериментов с LLM и окупить его, сэкономив на облачных вычислениях. Расчёты, настройка Grafana, выбор ж 8 мин чтения 06 Тест производительности: ik_llama.cpp против llama.cpp на Qwen3/3.5 MoE - 40% прирост или оптимизация под копирку? Полный бенчмарк ik_llama.cpp и llama.cpp на Qwen3/3.5 MoE. Команды, настройки, реальный прирост скорости до 40%. Аппаратная конфигурация, квантование Q4_K_M, ан 10 мин чтения 07 Практическое руководство по разработке AI-агентов: критика MCP, безопасность и архитектурные принципы Глубокий разбор ошибок в создании AI-агентов: почему MCP и терминал опасны. Практические принципы безопасности и архитектуры для надежных систем на 15.03.2026. 8 мин чтения 08 Как ускорить long context диалоги на Apple Silicon в 200 раз: эксперимент с KV cache в MLX Подробный эксперимент с KV cache в MLX: как добиться ускорения в 200 раз для long context диалогов на Mac, разбор ошибок с thinking tokens, практическое руковод 10 мин чтения 09 Kotlin HumanEval: 14B-модель громит 70B-гигантов, и вот почему ваши бенчмарки врут Результаты бенчмарка Kotlin HumanEval на 15.03.2026: маленькая локальная LLM обогнала гигантов. Анализ pass@1, pass@3 и почему размер не главное. 7 мин чтения 10 Как выбрать бюджетный ноутбук для локального запуска Qwen 3.5-35B-A3B: анализ железа, тесты и лайфхаки Подробное руководство по выбору бюджетного ноутбука для локального запуска Qwen 3.5-35B-A3B. Анализ требований к железу, тесты производительности и практические 7 мин чтения 11 Как построить мультиагентный AI-прогнозатор событий: архитектура Seldon Vault на Python Пошаговый гайд по созданию мультиагентного AI-прогнозатора событий с архитектурой Seldon Vault. Анализ новостей, DeepSeek-V3, координация агентов. 9 мин чтения 12 Как Peacock создал AI-аватара Энди Коэна: компьютерное зрение и агенты для генерации персонализированных видео Разбираем архитектуру системы Peacock для генерации персонализированных видео с AI-аватаром Энди Коэна. Компьютерное зрение, анализ 5000 часов контента, рекомен 7 мин чтения