Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4388 материалов
01 7 критических ошибок при создании MCP-серверов на FastMCP и как их исправить Разбор фатальных ошибок в MCP-серверах на FastMCP: пустые описания, игнорирование ToolAnnotations, неверная типизация. Код, примеры, исправления. 6 мин чтения 02 Промпт-инжиниринг 2026: какие техники устарели и что работает с reasoning-моделями Разбираем, почему Chain-of-Thought и few-shot больше не работают. Новые техники промптинга для o4, Claude Thinking, Gemini 2.5 Pro Reasoning в 2026 году. 7 мин чтения 03 Как научить ИИ-ассистента создавать сценарии умного дома: пайплайн и обучение на контексте Технический разбор от SberDevices: как ГигаЧат создает сценарии умного дома на естественном языке. Контекстное обучение вместо SFT, сценарная машина, пайплайн. 9 мин чтения 04 Лучший код не побеждает: разбор финала хакатона по агентной инженерии Dev-to-Dev хакатон 2026: почему чистый код проиграл. Анализ 10 финалистов, Docker-контракт, метрики агентов. Уроки для AI-инженеров. 1 мин чтения 05 Локальные VLM для GUI-автоматизации на Apple Silicon: решение проблем с плотными интерфейсами и скоростью префилла Практический гайд по оптимизации quantized VLM (UI-TARS, CogAgent, Qwen2-VL) на Apple Silicon. Как уменьшить визуальные токены, ускорить префилл и запустить аге 10 мин чтения 06 Микрофреймворк Neuro Evolution: как создать десктопное GUI для обучения AI-агентов на Python с Gymnasium и wxPython Пошаговое руководство по созданию десктопного GUI для обучения агентов с Gymnasium и wxPython. Визуализация, параллельное обучение, код и типичные ошибки. 9 мин чтения 07 Как запустить языковую модель на Game Boy Color: экстремальное сжатие трансформеров Запуск языковой модели на 8-битной консоли: 1-битное квантование, Z80 ассемблер, 8KB RAM. Реальный гайд с кодом и подводными камнями. 6 мин чтения 08 Инженерия качества ИИ-агентов: измеряем Factual Correctness с помощью RAGAS (Часть 2) Глубокий разбор метрики Factual Correctness из RAGAS: claim decomposition, промпты, пошаговый код и подводные камни. Для QA-инженеров AI-агентов. 1 мин чтения 09 Выбор локальной LLM для системы мониторинга: интеграция Zabbix с нейросетью Практическое руководство по выбору и внедрению локальной языковой модели для анализа алертов Zabbix. Критерии, архитектура, ошибки, лучшие модели на май 2026. 9 мин чтения 10 Гибридный поиск и реранжирование в production RAG: почему dense retrieval недостаточно Почему dense retrieval ломает RAG в production. Гайд по гибридному поиску (BM25 + вектор) и реранжированию cross-encoder. Метрики, код, ошибки и production-аспе 9 мин чтения 11 Как построить AI-директора: отказ от RAG, граф знаний и типизированная память Пошаговый гайд по созданию AI-агента-директора на FastAPI, Claude Haiku 4.5 и SQLite. Отказ от RAG в пользу графа знаний и типизированной памяти: архитектура, к 9 мин чтения 12 Почему короткий промпт может быть дороже длинного: разбор prefix cache в LLM-агентах Разбираем парадокс: ужимая промпт для агентов, вы теряете преимущества prefix caching. Рассказываю, как логировать кэш, не стрелять себе в ногу и экономить до 9 6 мин чтения