Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4377 материалов
01 Как исправить ошибку Xid 79 'GPU has fallen off the bus' на RTX 3090: практическое руководство Ошибка GPU has fallen off the bus на RTX 3090? Решение: чистка контактов PCIe райзера, проверка питания и драйверов. Полный гайд для владельцев multi-GPU. 7 мин чтения 02 Как приручить Llama 3.1 8B: pydantic-graph для надежных агентов на HumanEval Пошаговый гайд по созданию кодинг-агента на Llama 3.1 8B с pydantic-graph. Повышаем accuracy на HumanEval до 75% за счет конечных автоматов. Код, примеры, грабл 7 мин чтения 03 Как скрытый слот PCIe 2.0 x4 уничтожил производительность 4x RTX 3090 и как это исправить: полный гайд по диагностике multi-GPU rig Реальный кейс: слот PCIe 2.0 x4 убил производительность 4x RTX 3090. Узнайте, как диагностировать и исправить проблему с multi-GPU rig. Команды, настройки, сове 6 мин чтения 04 Связка rtk + context-mode поверх Serena и Semble: аудит прокси-экономии токенов — профит или оверхед? Детальный аудит связки rtk + context-mode поверх Serena и Semble: замеры экономии токенов, оверхед по латентности, пошаговая настройка и подводные камни. Резуль 8 мин чтения 05 Практическое руководство по LLM Engineering: RAG, реранкеры и оценка — полный гайд с примерами кода Пошаговое руководство по сборке продакшн-пайплайна RAG: гибридный поиск, реранкеры, LLM-as-Judge. Примеры кода, грабли и советы инженера. 6 мин чтения 06 Как внедрить MCP в Enterprise: опыт платформы MWS Octapi с low-code интеграциями Пошаговое руководство по интеграции MCP-протокола с корпоративными системами на примере low-code платформы MWS Octapi. OpenAPI, SOAP, GraphQL и типичные ошибки. 6 мин чтения 07 Как появиться в ответах ChatGPT: пошаговый гайд по созданию личного сайта для LLM за один вечер Пошаговая инструкция, как за один вечер создать сайт, который ChatGPT и Claude будут цитировать. Форк репозитория, llms.txt, деплой, подводные камни. 6 мин чтения 08 ZeroClaw: как мы автоматизировали расчёт отпусков с помощью AI-агента в корпоративном мессенджере Подробный кейс: ZeroClaw + Mattermost для расчёта отпусков. Интеграция, локальные модели, обработка исключений. Сократили время расчёта с 30 минут до 30 секунд. 7 мин чтения 09 Стратум: инженерная методология для превращения LLM в детерминированную систему Галлюцинации и нестабильность LLM побеждаются архитектурно. Стратум — методология, вдохновлённая советской школой проектирования. Пошаговый гайд с примерами и т 6 мин чтения 10 DQ-шаблон с ИИ-агентом и MCP: как мы автоматизировали проверку качества данных (и где споткнулись) Практический гайд по сборке DQ-шаблона с ИИ-агентом и MCP-сервером: архитектура, пошаговый план, типичные ошибки и как их избежать. Для BI и Data Engineering ко 7 мин чтения 11 Как настроить K8s для LLM инференса: DRA, GIE и LLM-D на практике Настройка Kubernetes для высоконагруженного LLM инференса с DRA, GIE и LLM-D. Практические шаги, архитектура, ошибки. Только реальный опыт 2026. 7 мин чтения 12 Масштабирование AI-систем: от GPT-wrapper до распределённой архитектуры Как превратить простой API-вызов в миллион RPS? Разбираем кэширование, rate limiting, роутинг запросов и распределенный вывод. Гайд для DevOps и архитекторов AI 8 мин чтения