Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4407
материалов
01
Математика сбоя AI-агентов: почему 85% точности - это катастрофа (разбор инцидента с Replit)
Анализ инцидента с удалением БД в Replit. Математика вероятности сбоя AI-агентов. Почему 85% точности недостаточно для продакшена на 20.03.2026.
02
Промышленная транскрибация на Whisper: как ЮMoney масштабировали сервис для тысяч часов аудио
Разбираем архитектуру сервиса транскрибации ЮMoney. Чанкование, диаризация, голосовые эмбеддинги на Whisper v3. Технический гайд по обработке тысяч часов звонко
03
Инструкции забываются, запреты работают: почему LLM игнорируют ваши указания в длинных контекстах
Почему инструкции забываются в длинных контекстах LLM и как запреты решают проблему. Практическое руководство по промпт-инжинирингу на 2026 год.
04
Три провальные ловушки Agentic RAG: Retrieval Thrash, Tool Storms, Context Bloat — диагностика и защита
Глубокий разбор трех опасных failure modes Agentic RAG: как диагностировать и защититься от Retrieval Thrash, Tool Storms и Context Bloat в production-системах
05
KV cache vs. весовая квантизация: Как экономить VRAM для параллельных запросов в Qwen 35B
Практическое руководство по экономии памяти для параллельных запросов в Qwen 35B. Сравниваем KV cache quantization и Q4_K_M, разбираем настройку Ollama и Open W
06
Рефакторинг кода на Java с помощью LLM: практический гайд по миграции Feature Flags
Пошаговая инструкция по использованию LLM для автоматической миграции Feature Flags в Java-коде. Готовые промпты, примеры кода до и после, актуальные инструмент
07
Автоматизация тестирования: как RAG + LLM генерируют Java-тесты в IDE — полный гайд
Пошаговое руководство по настройке RAG и LLM для автоматической генерации JUnit-тестов с Allure-отчетами прямо в вашей IDE. Экономьте часы рутинной работы.
08
Как графы знаний решают проблему RAG в юриспруденции: сравнение с векторным поиском и настройка LightRAG
Разбираем, почему векторный RAG проваливается в юриспруденции, как графы знаний решают проблему связей и практическая настройка LightRAG для юридических докумен
09
Создание консольного чата с LLM на Python: пошаговый гайд по Ollama, LiteLLM и system prompt
Пошаговое создание локального чата с ИИ в терминале на Python. Устанавливаем Ollama, настраиваем LiteLLM, пишем скрипт с system prompt и обработкой ошибок.
10
Полное руководство по настройке autoresearch на RTX 5090: разбор ошибок, оптимальная конфигурация и бенчмарки
Подробное руководство по установке и настройке autoresearch на видеокарте RTX 5090. Разбор ошибок, оптимальные параметры, тесты производительности на архитектур
11
Какие модели запускать на RTX 5090: обзор для победителя Nvidia GTC
Выиграли RTX 5090 на Nvidia GTC? Узнайте, какие языковые модели запускать на 24 ГБ GDDR7, как настроить и избежать ошибок. Актуально на март 2026.
12
Локальные эмбеддинги с Qwen3-0.6B INT8 для AI memory system: практическое руководство
Полное руководство по настройке локального сервера эмбеддингов на Qwen3-0.6B INT8. Замена OpenAI, экономия 95% затрат, ONNX Runtime, квантование и интеграция с