Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4407 материалов
01 Математика сбоя AI-агентов: почему 85% точности - это катастрофа (разбор инцидента с Replit) Анализ инцидента с удалением БД в Replit. Математика вероятности сбоя AI-агентов. Почему 85% точности недостаточно для продакшена на 20.03.2026. 6 мин чтения 02 Промышленная транскрибация на Whisper: как ЮMoney масштабировали сервис для тысяч часов аудио Разбираем архитектуру сервиса транскрибации ЮMoney. Чанкование, диаризация, голосовые эмбеддинги на Whisper v3. Технический гайд по обработке тысяч часов звонко 9 мин чтения 03 Инструкции забываются, запреты работают: почему LLM игнорируют ваши указания в длинных контекстах Почему инструкции забываются в длинных контекстах LLM и как запреты решают проблему. Практическое руководство по промпт-инжинирингу на 2026 год. 7 мин чтения 04 Три провальные ловушки Agentic RAG: Retrieval Thrash, Tool Storms, Context Bloat — диагностика и защита Глубокий разбор трех опасных failure modes Agentic RAG: как диагностировать и защититься от Retrieval Thrash, Tool Storms и Context Bloat в production-системах 8 мин чтения 05 KV cache vs. весовая квантизация: Как экономить VRAM для параллельных запросов в Qwen 35B Практическое руководство по экономии памяти для параллельных запросов в Qwen 35B. Сравниваем KV cache quantization и Q4_K_M, разбираем настройку Ollama и Open W 12 мин чтения 06 Рефакторинг кода на Java с помощью LLM: практический гайд по миграции Feature Flags Пошаговая инструкция по использованию LLM для автоматической миграции Feature Flags в Java-коде. Готовые промпты, примеры кода до и после, актуальные инструмент 7 мин чтения 07 Автоматизация тестирования: как RAG + LLM генерируют Java-тесты в IDE — полный гайд Пошаговое руководство по настройке RAG и LLM для автоматической генерации JUnit-тестов с Allure-отчетами прямо в вашей IDE. Экономьте часы рутинной работы. 7 мин чтения 08 Как графы знаний решают проблему RAG в юриспруденции: сравнение с векторным поиском и настройка LightRAG Разбираем, почему векторный RAG проваливается в юриспруденции, как графы знаний решают проблему связей и практическая настройка LightRAG для юридических докумен 10 мин чтения 09 Создание консольного чата с LLM на Python: пошаговый гайд по Ollama, LiteLLM и system prompt Пошаговое создание локального чата с ИИ в терминале на Python. Устанавливаем Ollama, настраиваем LiteLLM, пишем скрипт с system prompt и обработкой ошибок. 7 мин чтения 10 Полное руководство по настройке autoresearch на RTX 5090: разбор ошибок, оптимальная конфигурация и бенчмарки Подробное руководство по установке и настройке autoresearch на видеокарте RTX 5090. Разбор ошибок, оптимальные параметры, тесты производительности на архитектур 6 мин чтения 11 Какие модели запускать на RTX 5090: обзор для победителя Nvidia GTC Выиграли RTX 5090 на Nvidia GTC? Узнайте, какие языковые модели запускать на 24 ГБ GDDR7, как настроить и избежать ошибок. Актуально на март 2026. 9 мин чтения 12 Локальные эмбеддинги с Qwen3-0.6B INT8 для AI memory system: практическое руководство Полное руководство по настройке локального сервера эмбеддингов на Qwen3-0.6B INT8. Замена OpenAI, экономия 95% затрат, ONNX Runtime, квантование и интеграция с 9 мин чтения