Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4388 материалов
01 Промпты для Nano Banana 2 (Gemini 3 Flash Image): формула CAD+Physics для фотореалистичных изображений Научитесь создавать фотореалистичные изображения с Nano Banana 2. Подробный гайд по формуле CAD+Physics, subsurface scattering и токенам внимания. Примеры промп 7 мин чтения 02 Как я сократил счёт за Cursor в 10 раз: MCP-серверы на страже бюджета Пошаговая настройка трёх MCP-серверов, которые радикально уменьшают расход токенов Cursor без потери производительности. Актуально на 2026. 8 мин чтения 03 Оптимизация KV-кэша для Qwen 3.6-35B-A3B: PPL, KL divergence и асимметричные K/V на M5 Max Глубокое тестирование методов экономии KV-кэша для Qwen 3.6-35B-A3B на M5 Max: PPL, KL divergence и асимметричное квантование K/V. Результаты до 1M контекста. 9 мин чтения 04 Написание компилятора LLM с нуля: как PyTorch преобразуется в CUDA на 5000 строк Python Глубокий разбор создания компилятора для LLM: захват графа torch.fx, генерация CUDA ядер, fusion и оптимизация. Практический код и подводные камни. Апрель 2026. 7 мин чтения 05 Локальный пайплайн PDF в аудиокнигу: Kokoro 82M, Qwen и llama.cpp Полный гайд по созданию полностью офлайн-конвейера PDF→аудиокнига: извлечение текста через Qwen, очистка llama.cpp и синтез Kokoro 82M. Без облаков, без затрат, 8 мин чтения 06 Аудит безопасности LLM-платформы: как один curl раскрыл все API-ключи Реальный кейс: как через SSRF и открытые API утекли ключи AI-платформы. Пошаговый гайд по аудиту и защите инфраструктуры LLM. 6 мин чтения 07 Как заменить PySpark на YAML: создание пайплайнов данных без разработчиков Пошаговый гайд: как перевести ETL на декларативные YAML-пайплайны, избавиться от зависимости от разработчиков и ускорить релизы. Актуально на 2026 год. 1 мин чтения 08 Как дать кодинг-агенту зрение: MCP-сервер с локальной vision-моделью GLM-5.1 Пошаговый гайд по созданию MCP-сервера с локальной моделью GLM-5.1 Vision 8B для анализа скриншотов и UI. Как дать агенту глаза без облака. 9 мин чтения 09 Как сэкономить токены в агентных системах: 6 методов с интерактивными графиками Инженерный гайд по снижению расхода токенов в агентных системах: prompt caching, semantic caching, lazy-loading инструментов, маршрутизация, субагенты и очистка 10 мин чтения 10 llama.cpp NVFP4 Benchmark: Native vs Non-Native Performance on RTX 5090 (Blackwell) Сравнение производительности NVFP4-квантования в llama.cpp на RTX 5090 (Blackwell). Реальные бенчмарки, сборка native vs non-native, прирост скорости до 50%. 7 мин чтения 11 Настройка Claude Code для Spec-Driven Development: рабочее место SDD-кодера Пошаговое руководство по настройке Claude Code для Spec-Driven Development. Узнайте, как превратить AI-агента в предсказуемого инженера с помощью спецификаций. 9 мин чтения 12 GraphRAG против слепоты векторного поиска: кейс Сбера и практический гайд по внедрению Узнайте, как GraphRAG решает проблему контекста в RAG. На примере Сбера: граф знаний + векторный поиск = идеальный retrieval. Пошаговое руководство. 7 мин чтения