Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Скрипт AutoHotkey для Windows: ввод символов Markdown и кода без переключения русской раскладки
Готовый скрипт AutoHotkey 2.1.5 для Windows 11. Вводите символы *, _, `, [] без переключения раскладки. Установка, код, сравнение с аналогами.
02
Corbell: Как анализировать архитектуру нескольких репозиториев и генерировать дизайн-документы локально (с Ollama)
Обзор open-source инструмента Corbell для анализа архитектуры нескольких Git-репозиториев и генерации дизайн-документов оффлайн через Ollama. Сравнение с Augmen
03
Поддержка NVFP4 в llama.cpp: ваш билет в мир квантованных моделей NVIDIA
Полное руководство по использованию формата NVFP4 от NVIDIA в llama.cpp. Узнайте, как собрать, конвертировать модели и получить прирост скорости на CPU и GPU.
04
Pali v0.1: как настроить инфраструктуру памяти для LLM на Go с qdrant, neo4j и ollama
Обзор Pali v0.1: настройка памяти для LLM на Go с Qdrant, Neo4j, Ollama. Мультитенантность, гибридный поиск, MCP сервер и бенчмарки.
05
Understudy: ваш личный робот-помощник, который учится, глядя на экран
Полный обзор Understudy — десктопного агента с открытым исходным кодом, который обучается по демонстрациям. Работает локально, без облаков.
06
OmniCoder-9B: детальный обзор новой модели-агента для программирования от Tesslate
Детальный обзор OmniCoder-9B от Tesslate: 9B параметров, контекст 262K, восстановление после ошибок. Сравнение с Claude Code и Qwen Coder Next, примеры использо
07
GATED_DELTA_NET в llama.cpp: как новая опция Vulkan разгоняет Qwen до 30%
Обзор новой функции GATED_DELTA_NET в llama.cpp для Vulkan. Установка, бенчмарки и прирост скорости до 30% для моделей Qwen на видеокартах AMD. Актуально на мар
08
Новые CloudWatch метрики TimeToFirstToken и EstimatedTPMQuotaUsage для Amazon Bedrock: настройка алертов и управление квотами
Обзор новых метрик TimeToFirstToken и EstimatedTPMQuotaUsage в Amazon Bedrock. Как настроить алерты в CloudWatch и избежать троттлинга. Актуально на март 2026.
09
EVR-1 Maano: революционное 3-битное сжатие для Llama 3.1 8B — практическое применение и сравнение с GGUF
Обзор EVR-1 Maano — метода 3-битного квантования для Llama 3.1 8B, который решает проблему дегенерации. Сравнение с GGUF, примеры использования и рекомендации н
10
Nemotron-3 120B на RTX Pro 6000 Blackwell: полный бенчмарк скорости при длинном контексте до 512K
Тест производительности флагманской модели NVIDIA на новейшем GPU Blackwell. Цифры по TTFT, многопользовательской нагрузке и fp8 KV cache для контекста в 512 ты
11
pygbnf: грамматики для llama.cpp без головной боли с зависимостями
Как использовать pygbnf для создания грамматик без версионных конфликтов в llama.cpp. Примеры кода, сравнение с альтернативами и рекомендации.
12
Шпион из ядра: как eBPF-трассировщик мониторит LLM API без вашего ведома
Обзор eBPF-трассировщика для мониторинга вызовов LLM API и Model Context Protocol. Нулевое изменение кода, экспорт в OpenTelemetry, поддержка GPT-5, Claude 4, L