Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Скрипт AutoHotkey для Windows: ввод символов Markdown и кода без переключения русской раскладки Готовый скрипт AutoHotkey 2.1.5 для Windows 11. Вводите символы *, _, `, [] без переключения раскладки. Установка, код, сравнение с аналогами. 6 мин чтения 02 Corbell: Как анализировать архитектуру нескольких репозиториев и генерировать дизайн-документы локально (с Ollama) Обзор open-source инструмента Corbell для анализа архитектуры нескольких Git-репозиториев и генерации дизайн-документов оффлайн через Ollama. Сравнение с Augmen 6 мин чтения 03 Поддержка NVFP4 в llama.cpp: ваш билет в мир квантованных моделей NVIDIA Полное руководство по использованию формата NVFP4 от NVIDIA в llama.cpp. Узнайте, как собрать, конвертировать модели и получить прирост скорости на CPU и GPU. 5 мин чтения 04 Pali v0.1: как настроить инфраструктуру памяти для LLM на Go с qdrant, neo4j и ollama Обзор Pali v0.1: настройка памяти для LLM на Go с Qdrant, Neo4j, Ollama. Мультитенантность, гибридный поиск, MCP сервер и бенчмарки. 5 мин чтения 05 Understudy: ваш личный робот-помощник, который учится, глядя на экран Полный обзор Understudy — десктопного агента с открытым исходным кодом, который обучается по демонстрациям. Работает локально, без облаков. 3 мин чтения 06 OmniCoder-9B: детальный обзор новой модели-агента для программирования от Tesslate Детальный обзор OmniCoder-9B от Tesslate: 9B параметров, контекст 262K, восстановление после ошибок. Сравнение с Claude Code и Qwen Coder Next, примеры использо 4 мин чтения 07 GATED_DELTA_NET в llama.cpp: как новая опция Vulkan разгоняет Qwen до 30% Обзор новой функции GATED_DELTA_NET в llama.cpp для Vulkan. Установка, бенчмарки и прирост скорости до 30% для моделей Qwen на видеокартах AMD. Актуально на мар 5 мин чтения 08 Новые CloudWatch метрики TimeToFirstToken и EstimatedTPMQuotaUsage для Amazon Bedrock: настройка алертов и управление квотами Обзор новых метрик TimeToFirstToken и EstimatedTPMQuotaUsage в Amazon Bedrock. Как настроить алерты в CloudWatch и избежать троттлинга. Актуально на март 2026. 4 мин чтения 09 EVR-1 Maano: революционное 3-битное сжатие для Llama 3.1 8B — практическое применение и сравнение с GGUF Обзор EVR-1 Maano — метода 3-битного квантования для Llama 3.1 8B, который решает проблему дегенерации. Сравнение с GGUF, примеры использования и рекомендации н 4 мин чтения 10 Nemotron-3 120B на RTX Pro 6000 Blackwell: полный бенчмарк скорости при длинном контексте до 512K Тест производительности флагманской модели NVIDIA на новейшем GPU Blackwell. Цифры по TTFT, многопользовательской нагрузке и fp8 KV cache для контекста в 512 ты 5 мин чтения 11 pygbnf: грамматики для llama.cpp без головной боли с зависимостями Как использовать pygbnf для создания грамматик без версионных конфликтов в llama.cpp. Примеры кода, сравнение с альтернативами и рекомендации. 6 мин чтения 12 Шпион из ядра: как eBPF-трассировщик мониторит LLM API без вашего ведома Обзор eBPF-трассировщика для мониторинга вызовов LLM API и Model Context Protocol. Нулевое изменение кода, экспорт в OpenTelemetry, поддержка GPT-5, Claude 4, L 5 мин чтения