Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Новые встроенные инструменты llama.cpp server: exec_shell, edit_file и другие — полный обзор Полный обзор новых агентных функций llama.cpp: exec_shell, edit_file. Как они меняют локальный AI. Примеры, риски, альтернативы. 5 мин чтения 02 Мета-трансформеры: архитектура внимания, которая переворачивает игру с ног на голову Разбор Meta-Transformers — альтернативы классическому Transformer с нелинейным механизмом внимания. Где скачать веса, как тестировать и кому это нужно. 4 мин чтения 03 CodeGraph: граф кода для Claude Code вместо grep — обзор архитектуры, бенчмарков и сравнение с SocratiCode Разбор open-source MCP-сервера CodeGraph: tree-sitter + SQLite, бенчмарки 92% точности, сравнение с SocratiCode и архитектурные особенности. 4 мин чтения 04 Как исправить теги thinking в Gemma 4 31B с помощью Jinja-шаблона для llama.cpp Пошаговый гайд: исправляем баг с незакрытыми тегами рассуждений в Gemma 4 31B. Используем кастомный Jinja-шаблон из репозитория на HuggingFace. Работает в llama 5 мин чтения 05 Как добавить диаризацию и временные метки в Cohere Transcribe: дообучение модели для улучшенного распознавания речи Пошаговое руководство по дообучению Cohere Transcribe для поддержки диаризации и временных меток. Сравнение с Whisper, примеры кода и ссылка на готовую модель н 4 мин чтения 06 Zero от Vercel: agent-first язык — новый стандарт или маркетинг? Разбираем Zero от Vercel: синтаксис, бенчмарки, сравнение с Mojo и CodeSpeak. Agent-first подход — прорыв или очередной хайп Vercel? Анализ критики и перспектив 5 мин чтения 07 Как обучить детектор промпт-инъекций с ml-intern и DeepSeek v4 Flash для работы в браузере Пошаговый гайд: тренируем детектор атак на LLM с ml-intern и DeepSeek v4 Flash, экспортируем в ONNX и запускаем в браузере. Безопасность AI-агентов. 6 мин чтения 08 Специализация vs масштаб: как модель 3B параметров обходит гигантов на 50x дешевле — разбор DharmaOCR Разбираем, как специализированная OCR-модель DharmaOCR с 3B параметрами обходит гигантов в 50 раз дешевле. Сравнение с Qianfan-OCR, GLM-OCR, примеры использован 6 мин чтения 09 ztok: мультипоточный токенизатор на Zig, который рвет tiktoken как тузик грелку Обзор ztok — токенизатора на Zig с поддержкой tiktoken, HF и SentencePiece. Ускорение в 2-5 раз, мультипоточность, примеры. Кому нужен и как использовать. 4 мин чтения 10 Локальный запуск LLM: как стать «quasi-local summoner» — пошаговое руководство сообщества LocalLLaMA Полное руководство по запуску больших языковых моделей на арендованных GPU с полным локальным контролем. Команды, конфиги, сравнение с альтернативами. 6 мин чтения 11 Equinox-31B: создатели AI Dungeon выпустили открытую модель на базе Gemma 3 Equinox-31B — новый финтюн Gemma 3 от создателей AI Dungeon. Разбираем, чем эта модель отличается от других, кому подойдет для локальных экспериментов и сценарн 5 мин чтения 12 Spring AI: универсальный адаптер между Java и LLM — возможности, настройка и интеграция Полный обзор Spring AI — инструмента для интеграции LLM в Java-приложения. Сравнение с альтернативами, примеры настройки, код, рекомендации. Актуально на 2026 г 9 мин чтения