Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 htmLLM-50M: HTML/CSS модель, которая запустится даже на вашем холодильнике Обзор и тесты специализированной tiny LLM htmLLM-50M для генерации HTML и CSS кода. Сравнение, примеры использования и инструкция по запуску на старом железе. 5 мин чтения 02 NVILA-8B-HD-Video от NVIDIA: как AutoGaze сокращает латенцию обработки 4K-видео в 19 раз Как новая мультимодальная модель NVILA-8B-HD-Video с технологией AutoGaze ускоряет обработку HD-видео в 19 раз. Сравнение с альтернативами и примеры использован 5 мин чтения 03 Sorting Hat CLI: магия переименования файлов через локальную VLM Как использовать Sorting Hat CLI для переименования файлов на основе локальной VLM. Работает оффлайн с llama.cpp и OpenAI API. Обзор возможностей и сравнение ал 4 мин чтения 04 DoomVLM: как запустить смертельный матч VLM-моделей в классической игре Doom Обзор DoomVLM — open-source инструмента для тестирования VLM-моделей в игре Doom. Сравнение моделей, поддержка OpenAI-совместимых API, интерактивные смертельные 5 мин чтения 05 Phi-4-Reasoning-Vision в GGUF: как запустить мультимодальный рассудок Microsoft на своем железе и не обжечься Подробный гайд по запуску мультимодальной модели Phi-4-Reasoning-Vision-15B в llama.cpp. Сравнение производительности на CPU и GPU, реальные тесты скорости и ал 6 мин чтения 06 LEVI: Гибридный фреймворк для эволюционной оптимизации кода с локальными и облачными LLM Обзор LEVI — фреймворка для эволюционной оптимизации кода с гибридным использованием локальных (Qwen3-30B) и облачных LLM. Экономия до 10 раз на inference. 5 мин чтения 07 IDS+ протокол: как разобраться с Byte-Premium в CJK текстах для LLM Обзор IDS+ протокола — нового решения проблемы Byte-Premium при обработке китайских, японских, корейских символов в GPT-5, Gemini 3.0 и других LLM. Сравнение, п 5 мин чтения 08 Llama.cpp reasoning budget: как ограничить «размышления» модели и не потерять в качестве Узнайте, как использовать новый reasoning budget в llama.cpp для ограничения токенов на размышления в моделях Qwen, DeepSeek. Экономьте ресурсы без ущерба качес 4 мин чтения 09 Как запустить Nemotron 3 Super 120B в llama.cpp: инструкция по GGUF и тесты Полная инструкция по запуску NVIDIA Nemotron 3 Super 120B в llama.cpp через GGUF формат. Тесты производительности, сравнение с альтернативами и настройка для ло 5 мин чтения 10 MCP-сервер для Godot: 35 инструментов, чтобы AI-агент разрабатывал и тестировал игры как человек Обзор mcp-server-godot 2026. 35 инструментов для интеграции Claude и GPT с Godot Engine. Автоматизация разработки, тестирования и сборки игр AI-агентом. 5 мин чтения 11 Apex-1: как запустить 350M параметровую Tiny-LLM на слабой видеокарте — обзор, бенчмарки и ONNX-экспорт Полный обзор Apex-1 Tiny-LLM на 350M параметров. Как запустить на RTX 5060 Ti, бенчмарки, ONNX-экспорт для edge-устройств и сравнение с альтернативами. 6 мин чтения 12 Reka Edge 7B: мультимодальная модель для edge-устройств, которая не требует облака Обзор Reka Edge 7B от Hugging Face — модели для анализа видео и изображений на edge-устройствах. Сравнение с аналогами, примеры использования и кому подойдет. 5 мин чтения