Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Agentic Resource Discovery (ARD): новый стандарт для динамического поиска инструментов ИИ-агентов от Microsoft, Google и Hugging Face Разбираем Agentic Resource Discovery — открытый протокол Microsoft, Google и Hugging Face для динамического обнаружения инструментов агентов. Реализация, пример 5 мин чтения 02 Выжать соки из маленькой LLM: как Rust и Candle превращают бюджетные модели в зверей Разбираемся, как библиотека Candle на Rust выжимает максимум из маленьких моделей: квантование, скорость, малый footprint. Сравнение с llama.cpp и Ollama. 5 мин чтения 03 Запуск TRELLIS.2 на Mac: нативный MLX-порт для генерации 3D из изображения Как запустить TRELLIS.2 на Apple Silicon через MLX: установка, примеры, сравнение с Hunyuan3D и TripoSR. Работает на M1/M2/M3 без CUDA и интернета. 5 мин чтения 04 Локальный LLM-агент пишет raytraced FPS на C: техника headless screenshot loops Как 30B модель без API написала raytraced FPS-демку на C с помощью итеративного цикла headless screenshot loops. Разбор техники и примеры. 6 мин чтения 05 Забудьте про сценаристов: эта open-source RPG пишет NPC и квесты на лету через локальную LLM Обзор открытой RPG, где каждый NPC и квест генерируются нейросетью на вашем ПК. Сравнение с альтернативами, примеры использования, рекомендации. 5 мин чтения 06 SIQ-1 Qwen3.6: Как 35B модель с PPO учится исследовать мир без вашего присмотра Обзор новой модели SIQ-1 Qwen3.6 на базе Qwen-35B: возможности, сравнение с аналогами, примеры использования. Дообучение PPO для автономной работы агентов. 5 мин чтения 07 DreamX-World-5B: как запустить открытую модель генерации миров на своём железе Полный обзор DreamX-World-5B — открытой модели генерации видео с памятью локаций. Как запустить на своём GPU, сравнение с Runway и Google Genie, примеры для игр 6 мин чтения 08 Approxima: QA-агент на LLM, который не ищет кнопки по CSS-классам Обзор Approxima — self-hosted QA-агента для мониторинга пользовательских сценариев на LLM. Установка, настройка, сравнение с Playwright и Cypress. Поддержка Cla 6 мин чтения 09 GLM 5.2: Игрушка для гиков или рабочий инструмент? Запускаем локально и через облако Релиз GLM 5.2 с открытыми весами и поддержкой Ollama. Сравнение с Llama 3.1 и Qwen2.5. Инструкция по запуску локально и через облачный API. Квантование, произво 5 мин чтения 10 Как избежать сломанных пайплайнов при сбое LLM: библиотека восстановления с сохранением схемы RescueSchema автоматически обнаруживает ошибки схемы JSON, повторяет запросы и переключает модели, предотвращая падение пайплайнов. Примеры, сравнение, код. 4 мин чтения 11 VibeThinker-3B: компактная модель с рассуждениями уровня DeepSeek V3 – архитектура, результаты и открытый код Обзор VibeThinker-3B — открытой 3B-модели, которая на AIME26 догоняет DeepSeek V3 и V4. Архитектура, бенчмарки, примеры использования и как запустить локально. 4 мин чтения 12 Nex-N2 Pro GGUF: обзор производительности, квантование и правда о ребрендинге Разбираем Nex-N2 Pro в GGUF: квантования от bartowski, сравнение с Rio-3.5, производительность на слабом железе. Узнайте правду о переименовании модели. 5 мин чтения