Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Автотюнинг llama.cpp: скрипт, который не даст тебе сойти с ума от OOM на нескольких видеокартах Обзор скрипта для автотюнинга llama.cpp. Автоматическая оптимизация скорости, борьба с OOM на нескольких видеокартах. Примеры, сравнение, рекомендации. 7 мин чтения 02 Helios: как запустить генерацию видео в реальном времени (19.5 FPS) на одной видеокарте с 14B-моделью Полный обзор Helios — генерация видео в реальном времени с 14B-моделью. Сравнение с SVD, Flux, Diffusers и vLLM интеграция. Руководство по запуску на RTX 5090/H 5 мин чтения 03 Голос для локальной LLM: разворачиваем Kitten TTS сервер на Windows через MCP Запустите локальный TTS-сервер Kitten TTS/ONNX для голосового вывода в LLM через Model Context Protocol на Windows. Пошаговое руководство без зависимостей Pytho 6 мин чтения 04 Autoresearch на Apple Neural Engine: разбор реализации Karpathy и ускорение на M3 MacBook Глубокий разбор инструмента autoresearch от Андрея Карпати для автоматического исследования нейросетей. Динамические веса, ускорение на Apple Neural Engine, сра 5 мин чтения 05 Hugging Face Storage Buckets: полное руководство по S3-совместимому хранилищу для ML-артефактов Обзор Hugging Face Storage Buckets - S3-совместимого хранилища для чекпоинтов, датасетов и ML-артефактов. Интеграция с Xet, Python и CLI. 5 мин чтения 06 Как собрать no-code ИИ-агента для аудита процессов на n8n, Qdrant и Docker: кейс Woyax Соберите локального ИИ-агента для аудита процессов без кода. Практический разбор стека Woyax: n8n для workflow, Qdrant для RAG и Docker для развертывания. 6 мин чтения 07 Гонка за памятью: как разогнать Gemma-3 на AMD Strix Halo с помощью распределенного финтюнинга Пошаговое руководство по ускорению финтюнинга Gemma-3 на AMD Strix Halo с Unsloth 2026. Распределенное обучение, оптимизация памяти и настройка multi-node трени 7 мин чтения 08 Bartowski против Unsloth UD-XL: Qwen 122B на Strix Halo показывает, кто король квантов Тесты производительности и логической стабильности Bartowski и Unsloth UD-XL квантований для Qwen 35B и 122B на платформе Strix Halo в 2026 году. 5 мин чтения 09 Granite 4.0 1B Speech: обзор и применение компактной мультиязычной модели для распознавания речи на edge-устройствах Обзор Granite 4.0 1B Speech от IBM - компактной мультиязычной модели для распознавания речи на устройствах с ограниченными ресурсами. Сравнение с Whisper, Parak 5 мин чтения 10 JDTBridge: Как заставить ИИ видеть Java-код насквозь JDTBridge дает AI-агенту семантическое понимание Java-кода через Eclipse JDT. Экономит токены, улучшает анализ. Сравнение с Drift и Explyt Spring MCP. 4 мин чтения 11 LeRobot v0.5.0: полный гайд по установке и работе с гуманоидом Unitree G1 Подробный гайд по работе с LeRobot v0.5.0 для управления гуманоидом Unitree G1. Новые политики, Python 3.12, Transformers v5, интеграция с IsaacLab. 8 мин чтения 12 Как заменить облачный LLM-агент на 0.6B модель с лучшей точностью: open-source pipeline Open-source pipeline для создания специализированной 0.6B модели из продакшн-трейсов. Точность 79.5% против 50% у облачного агента. Экономьте на токенах. 4 мин чтения