Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 AFM MLX: как ускорить локальные LLM на Mac с помощью нативного Swift-инструмента Узнайте, как AFM MLX ускоряет локальные LLM на Apple Silicon с помощью нативного Swift, batch mode и prefix cache. Сравнение с альтернативами и примеры использо 4 мин чтения 02 CompactifAI: как технологии сжатия Multiverse Computing позволяют запускать мощные модели локально Как работает CompactifAI от Multiverse Computing. Технология квантового сжатия для запуска GPT-4o-class моделей на ноутбуке. Сравнение, примеры, кому подойдет в 5 мин чтения 03 Qwen3.5-40B как локальная замена Claude Opus: обзор тонких настроек и GGUF квантований Обзор Qwen3.5-40B как локальной замены Claude Opus. Тонкие настройки, GGUF квантования, сравнение с альтернативами и рекомендации по использованию. 5 мин чтения 04 Arandu v0.6.0: обзор лаунчера для llama.cpp с управлением моделями и HuggingFace Обзор Arandu v0.6.0 — графического лаунчера для llama.cpp с интеграцией HuggingFace. Скачивание моделей, запуск сервера, мониторинг железа. 6 мин чтения 05 Hunyuan3D 2 Mini: Ваш персональный фабрикант 3D-мешей на диване Установите открытый Hunyuan3D 2 Mini для генерации 3D-мешей из фото на своем ПК. Сравнение с аналогами, примеры и гайд по настройке на 2026 год. 5 мин чтения 06 Project Golem: Когда RAG перестаёт быть чёрным ящиком Open-source инструмент Project Golem визуализирует работу RAG-систем в интерактивном 3D-графе. Обзор возможностей для отладки и понимания эмбеддингов. 5 мин чтения 07 Qianfan-OCR 4B: как заменить громоздкий пайплайн одной моделью для распознавания документов на 192 языках Обзор Qianfan-OCR 4B — модели, которая распознает документы на 192 языках без сложных пайплайнов. Сравнение с Gemini, тесты OmniDocBench, квантование W8A8. 4 мин чтения 08 AFM MLX 0.9.7: полный обзор продвинутой обёртки для локальных LLM на Mac с Telegram-ботом и грамматическим декодированием Обзор AFM MLX 0.9.7 - инструмента для запуска локальных LLM на Apple Silicon с Telegram-ботом, грамматическим декодированием и кэшированием префиксов. 4 мин чтения 09 Взлом песочницы NemoClaw: запуск локального агента Nemotron 9B на одной видеокарте RTX 5090 Технический гайд: как обойти изоляцию NemoClaw, поднять локальный vLLM инстанс с Nemotron 9B на RTX 5090 и настроить tool_calls. Полный контроль вместо облака. 6 мин чтения 10 Omnicoder-Claude-4.6-Opus-Uncensored: полное руководство по мержу и квантованию разблокированных моделей Qwen 3.5 Пошаговый гайд по созданию uncensored-модели через Add Difference merge и квантование в GGUF. Актуально на март 2026. 5 мин чтения 11 Локальный движок роевого интеллекта для macOS: установка и использование multi-agent дебатов на Apple Silicon Запускайте multi-agent дебаты AI локально на macOS с Apple Silicon. Конфиденциальность, глубокий анализ, установка и примеры использования. 5 мин чтения 12 FlashMotion: как использовать контролируемую генерацию видео с 50-кратным ускорением локально Руководство по FlashMotion - революционной модели для контролируемой генерации видео с 50-кратным ускорением. Установка, примеры, сравнение с Kling и SVD. 6 мин чтения