Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4377 материалов
01 Granite 4.0 Nano от IBM: тестируем компактные модели для edge-вычислений Полный разбор семейства нано-моделей Granite 4.0 Nano от IBM (350M-1.5B параметров). Сравнение производительности с Gemma и Phi-3, инструкции по локальному запу 9 мин чтения 02 Оптимизация AMD Ryzen AI Halo (Strix Halo): практическое руководство для ускорения локального инференса LLM на 10–15% Пошаговая инструкция по настройке AMD Ryzen AI Halo для локального запуска LLM. Конкретные параметры BIOS/UEFI, оптимизации ОС, настройки llama.cpp и Ollama. Ре 8 мин чтения 03 Thunderbolt-бэкенд в PyTorch для Mac: ускорение распределенного ML на Apple Silicon в 2026 Глубокий разбор нового коммуникационного бэкенда Thunderbolt в PyTorch для ускорения ML-инференса на Apple Silicon. Архитектура, сравнение с NCCL, практические 10 мин чтения 04 Тестирование Qwen3.6 27B с тернарной квантизацией на RTX 3090: 60 токенов/с и стабильные tool call при 21 ГБ памяти Практический тест Qwen3.6 27B с тернарной квантизацией на GeForce RTX 3090: скорость генерации 60 токенов/с, потребление памяти 21 ГБ и полная сохранность функц 6 мин чтения 05 Bonsai-27B vs Qwen3.7 27B: сравнительный анализ GGUF-квантизаций от Prism-ML Полный разбор GGUF-квантизаций Bonsai-27B от Prism-ML и сравнение с Qwen3.7 27B. Анализ производительности, потребления памяти, троичного квантования и готовые 6 мин чтения 06 DeepSeek V4 и миф о one-shot программировании: что на самом деле показывают практические тесты Анализ практической применимости one-shot программирования с языковыми моделями. Сравнение эффективности one-shot vs мультиагентных подходов, архитектурные патт 7 мин чтения 07 GPT-5.6 Sol и проблема несанкционированных действий: технический анализ рисков и защита данных Технический разбор проблемы несанкционированных действий GPT-5.6 Sol: анализ уязвимости CWE-426, кейсы с удалением ВМ и риски кэша учетных данных. Практические 6 мин чтения 08 1-битные модели в 2026: практическое руководство по Bonsai 8B, AirLLM и развертыванию на edge Bonsai 8B (~1 ГБ) и 27B (~5 ГБ) — это уже не прототипы. Разбираем, как 1-битное квантование меняет правила игры: сравнение точности, инструкции по запуску через 7 мин чтения 09 От AI-ассистента к AI-компаньону: как OpenAI переопределяет smart-спикер Технический разбор первого аппаратного устройства OpenAI — умной колонки с механическими элементами. Детальный анализ архитектуры, практическое применение для р 7 мин чтения 10 huggingface_hub v1.0: архитектурный сдвиг, который переопределяет работу с open-source ML Глубокий технический анализ huggingface_hub v1.0: переход на HTTP/Xet протокол, оптимизация загрузки больших моделей, breaking changes и практические примеры ми 7 мин чтения 11 Hugging Face AI Sheets с поддержкой зрения в 2026: бескодовое извлечение данных и генерация контента Практический разбор обновления Hugging Face AI Sheets для анализа изображений без кода. Как извлекать данные из чеков, графиков и документов, генерировать визуа 9 мин чтения 12 Voice Consent Gate: Архитектура и код для этичного клонирования голоса с GigaAM и TTS | AI-MANUAL Готовое техническое решение для этичного клонирования голоса. Модульная архитектура Voice Consent Gate на Python с кодом, использованием GigaAM Multilingual для 10 мин чтения