Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3697 AI против Open Source: Как chardet сменил лицензию с LGPL на MIT и разозлил своего создателя Скандал в мире open source: ИИ использовали для смены лицензии chardet с LGPL на MIT. Создатель вернулся после 15 лет молчания. Вся история и последствия на 13 5 мин чтения 3698 Tenstorrent QuietBox 2: AI-инференс на RISC-V для домашних ПК - что это даёт энтузиастам Tenstorrent QuietBox 2 – AI-ускоритель на открытой архитектуре RISC-V для домашних ПК. Разбираем его возможности для локального инференса, производительность и 5 мин чтения 3699 Поддержка NVFP4 в llama.cpp: ваш билет в мир квантованных моделей NVIDIA Полное руководство по использованию формата NVFP4 от NVIDIA в llama.cpp. Узнайте, как собрать, конвертировать модели и получить прирост скорости на CPU и GPU. 5 мин чтения 3700 Выбор железа для 24/7 агентов: CUDA на 6x RTX 3080 vs энергоэффективные Strix Halo и GB10 Практический гайд по выбору железа для круглосуточных AI агентов. Сравнение производительности, энергопотребления и экосистем CUDA и ROCm на примере 6x RTX 3080 9 мин чтения 3701 Pali v0.1: как настроить инфраструктуру памяти для LLM на Go с qdrant, neo4j и ollama Обзор Pali v0.1: настройка памяти для LLM на Go с Qdrant, Neo4j, Ollama. Мультитенантность, гибридный поиск, MCP сервер и бенчмарки. 5 мин чтения 3702 Сжимаем Llama 8B до 2.5 ГБ: Экстремальный гайд для Jetson Orin Nano Практический гайд по запуску 8-миллиардной модели Llama на Jetson Orin Nano с всего 2.5 ГБ памяти. Квантование, оптимизация, ошибки и реальные показатели. 8 мин чтения 3703 Understudy: ваш личный робот-помощник, который учится, глядя на экран Полный обзор Understudy — десктопного агента с открытым исходным кодом, который обучается по демонстрациям. Работает локально, без облаков. 3 мин чтения 3704 OmniCoder-9B: детальный обзор новой модели-агента для программирования от Tesslate Детальный обзор OmniCoder-9B от Tesslate: 9B параметров, контекст 262K, восстановление после ошибок. Сравнение с Claude Code и Qwen Coder Next, примеры использо 4 мин чтения 3705 Тепловое троттлинг на MacBook M5 Max: сравнение 14” и 16” для непрерывного вывода 72B моделей Реальные тесты теплового троттлинга на MacBook M5 Max 14” и 16” при непрерывном выводе Qwen 2.5 72B. Сравнение температуры, скорости генерации и практические ре 6 мин чтения 3706 GATED_DELTA_NET в llama.cpp: как новая опция Vulkan разгоняет Qwen до 30% Обзор новой функции GATED_DELTA_NET в llama.cpp для Vulkan. Установка, бенчмарки и прирост скорости до 30% для моделей Qwen на видеокартах AMD. Актуально на мар 5 мин чтения 3707 Архитектура AI-фабрики: как собрать команду из 9 агентов на open-source моделях с одной видеокартой — конфиги, модели, бенчмарки Практический гайд: собираем команду из 9 AI-агентов на open-source моделях с одной RTX 4090. Конкретные модели для каждой роли, настройки VRAM, бенчмарки HumanE 10 мин чтения 3708 Новые CloudWatch метрики TimeToFirstToken и EstimatedTPMQuotaUsage для Amazon Bedrock: настройка алертов и управление квотами Обзор новых метрик TimeToFirstToken и EstimatedTPMQuotaUsage в Amazon Bedrock. Как настроить алерты в CloudWatch и избежать троттлинга. Актуально на март 2026. 4 мин чтения