Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3697
AI против Open Source: Как chardet сменил лицензию с LGPL на MIT и разозлил своего создателя
Скандал в мире open source: ИИ использовали для смены лицензии chardet с LGPL на MIT. Создатель вернулся после 15 лет молчания. Вся история и последствия на 13
3698
Tenstorrent QuietBox 2: AI-инференс на RISC-V для домашних ПК - что это даёт энтузиастам
Tenstorrent QuietBox 2 – AI-ускоритель на открытой архитектуре RISC-V для домашних ПК. Разбираем его возможности для локального инференса, производительность и
3699
Поддержка NVFP4 в llama.cpp: ваш билет в мир квантованных моделей NVIDIA
Полное руководство по использованию формата NVFP4 от NVIDIA в llama.cpp. Узнайте, как собрать, конвертировать модели и получить прирост скорости на CPU и GPU.
3700
Выбор железа для 24/7 агентов: CUDA на 6x RTX 3080 vs энергоэффективные Strix Halo и GB10
Практический гайд по выбору железа для круглосуточных AI агентов. Сравнение производительности, энергопотребления и экосистем CUDA и ROCm на примере 6x RTX 3080
3701
Pali v0.1: как настроить инфраструктуру памяти для LLM на Go с qdrant, neo4j и ollama
Обзор Pali v0.1: настройка памяти для LLM на Go с Qdrant, Neo4j, Ollama. Мультитенантность, гибридный поиск, MCP сервер и бенчмарки.
3702
Сжимаем Llama 8B до 2.5 ГБ: Экстремальный гайд для Jetson Orin Nano
Практический гайд по запуску 8-миллиардной модели Llama на Jetson Orin Nano с всего 2.5 ГБ памяти. Квантование, оптимизация, ошибки и реальные показатели.
3703
Understudy: ваш личный робот-помощник, который учится, глядя на экран
Полный обзор Understudy — десктопного агента с открытым исходным кодом, который обучается по демонстрациям. Работает локально, без облаков.
3704
OmniCoder-9B: детальный обзор новой модели-агента для программирования от Tesslate
Детальный обзор OmniCoder-9B от Tesslate: 9B параметров, контекст 262K, восстановление после ошибок. Сравнение с Claude Code и Qwen Coder Next, примеры использо
3705
Тепловое троттлинг на MacBook M5 Max: сравнение 14” и 16” для непрерывного вывода 72B моделей
Реальные тесты теплового троттлинга на MacBook M5 Max 14” и 16” при непрерывном выводе Qwen 2.5 72B. Сравнение температуры, скорости генерации и практические ре
3706
GATED_DELTA_NET в llama.cpp: как новая опция Vulkan разгоняет Qwen до 30%
Обзор новой функции GATED_DELTA_NET в llama.cpp для Vulkan. Установка, бенчмарки и прирост скорости до 30% для моделей Qwen на видеокартах AMD. Актуально на мар
3707
Архитектура AI-фабрики: как собрать команду из 9 агентов на open-source моделях с одной видеокартой — конфиги, модели, бенчмарки
Практический гайд: собираем команду из 9 AI-агентов на open-source моделях с одной RTX 4090. Конкретные модели для каждой роли, настройки VRAM, бенчмарки HumanE
3708
Новые CloudWatch метрики TimeToFirstToken и EstimatedTPMQuotaUsage для Amazon Bedrock: настройка алертов и управление квотами
Обзор новых метрик TimeToFirstToken и EstimatedTPMQuotaUsage в Amazon Bedrock. Как настроить алерты в CloudWatch и избежать троттлинга. Актуально на март 2026.