Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
673
Открытые веса vs проприетарные модели: геополитика, дистилляция и железо NVIDIA
Дженсен Хуан спровоцировал раскол в AI-индустрии открытым письмом против запрета open-weight моделей. Разбираем техническую несостоятельность запрета дистилляци
674
Проблемы интеграции ЦОД в энергосеть: вызовы и решения для AI-инфраструктуры
Разбираем инцидент в Северной Виргинии: отключение ЦОД мощностью 3 ГВт вызвало скачок напряжения в сети PJM. Как аккумуляторные системы сглаживают профиль нагру
675
Почему Ollama с Qwen3.6:35b случайно останавливает генерацию и как это исправить
Разбираем, почему Qwen3.6:35b в Ollama случайно прерывает вывод токенов на RTX 4070. Анализ OLLAMA_CONTEXT_LENGTH, KV-кэша и проверенные способы стабилизации.
676
ASUS GX10: Хроника отказа и уроки для владельцев AI-станций
Реальный случай выхода из строя ASUS GX10 при запуске LLM: повреждение NVMe, баги драйверов, отказ загрузки. Инструкция по RMA, советы по мониторингу и бэкапу д
677
Дешёвые и надёжные API для open-source моделей в 2026: сравниваем провайдеров DeepSeek, GLM и других
Сравнили 5 API-провайдеров для DeepSeek и GLM по цене токенов, uptime и скорости генерации. Таблицы с реальными цифрами, тесты консистентности и готовый код для
678
Экономика векторного поиска: когда RAM становится роскошью — HNSW, SPANN и DiskANN в 2026
100 млн векторов в float32 обходятся в ~$6000/мес на RAM, а 1 млрд — уже в $60,000. Сравниваем HNSW, SPANN и DiskANN: архитектура, стоимость, latency и дерево р
679
Гибридная сборка для LLM: RTX 3090 + AMD Radeon — стоит ли игра свеч в 2026 году?
Практический тест гибридной сборки Nvidia RTX 3090 и AMD Radeon 9070 для локального запуска LLM в 2026 году. Замеряем скорость генерации, стабильность и сравнив
680
Ограничения локального AI-воркспейса на 4 ГБ VRAM: реальные бенчмарки Qwen на RTX 3050 Ti
Реальные бенчмарки Qwen на ноутбучной RTX 3050 Ti с 4 ГБ VRAM: 96 ток/с на 2B-модели, обвал до 3 ток/с на 9B и три критических узких места, которые ставят крест
681
Как отключить AI в повседневных сервисах: полный гайд и почему это становится трендом
Пошаговые инструкции по отключению AI-функций на iPhone, Android, Windows и в сервисах Google. Разбираем триггеры сопротивления: от навязчивости до судебных иск
682
GLM 5.2 с Vision на 8x NVIDIA GB10: первые тесты и реальная производительность
Реальные тесты GLM 5.2 Vision на 8× NVIDIA GB10: 33-54 токенов/с на тексте, задержка 200-400 мс на изображениях. Цифры, конфиги запуска и честный разбор огранич
683
Slipstream: как запустить MoE-модели до 480B на MacBook с 36 ГБ RAM, стримя экспертов с SSD
Slipstream — форк llama.cpp для стриминга экспертов MoE-моделей с SSD. Запустите Qwen3.6-35B-A3B (13 ток/с) и Laguna 118B-A8B на MacBook с 36 ГБ RAM. Разбор про
684
Anthropic: Инсайты технического специалиста о внутренних дебатах и будущем AI-безопасности
Разбор внутренних дебатов Anthropic по AI-безопасности: аргументы инженеров о темпах разработки, открытых весах и alignment-подходах. Как эти дискуссии влияют н