Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

673 Открытые веса vs проприетарные модели: геополитика, дистилляция и железо NVIDIA Дженсен Хуан спровоцировал раскол в AI-индустрии открытым письмом против запрета open-weight моделей. Разбираем техническую несостоятельность запрета дистилляци 10 мин чтения 674 Проблемы интеграции ЦОД в энергосеть: вызовы и решения для AI-инфраструктуры Разбираем инцидент в Северной Виргинии: отключение ЦОД мощностью 3 ГВт вызвало скачок напряжения в сети PJM. Как аккумуляторные системы сглаживают профиль нагру 7 мин чтения 675 Почему Ollama с Qwen3.6:35b случайно останавливает генерацию и как это исправить Разбираем, почему Qwen3.6:35b в Ollama случайно прерывает вывод токенов на RTX 4070. Анализ OLLAMA_CONTEXT_LENGTH, KV-кэша и проверенные способы стабилизации. 7 мин чтения 676 ASUS GX10: Хроника отказа и уроки для владельцев AI-станций Реальный случай выхода из строя ASUS GX10 при запуске LLM: повреждение NVMe, баги драйверов, отказ загрузки. Инструкция по RMA, советы по мониторингу и бэкапу д 7 мин чтения 677 Дешёвые и надёжные API для open-source моделей в 2026: сравниваем провайдеров DeepSeek, GLM и других Сравнили 5 API-провайдеров для DeepSeek и GLM по цене токенов, uptime и скорости генерации. Таблицы с реальными цифрами, тесты консистентности и готовый код для 10 мин чтения 678 Экономика векторного поиска: когда RAM становится роскошью — HNSW, SPANN и DiskANN в 2026 100 млн векторов в float32 обходятся в ~$6000/мес на RAM, а 1 млрд — уже в $60,000. Сравниваем HNSW, SPANN и DiskANN: архитектура, стоимость, latency и дерево р 9 мин чтения 679 Гибридная сборка для LLM: RTX 3090 + AMD Radeon — стоит ли игра свеч в 2026 году? Практический тест гибридной сборки Nvidia RTX 3090 и AMD Radeon 9070 для локального запуска LLM в 2026 году. Замеряем скорость генерации, стабильность и сравнив 7 мин чтения 680 Ограничения локального AI-воркспейса на 4 ГБ VRAM: реальные бенчмарки Qwen на RTX 3050 Ti Реальные бенчмарки Qwen на ноутбучной RTX 3050 Ti с 4 ГБ VRAM: 96 ток/с на 2B-модели, обвал до 3 ток/с на 9B и три критических узких места, которые ставят крест 8 мин чтения 681 Как отключить AI в повседневных сервисах: полный гайд и почему это становится трендом Пошаговые инструкции по отключению AI-функций на iPhone, Android, Windows и в сервисах Google. Разбираем триггеры сопротивления: от навязчивости до судебных иск 11 мин чтения 682 GLM 5.2 с Vision на 8x NVIDIA GB10: первые тесты и реальная производительность Реальные тесты GLM 5.2 Vision на 8× NVIDIA GB10: 33-54 токенов/с на тексте, задержка 200-400 мс на изображениях. Цифры, конфиги запуска и честный разбор огранич 11 мин чтения 683 Slipstream: как запустить MoE-модели до 480B на MacBook с 36 ГБ RAM, стримя экспертов с SSD Slipstream — форк llama.cpp для стриминга экспертов MoE-моделей с SSD. Запустите Qwen3.6-35B-A3B (13 ток/с) и Laguna 118B-A8B на MacBook с 36 ГБ RAM. Разбор про 9 мин чтения 684 Anthropic: Инсайты технического специалиста о внутренних дебатах и будущем AI-безопасности Разбор внутренних дебатов Anthropic по AI-безопасности: аргументы инженеров о темпах разработки, открытых весах и alignment-подходах. Как эти дискуссии влияют н 9 мин чтения