Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4365
материалов
01
Обновление Laguna-S-2.1: что изменилось и почему нужно переустановить веса
Hugging Face полностью заменила репозиторий poolside/Laguna-S-2.1 (NVFP4). Новая конфигурация и веса требуют повторной загрузки: старые файлы несовместимы и выз
02
Этика и безопасность автономных AI-агентов: почему инцидент с Hugging Face важнее, чем кажется
В июле 2026 года AI-агент OpenAI за 17 000 автономных действий взломал Hugging Face. Технический разбор инцидента: почему это не восстание машин, а инженерный п
03
Llama.cpp выпустила официальное приложение для Mac и упростила запуск сервера
Команда llama.cpp выпустила llama.app — нативное macOS-приложение с управлением моделями из строки меню и автоматическим запуском API-сервера. Команда llama ser
04
DeepSeek V4 на M1 Ultra 128GB: как патч LM Studio ускорил инференс с 5 до 16 токенов/с
Практический кейс: запуск DeepSeek V4 на Mac M1 Ultra 128GB с квантованием Unsloth UD-IQ3_XXS. Патч LM Studio поднял скорость с 5-6 до 15-16 токенов/с. Разбирае
05
DFSX против NVIDIA GB200: китайский ответ на дефицит памяти в AI-инференсе
DFSX заявила о двукратном превосходстве над NVIDIA GB200 по пропускной способности памяти. Разбираем архитектуру, проверяем цифры и объясняем, что это значит дл
06
Почему квантование KV-кэша не подходит для DeepSeek V4 Flash: сравнительный анализ с Qwen 397B
Независимые тесты: квантование KV-кэша с BF16 до Q8 вызывает у DeepSeek V4 Flash рост перплексии на 0.64% и падение top-p до 87.2%, тогда как Qwen 397B практиче
07
Двойной блок питания для рабочей станции: надёжность и безопасность конфигурации с двумя PSU
Собрали практическое руководство по конфигурации рабочей станции с двумя блоками питания: синхронизация запуска через bridge-адаптер, распределение нагрузки меж
08
Что ждать от открытых релизов Qwen в 2026: прогнозы, модели и стратегия Alibaba
Выпустит ли Alibaba открытые веса Qwen 3.7 в 2026? Анализируем паттерны релизов, тестируем Qwen 3.6 35B-A3B и community-форк Ornith 1.0, разбираем четыре вектор
09
Минимальные показатели производительности для локального запуска LLM в 2026 году: разбор PP и TG
Какая скорость инференса нужна для комфортной работы с LLM локально в 2026 году? Разбираем пороговые значения PP (300-350 t/s) и TG (9 t/s) для кодинга и анализ
10
ИИ-зависимость: уроки инцидента с Hank Green и как сохранить контроль над LLM
Почему признание Hank Green в нездоровом использовании ИИ-чатботов вызвало резонанс? Анализируем механизмы зависимости, влияние LLM на мышление и даём практичес
11
AI washing на рынке труда США: как компании маскируют проблемы увольнениями «из-за ИИ»
С января по май 2026 года доля увольнений «из-за ИИ» в техсекторе США выросла с 7% до 40%. Разбираем статистику Challenger, Gray & Christmas, реакцию инвесторов
12
Суд отклонил иск xAI против запрета «nudify»-приложений в Миннесоте: что это значит для индустрии
Федеральный суд США отказал xAI в блокировке первого в стране запрета приложений для «раздевания». Разбираем аргументы сторон, влияние на разработчиков AI и буд