Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4371 материалов
01 CachyLLama: форк llama.cpp с SSD-кешированием KV для мгновенной обработки промптов в агентных пайплайнах CachyLLama — форк llama.cpp, который устраняет узкое место повторной оценки промптов в локальных агентах. Бенчмарки на AMD Ryzen 7840U: ускорение с 9,3 с до 0,4 6 мин чтения 02 Почему критика «джеилбрейков» Pliny the Liberator важна для сообщества OSS-моделей: разбор эксперта по безопасности Эксперт по кибербезопасности из hyperscaler разбирает методы Pliny the Liberator: контекстное выравнивание и альтернативные шрифты. Узнайте, почему это не джейл 5 мин чтения 03 hwatu: новый инструмент для верификации локальных AI-агентов с headless WebKit и pixel-diff Разбор hwatu — открытого инструмента на Rust для тестирования браузерных AI-агентов. Headless WebKit, pixel-diff с точным процентом совпадения, сравнение с Play 7 мин чтения 04 Открытые веса vs проприетарные модели: геополитика, дистилляция и железо NVIDIA Дженсен Хуан спровоцировал раскол в AI-индустрии открытым письмом против запрета open-weight моделей. Разбираем техническую несостоятельность запрета дистилляци 10 мин чтения 05 Проблемы интеграции ЦОД в энергосеть: вызовы и решения для AI-инфраструктуры Разбираем инцидент в Северной Виргинии: отключение ЦОД мощностью 3 ГВт вызвало скачок напряжения в сети PJM. Как аккумуляторные системы сглаживают профиль нагру 7 мин чтения 06 Почему Ollama с Qwen3.6:35b случайно останавливает генерацию и как это исправить Разбираем, почему Qwen3.6:35b в Ollama случайно прерывает вывод токенов на RTX 4070. Анализ OLLAMA_CONTEXT_LENGTH, KV-кэша и проверенные способы стабилизации. 7 мин чтения 07 ASUS GX10: Хроника отказа и уроки для владельцев AI-станций Реальный случай выхода из строя ASUS GX10 при запуске LLM: повреждение NVMe, баги драйверов, отказ загрузки. Инструкция по RMA, советы по мониторингу и бэкапу д 7 мин чтения 08 Дешёвые и надёжные API для open-source моделей в 2026: сравниваем провайдеров DeepSeek, GLM и других Сравнили 5 API-провайдеров для DeepSeek и GLM по цене токенов, uptime и скорости генерации. Таблицы с реальными цифрами, тесты консистентности и готовый код для 10 мин чтения 09 Экономика векторного поиска: когда RAM становится роскошью — HNSW, SPANN и DiskANN в 2026 100 млн векторов в float32 обходятся в ~$6000/мес на RAM, а 1 млрд — уже в $60,000. Сравниваем HNSW, SPANN и DiskANN: архитектура, стоимость, latency и дерево р 9 мин чтения 10 Гибридная сборка для LLM: RTX 3090 + AMD Radeon — стоит ли игра свеч в 2026 году? Практический тест гибридной сборки Nvidia RTX 3090 и AMD Radeon 9070 для локального запуска LLM в 2026 году. Замеряем скорость генерации, стабильность и сравнив 7 мин чтения 11 Ограничения локального AI-воркспейса на 4 ГБ VRAM: реальные бенчмарки Qwen на RTX 3050 Ti Реальные бенчмарки Qwen на ноутбучной RTX 3050 Ti с 4 ГБ VRAM: 96 ток/с на 2B-модели, обвал до 3 ток/с на 9B и три критических узких места, которые ставят крест 8 мин чтения 12 Как отключить AI в повседневных сервисах: полный гайд и почему это становится трендом Пошаговые инструкции по отключению AI-функций на iPhone, Android, Windows и в сервисах Google. Разбираем триггеры сопротивления: от навязчивости до судебных иск 11 мин чтения