Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
277
DeepSeek V4 Flash 284B на одной RTX PRO 6000: как размещение драфтера в RAM ускоряет генерацию на 15–17%
Бенчмарк DeepSeek V4 Flash 284B на одной RTX PRO 6000 96GB: перенос драфтера DSpark в RAM дал +4.4% к скорости, итоговый прирост 15–17% с 3 спекулятивными токен
278
ChatGPT для Linux: официальное приложение — установка, возможности и сравнение с Claude
OpenAI выпустила официальное приложение ChatGPT для Linux с поддержкой Ubuntu, Debian и Fedora. Пошаговая установка, разбор Codex и ChatGPT Work, сравнение с Cl
279
Как проверить автономность флота ИИ-агентов: инварианты, метрики и разрыв между декларацией и реальностью
Система ИИ-агентов заявляла полную автономность, но формальная проверка через четыре инварианта показала: только 7.7% транзакций соответствуют собственному прот
280
v100-skinny: как запустить Qwen3.6 27B на старых V100 с NVFP4 и получить до 366 токенов/с
Проект v100-skinny запускает Qwen3.6 27B с NVFP4-квантованием на устаревших V100 со скоростью до 366 токенов/с. Разбираем CUDA-ядра, бенчмарки на JSON и кодоген
281
Почему больше инструментов не значит лучше: как monday.com перестроил архитектуру своего AI-ассистента Sidekick
Инженерный кейс monday.com: как рост числа инструментов разрушает работу AI-ассистента в production, и почему модульная архитектура с оркестратором, субагентами
282
Сравнительный локальный бенчмарк Muse Glimmer 30B, Qwen 3.6 27B и Gemma4 31B: эффективность и запросы
Независимый тест моделей 27B–31B: Muse Glimmer 30B догоняет конкурентов по качеству, но требует в 2-3 раза больше запросов. Детальные метрики и выводы для практ
283
Daybreak Red и Daybreak Blue на Amazon Bedrock: как AWS и OpenAI усиливают киберзащиту с помощью специализированных моделей
AWS и OpenAI запустили Daybreak Red (GPT-5.6 Cyber) и Daybreak Blue (GPT-5.6 Sol) на Amazon Bedrock. Разбираем контекстную архитектуру безопасности, сценарии дл
284
Квантование DeepSeek V4 0731: скрытые баги конвертера, честный бенчмарк и хаос в названиях на Hugging Face
Команда AtomicChat нашла критические ошибки в конвертере DeepSeek V4 0731: NaN в эмбеддингах и искажение FP8→Q8_0. Исправленная модель и тест 38 квантов на 8×RT
285
Многоузловые конфигурации Spark Cluster для LLM: опыт сообщества r/LocalLLaMA
Разбор уникального кейса: участник r/LocalLLaMA продаёт четырёхузловой Spark-кластер с недокументированными конфигурациями супернод для оптимизации LLM-фреймвор
286
Практическое тестирование CMP170HX: 256 ГБ VRAM за $200 — реальность или лотерея?
Четыре CMP170HX по 64 ГБ дают 256 ГБ VRAM за $800. Тестируем в llama.cpp: до 120 t/s на 20B моделях, контекст 1M для DeepSeek V4-Flash. Разбираем узкие места, с
287
Accel закрывает фонд $550M для Индии: ставка на ИИ и новые горизонты венчурного рынка
Accel закрыла фонд для Индии на $550 млн, несмотря на неиспользованные резервы предыдущего. Разбираем стратегию: почему ИИ стал горизонтальной технологией, каки
288
Могут ли LLM распознавать свои галлюцинации через анализ logprobs? Эксперимент с Gemma и Qwen
Экспериментальная проверка гипотезы: можно ли отловить галлюцинации LLM через анализ logprobs в момент первого появления факта? Тесты Gemma и Qwen показали AUC