Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2641 Разоблачение или сплетни? Что на самом деле значат заявления о слабых навыках кода и ML у Сэма Олтмана Заявления о слабых технических навыках Сэма Олтмана взорвали AI-сообщество в 2026 году. Что это - правда или сплетни? Анализ влияния на управление OpenAI. 5 мин чтения 2642 Google AI Edge Eloquent: тестируем офлайн-диктовку на Gemma и сравнение с Wispr Flow Обзор Google AI Edge Eloquent — офлайн-диктовка на Gemma ASR. Сравнение с Wispr Flow по точности, скорости и приватности. 5 мин чтения 2643 Исправление ошибок вызова инструментов в Gemma 4 через llama.cpp: кейс с ChatGPT Практический гайд по отладке и исправлению ошибок вызова инструментов в Gemma 4 при работе с llama.cpp. Разбор кейса с использованием ChatGPT и анализа исходног 6 мин чтения 2644 Исправление утечки памяти в llama.cpp SYCL при использовании двух видеокарт Intel Arc Пошаговое руководство по исправлению утечки системной памяти при работе llama.cpp с SYCL на двух видеокартах Intel Arc. Диагностика, настройка окружения, флаги 7 мин чтения 2645 Project Glasswing: как Mythos нашел 27-летнюю дыру в OpenBSD и почему это только начало AI-модель Claude Mythos в рамках Project Glasswing обнаружила 27-летнюю уязвимость в OpenBSD и тысячи zero-day в браузерах. Как это меняет кибербезопасность? 4 мин чтения 2646 Tensor Parallelism в ik_llama: подробный гайд по ускорению Gemma 4 31B на нескольких GPU Полное руководство по настройке Tensor Parallelism в ik_llama для запуска Gemma 4 31B на нескольких видеокартах. Тесты PPL, сравнение производительности и пошаг 7 мин чтения 2647 Как настроить сервер для обработки 1B+ токенов в день: опыт исследовательской лаборатории с GPT-OSS-120B Практическое руководство по развертыванию высоконагруженного LLM-сервера с GPT-OSS-120B. Конфигурация железа, оптимизация vLLM и обработка миллиарда токенов в с 10 мин чтения 2648 Firmus и Nvidia Vera Rubin: как строят энергоэффективные AI-дата-центры за $5.5 млрд Стартап Firmus привлек $5.5 млрд на строительство дата-центров для чипов Nvidia Vera Rubin. Как Project Southgate решает проблему энергопотребления ИИ. 5 мин чтения 2649 Мифос против уязвимостей: как Anthropic тестирует новую модель для защиты кода Anthropic тестирует Claude Mythos в Project Glasswing, обнаружив тысячи zero-day уязвимостей. Но где детали? 3 мин чтения 2650 Асинхронные под-агенты в Deep Agents: как распараллелить долгие задачи и не сойти с ума Как использовать асинхронные под-агенты в Deep Agents для распараллеливания длинных задач. Stateful агенты, удаленные агенты, гетерогенное развертывание. 6 мин чтения 2651 SpectralQuant: революционный метод квантования LLM, который на 18% лучше TurboQuant — установка и бенчмарки Обзор SpectralQuant — нового метода квантования LLM с открытым кодом. Сравнение с TurboQuant, установка и бенчмарки на 07.04.2026. 4 мин чтения 2652 Как обработать 4700+ инженерных PDF за 45 минут вместо 4 недель: системный дизайн против чистого AI Практический кейс: как комбинация классических методов и AI обрабатывает тысячи инженерных чертежей за минуты, а не недели. Архитектура, код, ошибки. 7 мин чтения