Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7501 Архитектура State-of-the-Art Research Agent: философия и технические уроки от Tavily Глубокий разбор архитектуры продвинутых ИИ-агентов для исследований. Философия agent harness, управление контекстом, устойчивость к обновлениям моделей. Техниче 9 мин чтения 7502 RTEB: новый бенчмарк для оценки эмбеддинг-моделей — почему старые метрики врут RTEB — новый стандарт оценки эмбеддинг-моделей. Разбираем, почему старые бенчмарки врут о качестве поиска в RAG-системах и как избежать ошибок в продакшене. 7 мин чтения 7503 На 70% дешевле: как Google Cloud C4 на Intel Xeon 6 ускоряет GPT OSS и снижает TCO Google Cloud C4 на Intel Xeon 6 ускоряет GPT OSS в 1.4-1.7 раз и снижает TCO на 70%. Как работает оптимизация MoE и стоит ли переходить с GPU. 5 мин чтения 7504 Голосовой шлагбаум: как поставить заслон на пути deepfake без запретов Практическое решение для этичного клонирования голоса: демо на Hugging Face, код и архитектура системы подтверждения согласия. 6 мин чтения 7505 AprielGuard: Наконец-то сторож для LLM-агентов, который не спит на посту Обзор модели-сторожа AprielGuard от ServiceNow. Как защитить сложных LLM-агентов от промпт-инъекций, джейлбрейков и манипуляций инструментами. Архитектура, такс 8 мин чтения 7506 huggingface_hub v1.0: что сломалось, что работает и как не сойти с ума при обновлении Полный гайд по переходу на huggingface_hub v1.0: обновление библиотеки, переход на httpx-бэкенд, использование нового CLI на Typer. Все изменения и обратная сов 7 мин чтения 7507 Китайские AI-чипы: Huawei Ascend и Cambricon против NVIDIA. Что реально работает у разработчиков? Анализ китайских AI-чипов Huawei Ascend и Cambricon для разработчиков. Тесты производительности, совместимость с фреймворками, сравнение с NVIDIA и практические 5 мин чтения 7508 NousCoder-14B-GGUF: Qwen3 на стероидах, который решает 7 из 10 задач с первого раза Обзор NousCoder-14B-GGUF: как Qwen3 14B после RL-дообучения на 24k задач выдает 67.87% Pass@1. Сравнение с альтернативами, тесты и рекомендации. 6 мин чтения 7509 Routed GQA (R-GQA): как реализовать маршрутизированное внимание для ускорения обучения на 40% Пошаговый гайд по реализации Routed GQA (R-GQA) для ускорения обучения языковых моделей на 40%. Объяснение механизма, преимущества и нюансы. 6 мин чтения 7510 CUGA: конфигурируемый агент для веб и API задач - обзор и запуск в Hugging Face Spaces Обзор CUGA - конфигурируемого агента с открытым кодом для веб и API задач. Запуск демо в Hugging Face Spaces, сравнение с альтернативами и примеры использования 5 мин чтения 7511 Visual Haystacks: как найти иголку в стоге визуальных данных Как работает Visual Haystacks — новый бенчмарк для тестирования способности мультимодальных моделей анализировать коллекции изображений. Needle-In-A-Haystack по 8 мин чтения 7512 Anthology: когда виртуальным личностям нужна настоящая биография Обзор Anthology — инструмента для генерации консистентных виртуальных персонажей с полными backstories для исследований в социальных науках и тестирования LLM. 5 мин чтения