Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4225
Multi-LoRA serving в vLLM 0.15.0: как обслуживать десятки MoE-моделей на одном GPU
Как vLLM 0.15.0 с multi-LoRA serving экономит GPU при запуске десятков fine-tuned MoE-моделей. Сравнение с альтернативами, примеры и настройка.
4226
H-нейроны: как исследователи Tsinghua нашли и изучили нейроны, ответственные за галлюцинации в LLM
Ученые Tsinghua обнаружили H-нейроны, ответственные за галлюцинации в больших языковых моделях. Как это меняет борьбу с вымыслом в AI?
4227
Как Peer Direct решил проблему производительности ускорителей Gaudi в облаке: инженерный кейс
Инженерный кейс: как команда Peer Direct победила узкое место сетевой карты хоста для ускорителей Habana Gaudi 3 в AWS, используя RDMA RoCE v2.
4228
Скандал с кодом агентов: как уязвимость в MiniMax и Kimi привела к утечке 90% исходников
Громкий скандал: промпт-инъекция в агенты MiniMax M2.1 и Kimi K2.5 привела к массовой утечке исходного кода. Детали, последствия и как защитить свои проекты.
4229
Бенчмарк квантований Qwen3.5-35B-A3B: выбор между Q4_K_M и UD-Q4_K_XL для llama.cpp
Сравнение перплексии и скорости квантований Q4_K_M и UD-Q4_K_XL для Qwen3.5-35B-A3B в llama.cpp. Практический гайд для выбора формата на RTX 5080.
4230
Архитектуры 10 open-weight LLM весны 2026: сравнительный анализ и тренды
Экспертный обзор архитектур 10 open-weight LLM весны 2026 на основе анализа Sebastian Raschka. Сравнение моделей, тренды и практические выводы.
4231
Genome AI: как машинное обучение и цифровые двойники революционизируют селекцию скота
Подробный гайд по применению машинного обучения и цифровых двойников для геномной селекции скота. Решение проблем грязных данных, архитектура SaaS-платформы.
4232
Битва ИИ-кодеров: Qwen 3.5, Codex 5.3 и локальные модели на 70 репозиториях — кто выжил?
Результаты тестирования ИИ-моделей для программирования на 70 реальных репозиториях. Сравнение Qwen 3.5, Codex 5.3 и локальных моделей. Кто лучше справляется с
4233
Как обновить llama.cpp для Qwen 3.5: исправление multi-GPU crash и настройка prompt caching
Пошаговый гайд по обновлению llama.cpp, применению патча для исправления краша на нескольких GPU и настройке prompt caching под Qwen 3.5. Актуально на февраль 2
4234
Claude 4.6 Sonnet: почему 'средняя' модель стала угрозой для GPT и Gemini в 2025 году
Разбор феномена Claude 4.6 Sonnet: как модель среднего уровня от Anthropic бросила вызов GPT-5.3 и Gemini 3 в 2025 году. Анализ бенчмарков, стоимости API и аген
4235
Антропический скандал: Anthropic обвиняет Китай в краже моделей, заплатив $1.5 млрд за свое воровство
Anthropic публично обвинила китайские компании в краже Claude 4.5, но сама потратила $1.5 млрд на сомнительные данные. Разбираем лицемерие в AI-индустрии.
4236
GitHub Agentic Workflows: подробный гайд по настройке AI-агентов для автоматизации репозитория
Полное руководство по настройке AI-агентов в GitHub Actions для автоматизации issues, документации и code review. Актуально на 25.02.2026.