Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2077
Суд Musk vs Altman: первая неделя процесса и последствия для OpenAI
Первая неделя судебного процесса Илона Маска против Сэма Альтмана. Что происходит в зале суда, какие обвинения выдвигаются и как это повлияет на будущее OpenAI.
2078
VibeVoice.cpp: Microsoft VibeVoice на стероидах — локальный speech-to-speech без Python и облаков
Запускаем VibeVoice.cpp — порт Microsoft VibeVoice на ggml/C++ с поддержкой CPU, CUDA, Metal, Vulkan. Без Python, с квантованием и voice cloning. Сравнение с ал
2079
Внедрение ИИ-агентов в команду: pull-модель для тимлидов (гайд без бунта)
Как внедрить ИИ-агентов без бунта команды. Pull-модель: пошаговый план, антипаттерны, инфраструктура. Для тимлидов, которые хотят, чтобы разработчики сами тянул
2080
Почему промпт-инъекции нельзя починить: архитектурные пределы безопасности LLM-агентов
Глубокий разбор фундаментальной уязвимости LLM-агентов: почему модель не отличает инструкции от данных, и как это делает любую защиту паллиативом. Практические
2081
MTPLX: ускорение инференса на Apple Silicon в 2.24 раза — обзор нового MTP-движка
Разбор MTPLX — нативного MTP-движка для Apple Silicon, который ускоряет инференс в 2.24 раза. Бенчмарки, сравнение с llama.cpp и mlx-lm, примеры запуска на M5 M
2082
FastDMS: как сжать KV-cache в 6 раз и ускорить инференс — обзор открытой реализации и бенчмарков
Разбор открытой реализации Dynamic Memory Sparsification (FastDMS): сжатие KV-cache в 6 раз, ускорение инференса на 30% против vLLM. Примеры, бенчмарки, сравнен
2083
Как использовать Webhooks в Gemini API: пример на Python и настройка
Полный гайд по настройке webhooks в Gemini API. Пример кода на Python, верификация подписей, идемпотентность, сравнение с polling. Работает с Gemini 3.
2084
V100 32GB vs RTX 5060 Ti/5070 Ti: реальный опыт сборки homelab AI на старом железе
Сравниваем Tesla V100 32GB и RTX 5060 Ti/5070 Ti для домашнего AI: цена, VRAM, производительность, нюансы сборки и реальные бенчмарки LLM.
2085
LLM-пентест 2026: OWASP Top 10, новые атаки и практический playbook
Разбор OWASP LLM Top 10 2025: System Prompt Leakage, Vector Weaknesses, RAG-poisoning. Готовый playbook для тестирования безопасности LLM с примерами атак и защ
2086
Пять механизмов памяти Claude Code: как управлять контекстом и не терять данные
Полный разбор пяти механизмов памяти Claude Code: CLAUDE.md, ~/.claude/memory/, команды /memory, сжатие контекста, внешние файлы. Как не потерять данные в длите
2087
Как построить эффективную базу знаний для AI-моделей: пошаговое руководство с примерами
6 шагов к идеальной базе знаний для RAG: от сбора данных до мониторинга. Примеры, код, типичные ошибки. Актуально на 2026 год.
2088
APEX MoE квантизация: 30+ моделей с ускорением до 33% и новый ультра-сжатый I-Nano уровень
Обзор APEX — MoE-aware mixed-precision квантизация. Ускорение до 33%, поддержка 30+ моделей, ультра-сжатый уровень I-Nano. Сравнение с аналогами, тесты скорости