Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2077 Суд Musk vs Altman: первая неделя процесса и последствия для OpenAI Первая неделя судебного процесса Илона Маска против Сэма Альтмана. Что происходит в зале суда, какие обвинения выдвигаются и как это повлияет на будущее OpenAI. 5 мин чтения 2078 VibeVoice.cpp: Microsoft VibeVoice на стероидах — локальный speech-to-speech без Python и облаков Запускаем VibeVoice.cpp — порт Microsoft VibeVoice на ggml/C++ с поддержкой CPU, CUDA, Metal, Vulkan. Без Python, с квантованием и voice cloning. Сравнение с ал 1 мин чтения 2079 Внедрение ИИ-агентов в команду: pull-модель для тимлидов (гайд без бунта) Как внедрить ИИ-агентов без бунта команды. Pull-модель: пошаговый план, антипаттерны, инфраструктура. Для тимлидов, которые хотят, чтобы разработчики сами тянул 6 мин чтения 2080 Почему промпт-инъекции нельзя починить: архитектурные пределы безопасности LLM-агентов Глубокий разбор фундаментальной уязвимости LLM-агентов: почему модель не отличает инструкции от данных, и как это делает любую защиту паллиативом. Практические 5 мин чтения 2081 MTPLX: ускорение инференса на Apple Silicon в 2.24 раза — обзор нового MTP-движка Разбор MTPLX — нативного MTP-движка для Apple Silicon, который ускоряет инференс в 2.24 раза. Бенчмарки, сравнение с llama.cpp и mlx-lm, примеры запуска на M5 M 5 мин чтения 2082 FastDMS: как сжать KV-cache в 6 раз и ускорить инференс — обзор открытой реализации и бенчмарков Разбор открытой реализации Dynamic Memory Sparsification (FastDMS): сжатие KV-cache в 6 раз, ускорение инференса на 30% против vLLM. Примеры, бенчмарки, сравнен 3 мин чтения 2083 Как использовать Webhooks в Gemini API: пример на Python и настройка Полный гайд по настройке webhooks в Gemini API. Пример кода на Python, верификация подписей, идемпотентность, сравнение с polling. Работает с Gemini 3. 6 мин чтения 2084 V100 32GB vs RTX 5060 Ti/5070 Ti: реальный опыт сборки homelab AI на старом железе Сравниваем Tesla V100 32GB и RTX 5060 Ti/5070 Ti для домашнего AI: цена, VRAM, производительность, нюансы сборки и реальные бенчмарки LLM. 8 мин чтения 2085 LLM-пентест 2026: OWASP Top 10, новые атаки и практический playbook Разбор OWASP LLM Top 10 2025: System Prompt Leakage, Vector Weaknesses, RAG-poisoning. Готовый playbook для тестирования безопасности LLM с примерами атак и защ 10 мин чтения 2086 Пять механизмов памяти Claude Code: как управлять контекстом и не терять данные Полный разбор пяти механизмов памяти Claude Code: CLAUDE.md, ~/.claude/memory/, команды /memory, сжатие контекста, внешние файлы. Как не потерять данные в длите 9 мин чтения 2087 Как построить эффективную базу знаний для AI-моделей: пошаговое руководство с примерами 6 шагов к идеальной базе знаний для RAG: от сбора данных до мониторинга. Примеры, код, типичные ошибки. Актуально на 2026 год. 7 мин чтения 2088 APEX MoE квантизация: 30+ моделей с ускорением до 33% и новый ультра-сжатый I-Nano уровень Обзор APEX — MoE-aware mixed-precision квантизация. Ускорение до 33%, поддержка 30+ моделей, ультра-сжатый уровень I-Nano. Сравнение с аналогами, тесты скорости 6 мин чтения