Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6877 GGUF-файлы на Hugging Face: как не скачать троян вместо модели Подробный гайд по проверке GGUF-файлов на Hugging Face. Как отличить безопасные модели от опасных, какие организации доверять, как сканировать файлы и избегать 6 мин чтения 6878 Золотая лихорадка ИИ в медицине: риски галлюцинаций и утечек данных в новых продуктах Инвестиции в медицинские ИИ бьют рекорды, но галлюцинации LLM и уязвимости безопасности ставят под угрозу пациентов. Разбираем реальные риски за хайпом. 4 мин чтения 6879 Бенчмарки производительности llama.cpp на 72 ГБ VRAM: сравнение 20+ моделей в январе 2026 Практическое сравнение производительности 20+ LLM моделей на llama.cpp с 72 ГБ VRAM. Таблицы скорости генерации, рекомендации по выбору модели. 6 мин чтения 6880 Piemme: Ваши промпты теперь под контролем версий. Наконец-то. Обзор Piemme — инструмента на Rust для версионирования, композиции и динамического выполнения промптов. Сравнение с аналогами и примеры использования. 6 мин чтения 6881 GigaChat 3 Lightning: как запустить и использовать open source MoE-модель от Сбера на Colab Пошаговый гайд по запуску GigaChat 3 Lightning на Google Colab с квантованием. Русскоязычная MoE-модель от Сбера на бесплатном железе. 7 мин чтения 6882 Cursor против Warp против Claude Code: как я потратил $200 и нашел идеальный AI-стек Личный опыт тестирования AI-инструментов для программирования. Настройка Cursor, Warp и Claude Code для максимальной продуктивности. Таблица сравнения, промпты 8 мин чтения 6883 Спам-детектор, который не шпионит: как запустить и переучить 500-мегабайтную модель локально Пошаговый гайд по запуску 500 МБ модели для фильтрации спама на своем сервере и ее дообучению под свои данные с помощью Artifex. 7 мин чтения 6884 vLLM-MLX: настройка нативного LLM-инференса на Apple Silicon с производительностью до 464 ток/с Полный обзор vLLM-MLX: настройка локального LLM-сервера на Apple Silicon с OpenAI API. Сравнение производительности, установка, примеры использования. 5 мин чтения 6885 Speech-to-Speech конверсия голоса: лучшие open-source инструменты для анонимизации с сохранением интонации RVC, So-VITS-SVC и другие open-source решения для speech-to-speech конверсии голоса. Сохраняйте интонацию, меняйте голос, работайте локально. 6 мин чтения 6886 Гипер-связи DeepSeek: воспроизведение нестабильности, взрыв градиентов и как это фиксируют Глубокий разбор гипер-связей DeepSeek: воспроизводим нестабильность обучения, анализируем взрыв градиентов и показываем фиксы через Sinkhorn проекцию и AdamW. 9 мин чтения 6887 Как запустить 20B-параметровую модель на 6 ГБ VRAM в браузере: обзор Open WebUI и локальных альтернатив Пошаговый гайд по запуску 20B-параметровой модели в браузере на 6 ГБ VRAM. Сравнение Open WebUI, Ollama WebUI и других локальных решений. 6 мин чтения 6888 7 видеокарт на AM5 для LLM: PCIe-коммутаторы, P2P-драйвер и тесты, которые вас удивят Подробный гайд по сборке системы с 7 видеокартами на платформе AM5 для работы с LLM. PCIe-коммутаторы, установка P2P-драйвера NVIDIA, реальные тесты производите 8 мин чтения