Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7717 Propagate: когда backpropagation устарел, а эволюция - новый king Обзор Propagate - инструмента для обучения языковых моделей без обратного распространения. Эволюционные стратегии, ускорение тренировки, сравнение с LoRA и GRPO 6 мин чтения 7718 Qwen3-VL-8B или конкурент: какой VLM возьмет ваши мультиязычные документы в 2025? Тест производительности Qwen3-VL-8B против LLaVA, InternVL, CogVLM на реальных документах. Какая модель быстрее и точнее для таблиц, счетов, контрактов на англи 11 мин чтения 7719 Как исправить ошибку 'Unable to find path' при запуске Kokoro TTS на Windows: полное руководство Пошаговое решение ошибки 'Unable to find path' при запуске Kokoro TTS на Windows. Установка, настройка Python, исправление run_gradio.bat. 7 мин чтения 7720 HyperNova-60B: когда можно решать сложные задачи, но не хочется платить за все 120 миллиардов параметров Практичный обзор HyperNova-60B: MoE-архитектура, MXFP4 квантование, настройка reasoning усилителя и экономия VRAM. Для кого подойдет эта модель? 8 мин чтения 7721 LLM-галлюцинации: Как заставить нейросеть говорить правду (или хотя бы не врать так очевидно) Практическое руководство по стабилизации работы LLM. Сравнение детерминированных подходов, промпт-инжиниринга, валидации ответов. Техники для предсказуемого ИИ. 8 мин чтения 7722 Когда одного блока не хватает: как запитывать GPU от второго БП без взрыва Пошаговый гайд по безопасному подключению второго БП для питания GPU в LLM-сборке. Схемы, ошибки, инструменты. 7 мин чтения 7723 GLM-4.7-REAP-40p IQ3_S на RTX 6000: хватит ли 48 ГБ для SWE-Bench? Запускаем GLM-4.7-REAP-40p с квантованием IQ3_S на RTX 6000, тестируем на реальных задачах SWE-Bench. Полный код, результаты, сравнение с альтернативами. 7 мин чтения 7724 Flow Protocol: как развернуть децентрализованную сеть для нецензурируемого AI-инференса на своём GPU Как запустить Flow Protocol на своей видеокарте. Настройка децентрализованной P2P сети для нецензурируемого AI-инференса и майнинга. Полный гайд. 7 мин чтения 7725 Полное руководство по тонкой настройке LLM: от сбора данных до запуска модели Подробное руководство по тонкой настройке LLM: сбор данных, подготовка, обучение с LoRA, оценка и запуск. Практические советы и примеры кода. 7 мин чтения 7726 Models Explorer: как найти open-source альтернативу любой AI-модели за 30 секунд Обзор инструмента Models Explorer для поиска open-weight альтернатив, сравнения моделей и расчета стоимости токенов. 7 мин чтения 7727 GLM-4.7 с Claude-совместимым API: как сэкономить $1000 в месяц на агентах Пошаговый гайд по развертыванию GLM-4.7 с Claude-совместимым API для агентов, тестирования и внутренних инструментов. Экономия до 1000$ в месяц. 11 мин чтения 7728 Когда 512k токенов — это не хвастовство, а боль: как правильно бенчмаркать длинные контексты LLM Полное руководство по тестированию LLM с длинным контекстом. lm-eval, Runer-QA-Hotpot, стресс-тесты, анализ деградации качества — всё, что нужно для честного бе 8 мин чтения