Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4957
P1-235B-A22B: как открытая модель победила на физической олимпиаде и где скачать веса
Как открытая модель P1-235B-A22B от Shanghai AI Laboratory получила золото на IPhO 2026. Скачать веса на HuggingFace, возможности и примеры использования Physic
4958
Эволюция ИИ в лаборатории: как 200 нейросетей выработали иммунитет к вирусу и разучились думать
Лабораторный эксперимент с 200 версиями microGPT показал: защита от вируса делает нейросети глупее. Фундаментальный компромисс в обучении ИИ.
4959
Как оживить ролевые игры с ИИ: метод рандомизации системных промптов
Практический метод рандомизации системных промптов для создания живых NPC в ролевых играх с ИИ. Решение проблемы картонности персонажей.
4960
AdaLLM: Полное руководство по запуску NVFP4-моделей на RTX 4090 с FP8 KV-кэшем и кастомным ядром
Подробное руководство по установке и использованию AdaLLM для запуска квантованных моделей на RTX 4090 с оптимизациями FP8 KV-кэша и кастомным ядром Triton.
4961
Генеративный ИИ-бот для заказов: как сделать, чтобы он не разговаривал, а работал
Пошаговое создание AI-бота для бизнеса на Python с конфигурируемым скриптом, интеграцией с GPT-4.5 Turbo и автоматизацией продаж.
4962
Безопасность ИИ под угрозой: почему инженеры массово уходят из xAI и что происходит с Grok
Массовый исход специалистов из компании Илона Маска из-за конфликта по безопасности ИИ. Почему Grok-3 становится опасным и какие риски это несет.
4963
Секретный учебник от сооснователя OpenAI: как GPT работает на 200 строчках чистого Python
Полный разбор образовательного проекта Андрея Карпаты - microgpt на 200 строках Python. Изучите архитектуру GPT, механизм внимания и обучение без фреймворков.
4964
JSON-парсер в llama.cpp сломал Qwen3 Next Coder? Вот как это чинить в 2026 году
Пошаговое руководство по исправлению ошибок парсера JSON при запуске Qwen3 Next Coder с OpenCode в llama.cpp. Актуальное решение на февраль 2026 года.
4965
SnapLLM: Как мгновенно переключаться между локальными LLM и SD моделями без перезагрузки
Обзор SnapLLM — инструмента для мгновенного переключения между локальными LLM и Stable Diffusion моделями без перезагрузки. Архитектура vPID, три уровня памяти,
4966
EdgeDox и MNN: как запустить полноценный RAG с LLM офлайн на Android
Обзор EdgeDox — приложения для запуска RAG с локальной LLM на Android с использованием движка MNN. Приватность, офлайн работа, квантованные модели.
4967
Seedance 2.0 против Голливуда: как новый AI-видеогенератор ByteDance вызвал скандал из-за авторских прав
ByteDance выпустил Seedance 2.0 — AI-видеогенератор, который создал скандал в Голливуде из-за авторских прав. Подробности конфликта и последствия для индустрии.
4968
Qwen3-TTS.cpp: ускорение TTS в 4 раза на CPU и Apple Silicon
Обзор Qwen3-TTS.cpp: ускорение TTS в 4 раза, поддержка Metal/CoreML, голосовой клон. Локальный синтез речи без облаков для разработчиков.