Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6937 От нуля до жеста: как я научил YOLO понимать язык жестов с нуля Пошаговое руководство по созданию пет-проекта для распознавания американского языка жестов с помощью YOLO. Сбор датасета, разметка, обучение и нюансы. 8 мин чтения 6938 Война за AI-таланты: как переходы топ-специалистов между OpenAI, Anthropic и Thinking Machines меняют индустрию Анализ кадровых войн в AI: почему топ-специалисты уходят из OpenAI в Anthropic и Thinking Machines, и как это меняет индустрию. 5 мин чтения 6939 Как запустить Qwen3-VL-8B на CPU: реальный бенчмарк производительности и ловушка llama.cpp с флагом -ngl 0 Практическое руководство по запуску Qwen3-VL-8B на CPU с реальными тестами производительности на i9-12900k. Разбираем ошибку -ngl 0 и показываем правильный флаг 8 мин чтения 6940 Файн-тюнинг LLM для RAG на практике: реальные кейсы GPT OSS 20B от разработчиков Реальный опыт файн-тюнинга GPT OSS 20B для RAG-систем. Юридические документы, форматирование ответов, сравнение до и после. Практические кейсы от разработчиков. 7 мин чтения 6941 Framework Desktop против RTX 5090: как не прогадать с железом для анализа старого кода на локальных LLM Практическое сравнение Framework Desktop и RTX 5090 для анализа vintage C и ассемблера на локальных LLM. Как выбрать железо под задачу и не переплатить. 7 мин чтения 6942 OptiMind от Microsoft: как превращать текстовые задачи в математические модели Обзор Microsoft OptiMind — исследовательской модели, которая автоматически преобразует текстовые описания задач в формальные математические модели для оптимизац 5 мин чтения 6943 Higgsfield: $1.3 млрд за видео без «AI slop». Кто платит? Как стартап Higgsfield с командой из Snap привлёк $1.3 млрд оценки, создавая AI-видео для маркетологов, и почему это не очередной «AI slop». 4 мин чтения 6944 TranslateGemma: как запустить лёгкие модели перевода от Google на своём ПК Как запустить TranslateGemma на своём ПК. Лёгкие модели перевода от Google (27B/12B/4B), поддержка 55 языков, сравнение с альтернативами. 5 мин чтения 6945 Nemotron-3-nano:30b — тёмная лошадка, которая обгоняет гигантов. Тесты, сравнение и быстрый запуск Практический обзор Nemotron-3-nano:30b. Сравнение с Llama 3.3:70b по скорости и качеству. Инструкция по запуску в Ollama и LM Studio. 5 мин чтения 6946 Agent Skills на Python: почему файловая система умнее любой оркестрации Как заменить сложную оркестрацию агентов простой файловой системой. Реализация на 100 строк кода, SKILL.md и прогрессивное раскрытие навыков. 10 мин чтения 6947 Open Responses: новый стандарт для агентов против устаревшего Chat Completion OpenAI и Hugging Face представили Open Responses — открытый стандарт для AI-агентов, который заменит устаревший Chat Completion API. Разбираем детали. 4 мин чтения 6948 Modelgrep: как найти дешёвые и быстрые OSS-модели у хостинг-провайдеров Обзор Modelgrep - инструмента для поиска самых дешёвых и быстрых open-source моделей у хостинг-провайдеров через OpenRouter. Сравнение провайдеров, квантований 5 мин чтения