Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6937
От нуля до жеста: как я научил YOLO понимать язык жестов с нуля
Пошаговое руководство по созданию пет-проекта для распознавания американского языка жестов с помощью YOLO. Сбор датасета, разметка, обучение и нюансы.
6938
Война за AI-таланты: как переходы топ-специалистов между OpenAI, Anthropic и Thinking Machines меняют индустрию
Анализ кадровых войн в AI: почему топ-специалисты уходят из OpenAI в Anthropic и Thinking Machines, и как это меняет индустрию.
6939
Как запустить Qwen3-VL-8B на CPU: реальный бенчмарк производительности и ловушка llama.cpp с флагом -ngl 0
Практическое руководство по запуску Qwen3-VL-8B на CPU с реальными тестами производительности на i9-12900k. Разбираем ошибку -ngl 0 и показываем правильный флаг
6940
Файн-тюнинг LLM для RAG на практике: реальные кейсы GPT OSS 20B от разработчиков
Реальный опыт файн-тюнинга GPT OSS 20B для RAG-систем. Юридические документы, форматирование ответов, сравнение до и после. Практические кейсы от разработчиков.
6941
Framework Desktop против RTX 5090: как не прогадать с железом для анализа старого кода на локальных LLM
Практическое сравнение Framework Desktop и RTX 5090 для анализа vintage C и ассемблера на локальных LLM. Как выбрать железо под задачу и не переплатить.
6942
OptiMind от Microsoft: как превращать текстовые задачи в математические модели
Обзор Microsoft OptiMind — исследовательской модели, которая автоматически преобразует текстовые описания задач в формальные математические модели для оптимизац
6943
Higgsfield: $1.3 млрд за видео без «AI slop». Кто платит?
Как стартап Higgsfield с командой из Snap привлёк $1.3 млрд оценки, создавая AI-видео для маркетологов, и почему это не очередной «AI slop».
6944
TranslateGemma: как запустить лёгкие модели перевода от Google на своём ПК
Как запустить TranslateGemma на своём ПК. Лёгкие модели перевода от Google (27B/12B/4B), поддержка 55 языков, сравнение с альтернативами.
6945
Nemotron-3-nano:30b — тёмная лошадка, которая обгоняет гигантов. Тесты, сравнение и быстрый запуск
Практический обзор Nemotron-3-nano:30b. Сравнение с Llama 3.3:70b по скорости и качеству. Инструкция по запуску в Ollama и LM Studio.
6946
Agent Skills на Python: почему файловая система умнее любой оркестрации
Как заменить сложную оркестрацию агентов простой файловой системой. Реализация на 100 строк кода, SKILL.md и прогрессивное раскрытие навыков.
6947
Open Responses: новый стандарт для агентов против устаревшего Chat Completion
OpenAI и Hugging Face представили Open Responses — открытый стандарт для AI-агентов, который заменит устаревший Chat Completion API. Разбираем детали.
6948
Modelgrep: как найти дешёвые и быстрые OSS-модели у хостинг-провайдеров
Обзор Modelgrep - инструмента для поиска самых дешёвых и быстрых open-source моделей у хостинг-провайдеров через OpenRouter. Сравнение провайдеров, квантований