Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4093 Qwen 3.5 и её скрытая проблема: почему каждый ваш запрос стоит дороже, чем вы думаете Разбираемся, почему Qwen 3.5 пересчитывает длинные промпты с нуля, как это влияет на скорость и стоимость, и что с этим делать в 2026 году. 5 мин чтения 4094 Как обучить 3B LLM на специфичном датасете (патристическая теология) на одной RTX 3090 за 22 часа: полный разбор Пошаговый гайд по fine-tuning 3-миллиардной модели на нишевом датасете патристики. Конкретные параметры, код и оптимизации для RTX 3090. Работает за 22 часа. 9 мин чтения 4095 Как Clay масштабирует до 300 млн запусков AI-агентов в месяц: кейс использования LangSmith для мониторинга и отладки Реальный кейс Clay: как платформа обрабатывает 300 млн запусков AI-агентов ежемесячно с помощью LangSmith для мониторинга и отладки. Анализ проблем и решений. 6 мин чтения 4096 Как настроить Qwen3.5 27B для рекордной скорости: vLLM, MTP и компиляция под железо Подробный гайд по ускорению Qwen3.5 27B на двух RTX 3090: tensor parallelism в vLLM, Multi-Token Prediction и компиляция. Достигаем 100+ t/s генерации. 9 мин чтения 4097 Значительный прирост скорости Vulkan в llama.cpp после обновления прошивки AMD: тесты на Strix Halo и Qwen 3.5 35B Обновление прошивки AMD и ROCm 7.12 дало +40% скорости Vulkan в llama.cpp для Qwen 3.5 35B на Strix Halo. Детальный разбор и инструкция. 7 мин чтения 4098 Doc-to-LoRA и Text-to-LoRA от Sakana AI: как динамически обновлять знания LLM без переобучения Обзор методов Doc-to-LoRA и Text-to-LoRA от Sakana AI для создания LoRA адаптеров на лету через гиперсети. Сравнение с CLaaS и другими альтернативами. 4 мин чтения 4099 RewardHackWatch v1.3: детектирование взлома награды в LLM-агентах на CPU с локальным судьёй Llama Анонс RewardHackWatch v1.3 — open-source инструмент для детектирования подмены тестов и взлома наград в LLM-агентах. Работает на CPU через Ollama с локальным су 5 мин чтения 4100 Топ-10 фатальных ошибок промпт-инжиниринга: почему ChatGPT и Midjourney выдают ерунду ChatGPT и Midjourney выдают странные результаты? Разбираем 10 главных ошибок в промпт-инжиниринге, которые губят ваши запросы. Примеры, исправления, готовые шаб 6 мин чтения 4101 Прогресс локального ИИ за год: от $6000 за DeepSeek до Qwen 3.5 на мини-ПК за $600 Запуск LLM теперь в 10 раз дешевле. Как Qwen 3.5 на мини-ПК за $600 заменил дорогие серверы для DeepSeek. Актуально на 01.03.2026. 3 мин чтения 4102 Мышь, которая видит: автоматизация GUI на локальных мультимодальных моделях Пошаговый гайд по созданию пайплайна для автоматизации графического интерфейса с помощью PyAutoGUI и локальных мультимодальных моделей. Сравнение Ollama и llama 7 мин чтения 4103 Как запустить AI-агента на старом Android-телефоне: разбор 18 ошибок и финальная конфигурация Практический гайд по запуску AI-агента на Android-телефоне 2016 года. Разбор 18 фатальных ошибок, настройка Termux, Gemini Flash 2.0 API и готовый рабочий код д 10 мин чтения 4104 Беспилотник на VLM и ROS2: пошаговый гайд от установки до запуска на реальном железе Полный гайд по созданию автономного беспилотника на Vision-Language моделях и ROS2. Установка, настройка промптов, работа с реальным железом. 13 мин чтения