Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4093
Qwen 3.5 и её скрытая проблема: почему каждый ваш запрос стоит дороже, чем вы думаете
Разбираемся, почему Qwen 3.5 пересчитывает длинные промпты с нуля, как это влияет на скорость и стоимость, и что с этим делать в 2026 году.
4094
Как обучить 3B LLM на специфичном датасете (патристическая теология) на одной RTX 3090 за 22 часа: полный разбор
Пошаговый гайд по fine-tuning 3-миллиардной модели на нишевом датасете патристики. Конкретные параметры, код и оптимизации для RTX 3090. Работает за 22 часа.
4095
Как Clay масштабирует до 300 млн запусков AI-агентов в месяц: кейс использования LangSmith для мониторинга и отладки
Реальный кейс Clay: как платформа обрабатывает 300 млн запусков AI-агентов ежемесячно с помощью LangSmith для мониторинга и отладки. Анализ проблем и решений.
4096
Как настроить Qwen3.5 27B для рекордной скорости: vLLM, MTP и компиляция под железо
Подробный гайд по ускорению Qwen3.5 27B на двух RTX 3090: tensor parallelism в vLLM, Multi-Token Prediction и компиляция. Достигаем 100+ t/s генерации.
4097
Значительный прирост скорости Vulkan в llama.cpp после обновления прошивки AMD: тесты на Strix Halo и Qwen 3.5 35B
Обновление прошивки AMD и ROCm 7.12 дало +40% скорости Vulkan в llama.cpp для Qwen 3.5 35B на Strix Halo. Детальный разбор и инструкция.
4098
Doc-to-LoRA и Text-to-LoRA от Sakana AI: как динамически обновлять знания LLM без переобучения
Обзор методов Doc-to-LoRA и Text-to-LoRA от Sakana AI для создания LoRA адаптеров на лету через гиперсети. Сравнение с CLaaS и другими альтернативами.
4099
RewardHackWatch v1.3: детектирование взлома награды в LLM-агентах на CPU с локальным судьёй Llama
Анонс RewardHackWatch v1.3 — open-source инструмент для детектирования подмены тестов и взлома наград в LLM-агентах. Работает на CPU через Ollama с локальным су
4100
Топ-10 фатальных ошибок промпт-инжиниринга: почему ChatGPT и Midjourney выдают ерунду
ChatGPT и Midjourney выдают странные результаты? Разбираем 10 главных ошибок в промпт-инжиниринге, которые губят ваши запросы. Примеры, исправления, готовые шаб
4101
Прогресс локального ИИ за год: от $6000 за DeepSeek до Qwen 3.5 на мини-ПК за $600
Запуск LLM теперь в 10 раз дешевле. Как Qwen 3.5 на мини-ПК за $600 заменил дорогие серверы для DeepSeek. Актуально на 01.03.2026.
4102
Мышь, которая видит: автоматизация GUI на локальных мультимодальных моделях
Пошаговый гайд по созданию пайплайна для автоматизации графического интерфейса с помощью PyAutoGUI и локальных мультимодальных моделей. Сравнение Ollama и llama
4103
Как запустить AI-агента на старом Android-телефоне: разбор 18 ошибок и финальная конфигурация
Практический гайд по запуску AI-агента на Android-телефоне 2016 года. Разбор 18 фатальных ошибок, настройка Termux, Gemini Flash 2.0 API и готовый рабочий код д
4104
Беспилотник на VLM и ROS2: пошаговый гайд от установки до запуска на реальном железе
Полный гайд по созданию автономного беспилотника на Vision-Language моделях и ROS2. Установка, настройка промптов, работа с реальным железом.