Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2905 Qwen3.5 Omni Plus: тест мультимодального гиганта от Alibaba и сравнение с Gemini Тестируем Qwen3.5 Omni Plus от Alibaba — мультимодальную модель с Audio-Visual Vibe Coding. Сравнение с Gemini 3 Pro по работе с видео и кодом. Кто сильнее на п 5 мин чтения 2906 Как запустить 9B модель на 6GB VRAM: бесплатный гайд по использованию Google Colab и Cloudflare Tunnel Пошаговый гайд по запуску 9B-параметровой LLM на Google Colab T4 с 6GB VRAM и созданию публичного API через Cloudflare Tunnel. Актуально на март 2026. 8 мин чтения 2907 SycoFact 4B: ИИ-детектор подхалимства, который чистит датасеты от мусора Обзор модели SycoFact 4B для обнаружения подхалимства и ошибок в ответах ИИ. Как использовать для фильтрации тренировочных данных. Сравнение с аналогами на 30.0 6 мин чтения 2908 6 паттернов промпт-инжиниринга для разработчиков: от рефакторинга до аудита безопасности Готовые шаблоны промптов для рефакторинга, тестирования, миграции кода и аудита безопасности. Практическое руководство для разработчиков. 7 мин чтения 2909 Как обучить мощную модель для эмбеддингов на одной видеокарте 3060 Ti: руководство по Unsloth и BRIGHT Пошаговое руководство по обучению модели для эмбеддингов на видеокарте 3060 Ti с использованием Unsloth. Достигните #2 в benchmark BRIGHT на домашнем железе. 9 мин чтения 2910 Твой Coding Agent глупеет на C#? Qwen 3.5 против Llama 3.3 и баг, который убивает 65K контекст Глубокий разбор бага tiered eviction в llama.cpp для гибридных моделей. Почему pure-attention 70B лучше для агентного C# кодирования и как избежать потери конте 10 мин чтения 2911 Как исправить инвалидацию KV-кэша в llama.cpp при использовании Claude Code: инструкция по настройке Пошаговая инструкция по настройке Claude Code для предотвращения инвалидации KV-кэша в llama.cpp. Решение проблемы перерасчета токенов и повышение производитель 6 мин чтения 2912 LlamaStick: ваш карманный ИИ, который работает на любой машине без установки Обзор LlamaStick: инструмент для запуска любых LLM (включая Llama 3.3, Qwen2.5, Gemma 3) с USB-флешки без Python, Docker или установки. Работает на Windows, mac 6 мин чтения 2913 SentrySearch: как настроить локальный семантический поиск по видео на Qwen3-VL-Embedding без API Пошаговая настройка SentrySearch CLI для локального семантического поиска по видео. Используем Qwen3-VL-Embedding и ChromaDB без облачных API. Инструкция для Ap 5 мин чтения 2914 MCP Slim: как сократить расход контекста на 96% с помощью локального семантического поиска инструментов MCP Slim решает проблему переполнения контекста MCP-серверов. Локальный оффлайн-поиск инструментов на MiniLM эмбеддингах экономит токены и делает модель умнее. 5 мин чтения 2915 Архитектура Ring: как масштабировать мультиязычную RAG-поддержку на Bedrock Knowledge Bases с экономией 21% Пошаговый гайд по Ring-архитектуре для глобального RAG-чата на AWS Bedrock Knowledge Bases. Фильтрация по метаданным, пайплайны Step Functions и реальный кейс э 9 мин чтения 2916 Mantis Biotech создает цифровых двойников: медицина без реальных пациентов Как стартап Mantis Biotech использует синтетические данные и ИИ для создания цифровых двойников пациентов. Решение проблем редких заболеваний и этики. 4 мин чтения