Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2905
Qwen3.5 Omni Plus: тест мультимодального гиганта от Alibaba и сравнение с Gemini
Тестируем Qwen3.5 Omni Plus от Alibaba — мультимодальную модель с Audio-Visual Vibe Coding. Сравнение с Gemini 3 Pro по работе с видео и кодом. Кто сильнее на п
2906
Как запустить 9B модель на 6GB VRAM: бесплатный гайд по использованию Google Colab и Cloudflare Tunnel
Пошаговый гайд по запуску 9B-параметровой LLM на Google Colab T4 с 6GB VRAM и созданию публичного API через Cloudflare Tunnel. Актуально на март 2026.
2907
SycoFact 4B: ИИ-детектор подхалимства, который чистит датасеты от мусора
Обзор модели SycoFact 4B для обнаружения подхалимства и ошибок в ответах ИИ. Как использовать для фильтрации тренировочных данных. Сравнение с аналогами на 30.0
2908
6 паттернов промпт-инжиниринга для разработчиков: от рефакторинга до аудита безопасности
Готовые шаблоны промптов для рефакторинга, тестирования, миграции кода и аудита безопасности. Практическое руководство для разработчиков.
2909
Как обучить мощную модель для эмбеддингов на одной видеокарте 3060 Ti: руководство по Unsloth и BRIGHT
Пошаговое руководство по обучению модели для эмбеддингов на видеокарте 3060 Ti с использованием Unsloth. Достигните #2 в benchmark BRIGHT на домашнем железе.
2910
Твой Coding Agent глупеет на C#? Qwen 3.5 против Llama 3.3 и баг, который убивает 65K контекст
Глубокий разбор бага tiered eviction в llama.cpp для гибридных моделей. Почему pure-attention 70B лучше для агентного C# кодирования и как избежать потери конте
2911
Как исправить инвалидацию KV-кэша в llama.cpp при использовании Claude Code: инструкция по настройке
Пошаговая инструкция по настройке Claude Code для предотвращения инвалидации KV-кэша в llama.cpp. Решение проблемы перерасчета токенов и повышение производитель
2912
LlamaStick: ваш карманный ИИ, который работает на любой машине без установки
Обзор LlamaStick: инструмент для запуска любых LLM (включая Llama 3.3, Qwen2.5, Gemma 3) с USB-флешки без Python, Docker или установки. Работает на Windows, mac
2913
SentrySearch: как настроить локальный семантический поиск по видео на Qwen3-VL-Embedding без API
Пошаговая настройка SentrySearch CLI для локального семантического поиска по видео. Используем Qwen3-VL-Embedding и ChromaDB без облачных API. Инструкция для Ap
2914
MCP Slim: как сократить расход контекста на 96% с помощью локального семантического поиска инструментов
MCP Slim решает проблему переполнения контекста MCP-серверов. Локальный оффлайн-поиск инструментов на MiniLM эмбеддингах экономит токены и делает модель умнее.
2915
Архитектура Ring: как масштабировать мультиязычную RAG-поддержку на Bedrock Knowledge Bases с экономией 21%
Пошаговый гайд по Ring-архитектуре для глобального RAG-чата на AWS Bedrock Knowledge Bases. Фильтрация по метаданным, пайплайны Step Functions и реальный кейс э
2916
Mantis Biotech создает цифровых двойников: медицина без реальных пациентов
Как стартап Mantis Biotech использует синтетические данные и ИИ для создания цифровых двойников пациентов. Решение проблем редких заболеваний и этики.