Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5653 Qwen3-Coder-Next: китайский ответ на CodeLlama, который умеет думать как программист Тестируем Qwen3-Coder-Next на реальных задачах, сравниваем с CodeLlama и DeepSeek-Coder. Кому подойдет новая модель для программирования. 5 мин чтения 5654 Mistral-Helcyon-Mercury-12b: локальная модель с тоном GPT-4o — тест и настройка Тест Mistral-Helcyon-Mercury-12b - локальной модели с тоном GPT-4o. Сравнение, настройка GGUF, инференс на RTX 3060 12GB. Альтернатива Mistral и Qwen2.5. 5 мин чтения 5655 Как создать специализированный AI-инструмент без галлюцинаций: кейс «Цифровой стандарт» для строительных норм Пошаговый гайд по созданию специализированного AI-инструмента для работы с нормативной документацией без галлюцинаций. Реальный кейс «Цифровой стандарт» для стр 8 мин чтения 5656 Медицинские LLM на вашем столе: какие модели реально работают на AI MAX+ и сколько памяти они съедают Практический гайд по выбору и запуску медицинских LLM на AI MAX+ с 128GB RAM. Сравнение Meditron, BioBERT, GPT-4 Medical, требования к памяти, скорость работы. 7 мин чтения 5657 Агент, который забыл, что уже сделал: почему долгоживущие LLM сходят с ума и как это лечить Практическое руководство по управлению состоянием, побочными эффектами и консистентностью в долгоживущих локальных LLM-агентах. Реальные проблемы и решения. 8 мин чтения 5658 Devstral Small 2 на стероидах: как выжать 2-3x скорость в llama.cpp через ngram-mod и draft-логику Пошаговый гайд по настройке ngram-mod и speculative decoding для 2-3x ускорения Devstral Small 2 в llama.cpp. Конкретные команды, параметры и тесты. 7 мин чтения 5659 WorldVQA: когда ИИ-зрение должно знать, а не догадываться Анализ WorldVQA от Kimi — бенчмарка на 3500 пар, который тестирует не рассуждения, а запомненные знания Vision-Language Models. Почему это меняет правила игры. 5 мин чтения 5660 Embedding-модели для compliance-документов: как не провалить проверку из-за плохого RAG Практический гайд по выбору embedding-моделей для регуляторных документов. Сравнение производительности, чанкинг, рекомендации для продакшена. 9 мин чтения 5661 Tanaos Sentiment Analysis: крошечная модель, которая понимает иронию лучше маркетологов Обзор Tanaos Sentiment Analysis — 500Мб модели для анализа тональности текста. Сравнение с аналогами, примеры работы через API, инструкция по локальному запуску 6 мин чтения 5662 ИИ в БАКе: как нейросети ищут физику там, где не могут учёные Нейросети анализируют данные Большого адронного коллайдера, чтобы найти то, что скрыто от человеческого взгляда. Как это работает и что уже нашли? 7 мин чтения 5663 Бот-аналитик на локальной LLM: как мы в ecom.tech разгрузили команду и не отправили данные конкурентам Практическое руководство по созданию локального бота для генерации SQL-запросов. Архитектура, выбор моделей, работа с изолированной БД на примере реального кейс 10 мин чтения 5664 Moltbook сдал 1.5 млн ключей: облачные агенты оказались дырявым ведром Скандальная утечка через Supabase в Moltbook показала, почему локальные модели безопаснее облачных агентов. Разбор архитектурной ошибки и её последствий. 4 мин чтения