Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5653
Qwen3-Coder-Next: китайский ответ на CodeLlama, который умеет думать как программист
Тестируем Qwen3-Coder-Next на реальных задачах, сравниваем с CodeLlama и DeepSeek-Coder. Кому подойдет новая модель для программирования.
5654
Mistral-Helcyon-Mercury-12b: локальная модель с тоном GPT-4o — тест и настройка
Тест Mistral-Helcyon-Mercury-12b - локальной модели с тоном GPT-4o. Сравнение, настройка GGUF, инференс на RTX 3060 12GB. Альтернатива Mistral и Qwen2.5.
5655
Как создать специализированный AI-инструмент без галлюцинаций: кейс «Цифровой стандарт» для строительных норм
Пошаговый гайд по созданию специализированного AI-инструмента для работы с нормативной документацией без галлюцинаций. Реальный кейс «Цифровой стандарт» для стр
5656
Медицинские LLM на вашем столе: какие модели реально работают на AI MAX+ и сколько памяти они съедают
Практический гайд по выбору и запуску медицинских LLM на AI MAX+ с 128GB RAM. Сравнение Meditron, BioBERT, GPT-4 Medical, требования к памяти, скорость работы.
5657
Агент, который забыл, что уже сделал: почему долгоживущие LLM сходят с ума и как это лечить
Практическое руководство по управлению состоянием, побочными эффектами и консистентностью в долгоживущих локальных LLM-агентах. Реальные проблемы и решения.
5658
Devstral Small 2 на стероидах: как выжать 2-3x скорость в llama.cpp через ngram-mod и draft-логику
Пошаговый гайд по настройке ngram-mod и speculative decoding для 2-3x ускорения Devstral Small 2 в llama.cpp. Конкретные команды, параметры и тесты.
5659
WorldVQA: когда ИИ-зрение должно знать, а не догадываться
Анализ WorldVQA от Kimi — бенчмарка на 3500 пар, который тестирует не рассуждения, а запомненные знания Vision-Language Models. Почему это меняет правила игры.
5660
Embedding-модели для compliance-документов: как не провалить проверку из-за плохого RAG
Практический гайд по выбору embedding-моделей для регуляторных документов. Сравнение производительности, чанкинг, рекомендации для продакшена.
5661
Tanaos Sentiment Analysis: крошечная модель, которая понимает иронию лучше маркетологов
Обзор Tanaos Sentiment Analysis — 500Мб модели для анализа тональности текста. Сравнение с аналогами, примеры работы через API, инструкция по локальному запуску
5662
ИИ в БАКе: как нейросети ищут физику там, где не могут учёные
Нейросети анализируют данные Большого адронного коллайдера, чтобы найти то, что скрыто от человеческого взгляда. Как это работает и что уже нашли?
5663
Бот-аналитик на локальной LLM: как мы в ecom.tech разгрузили команду и не отправили данные конкурентам
Практическое руководство по созданию локального бота для генерации SQL-запросов. Архитектура, выбор моделей, работа с изолированной БД на примере реального кейс
5664
Moltbook сдал 1.5 млн ключей: облачные агенты оказались дырявым ведром
Скандальная утечка через Supabase в Moltbook показала, почему локальные модели безопаснее облачных агентов. Разбор архитектурной ошибки и её последствий.