Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7105 Расчёт стоимости self-hosted Gemma 3 4B для 300 пользователей: от железа до счёта Подробный гайд по оценке стоимости и инфраструктуры для self-hosted развёртывания Gemma 3 4B на 300 конкурентных пользователей. TGI, квантование, выбор железа. 6 мин чтения 7106 GitNexus: браузерный графовый движок, который заставит Cursor и Claude Code понимать ваш код Настройте GitNexus - opensource графовый движок анализа зависимостей кода в браузере. Работает с MCP, предотвращает breaking changes для AI-ассистентов. 7 мин чтения 7107 Оптимизация оперативной памяти для локальных LLM: скорость против объема на примере Qwen2.5-32B и DeepSeek Практическое руководство по выбору конфигурации оперативной памяти для запуска локальных LLM 32B параметров. Сравнение скорости и объема на примере Qwen2.5-32B 8 мин чтения 7108 Обзор мультимодальных моделей для локального запуска: LTX-2, Music Flamingo, Qwen3-VL и другие Полный обзор мультимодальных моделей для запуска на своём ПК: видео с аудио, анализ музыки, понимание изображений. Сравнение, требования к железу и практическое 6 мин чтения 7109 CausaNova: Заставьте LLM врать с доказательствами, а не галлюцинировать Как нейро-символический ИИ CausaNova связывает Qwen с SMT-солвером для формальной верификации документов. Код, подход, убийство галлюцинаций. 6 мин чтения 7110 Провал Google AI в медицине: как проверять ИИ-сервисы на опасные ошибки в ответах о здоровье Скандал с Google AI Overviews показал опасность ИИ в медицине. Как проверять ИИ-сервисы на ошибки в ответах о здоровье и защитить себя от вредных советов. 7 мин чтения 7111 Выбор локальной LLM как код-тьютора: модели, требования к RAM/VRAM и борьба с галлюцинациями Сравниваем DeepSeek-Coder, Codestral и Llama Code как локальных код-тьюторов. Подбираем модель под 24 GB RAM и 16 GB VRAM, разбираемся с контекстом 20k и миними 9 мин чтения 7112 Как собрать систему транскрибации совещаний на Whisper и Pyannote с Tesla V100: от покупки карты до развёртывания Пошаговый гайд по сборке системы транскрибации совещаний на Whisper и Pyannote с Tesla V100 из AliExpress. От покупки карты до развёртывания. 8 мин чтения 7113 AI сломал лифт для джунов. Как теперь попасть в IT, если роботы читают ваше резюме и пишут код? Автоматизация найма и кодинга AI подняла планку для начинающих. Разбираем, что делать джунам, чтобы пробиться через фильтры ИИ и найти первую работу. 7 мин чтения 7114 Разреженные автоэнкодеры (SAE): как заглянуть в «чёрный ящик» LLM и управлять поведением модели Практический гайд по разреженным автоэнкодерам (SAE) для интерпретации чёрного ящика LLM и управления поведением моделей. Примеры с Claude 3 Sonnet. 6 мин чтения 7115 Amazon Bee vs. Alexa: зачем Amazon купила AI-носимый гаджет и как это изменит рынок Анализ приобретения Amazon устройства Bee: как это повлияет на Alexa, конкуренцию с Meta и рынок носимых AI-гаджетов. 5 мин чтения 7116 Claude for Healthcare vs ChatGPT Health: битва ИИ-гигантов за больничные койки Технический разбор архитектуры медицинских LLM от Anthropic и OpenAI. Как они автоматизируют документооборот и prior authorization. 6 мин чтения