Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

649 Sentient OS: проактивный AI-ассистент на локальных LLM с компьютерным зрением Sentient OS — открытый AI-ассистент, который каждую ночь анализирует ваши файлы, почту и скриншоты на локальной модели Gemma 4 E4B. Никакие данные не уходят в о 9 мин чтения 650 Как превратить стриминг-док Ajazz AKP05E Pro в AI-ассистента: практический гайд по кастомизации Превратите Ajazz AKP05E Pro в AI-ассистента: мониторинг CPU/GPU/RAM, отслеживание лимитов API Claude и Codex, интеграция с календарём и погодой, настройка крути 8 мин чтения 651 MCP как новый интерфейс продукта: агенты меняют модель взаимодействия с GUI Model Context Protocol превращает намерения пользователя в действия без GUI. Разбираем кейсы Selectel, экосистему скиллов от NVIDIA и Anthropic, угрозы вроде SA 8 мин чтения 652 Обзор Inflect v2: ультракомпактные TTS-модели с 4 и 9 миллионами параметров Разбираем Inflect v2: две TTS-модели с 3.96M и 9.36M параметров, которые работают на CPU быстрее реального времени. UTMOS 4.4, WER <4.2%, второе и третье места 8 мин чтения 653 Почему DenseNet121 не подходит для медицинской диагностики и как RAD-DINO решил проблему ложных срабатываний DenseNet121 запоминает артефакты кадра вместо реальных патологий. Разбираем проблему на примере рентгеновских снимков и показываем, как RAD-DINO-MAIRA-2 с замор 8 мин чтения 654 DKV: как фреймворк DifferentialKV сжимает KV-cache для локального инференса LLM Разбираем DKV (DifferentialKV) — open-source фреймворк для сжатия KV-кэша LLM. Четыре техники: anchor-based representations, joint low-rank compression, exact r 9 мин чтения 655 RUMBA: новый стандарт оценки долгосрочной памяти русскоязычных диалоговых систем RUMBA — первый бенчмарк долгосрочной памяти для русскоязычных диалоговых систем. 50+ сессий, трек абстенции и темпоральная логика. Сравнение RAG и полного конте 9 мин чтения 656 Voice Mode как предвестник смены парадигмы: почему следующей большой платформой станет голосовой интерфейс, а не очередная колонка Разбираем выход Voice Mode от ChatGPT и проект Сэма Альтмана и Джонни Айва. Почему это не умная колонка, а новый класс устройств — домашний компьютер с голосовы 11 мин чтения 657 OpenAI Micro: первый аппаратный продукт — стоит ли $230 за ИИ-клавиатуру? Разбираем OpenAI Micro — физическую клавиатуру для ChatGPT и Codex за $230. Характеристики, сценарии использования, сравнение с обычной клавиатурой и первые отз 7 мин чтения 658 AMD Instella-MoE-16B-A3B: первая открытая MoE-модель AMD с 3B активных параметров — архитектура, тесты и запуск AMD Instella-MoE-16B-A3B-Think: 16B общих параметров, всего 3B активных на токен. Разбираем архитектуру Mixture-of-Experts, сравниваем с Qwen2.5-14B-A3B и DeepS 9 мин чтения 659 Тест на пространственное мышление LLM: лабиринт с ключом как новый бенчмарк навигации без карты Разбираем новый бенчмарк для LLM — лабиринт с ключом. Модели должны найти выход без карты, используя только текстовые описания окружения. Первые тесты: GPT-5.4 7 мин чтения 660 Почему Intel Core Ultra 270K и Z890 не подходят для multi-GPU AI-инференса: тесты PCIe P2P и Tensor Parallel Практический тест Intel Arrow Lake на Core Ultra 270K и Z890 для multi-GPU AI-инференса. PCIe P2P не работает: пропускная способность падает вдвое, VLLM с tenso 6 мин чтения