Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
649
Sentient OS: проактивный AI-ассистент на локальных LLM с компьютерным зрением
Sentient OS — открытый AI-ассистент, который каждую ночь анализирует ваши файлы, почту и скриншоты на локальной модели Gemma 4 E4B. Никакие данные не уходят в о
650
Как превратить стриминг-док Ajazz AKP05E Pro в AI-ассистента: практический гайд по кастомизации
Превратите Ajazz AKP05E Pro в AI-ассистента: мониторинг CPU/GPU/RAM, отслеживание лимитов API Claude и Codex, интеграция с календарём и погодой, настройка крути
651
MCP как новый интерфейс продукта: агенты меняют модель взаимодействия с GUI
Model Context Protocol превращает намерения пользователя в действия без GUI. Разбираем кейсы Selectel, экосистему скиллов от NVIDIA и Anthropic, угрозы вроде SA
652
Обзор Inflect v2: ультракомпактные TTS-модели с 4 и 9 миллионами параметров
Разбираем Inflect v2: две TTS-модели с 3.96M и 9.36M параметров, которые работают на CPU быстрее реального времени. UTMOS 4.4, WER <4.2%, второе и третье места
653
Почему DenseNet121 не подходит для медицинской диагностики и как RAD-DINO решил проблему ложных срабатываний
DenseNet121 запоминает артефакты кадра вместо реальных патологий. Разбираем проблему на примере рентгеновских снимков и показываем, как RAD-DINO-MAIRA-2 с замор
654
DKV: как фреймворк DifferentialKV сжимает KV-cache для локального инференса LLM
Разбираем DKV (DifferentialKV) — open-source фреймворк для сжатия KV-кэша LLM. Четыре техники: anchor-based representations, joint low-rank compression, exact r
655
RUMBA: новый стандарт оценки долгосрочной памяти русскоязычных диалоговых систем
RUMBA — первый бенчмарк долгосрочной памяти для русскоязычных диалоговых систем. 50+ сессий, трек абстенции и темпоральная логика. Сравнение RAG и полного конте
656
Voice Mode как предвестник смены парадигмы: почему следующей большой платформой станет голосовой интерфейс, а не очередная колонка
Разбираем выход Voice Mode от ChatGPT и проект Сэма Альтмана и Джонни Айва. Почему это не умная колонка, а новый класс устройств — домашний компьютер с голосовы
657
OpenAI Micro: первый аппаратный продукт — стоит ли $230 за ИИ-клавиатуру?
Разбираем OpenAI Micro — физическую клавиатуру для ChatGPT и Codex за $230. Характеристики, сценарии использования, сравнение с обычной клавиатурой и первые отз
658
AMD Instella-MoE-16B-A3B: первая открытая MoE-модель AMD с 3B активных параметров — архитектура, тесты и запуск
AMD Instella-MoE-16B-A3B-Think: 16B общих параметров, всего 3B активных на токен. Разбираем архитектуру Mixture-of-Experts, сравниваем с Qwen2.5-14B-A3B и DeepS
659
Тест на пространственное мышление LLM: лабиринт с ключом как новый бенчмарк навигации без карты
Разбираем новый бенчмарк для LLM — лабиринт с ключом. Модели должны найти выход без карты, используя только текстовые описания окружения. Первые тесты: GPT-5.4
660
Почему Intel Core Ultra 270K и Z890 не подходят для multi-GPU AI-инференса: тесты PCIe P2P и Tensor Parallel
Практический тест Intel Arrow Lake на Core Ultra 270K и Z890 для multi-GPU AI-инференса. PCIe P2P не работает: пропускная способность падает вдвое, VLLM с tenso