Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7333
Создаем AI-компаньона с памятью, который учится сам и видит сны
Пошаговое руководство по созданию AI-компаньона для рабочего стола с долговременной памятью, автономным обучением и интеграцией Grok API.
7334
Цитируй или умри: как выбрать локальную LLM для советов по здоровью и карьере
Практическое сравнение локальных LLM с цитированием для медицинских и карьерных советов. Qwen3, GPT OSS, DeepSeek - что выбрать для интеграции с Weaviate и вект
7335
Обзор Ollie: локальный AI-редактор кода с прозрачностью и без подписки
Ollie - локальный AI-редактор кода с интеграцией Ollama, одноразовой покупкой и полной прозрачностью токенов. Обзор возможностей, сравнение и примеры использова
7336
MRI-GPT: Собираем локальный ИИ-ассистент для анализа МРТ позвоночника
Пошаговый гайд по сборке MRI-GPT — локального инструмента для сегментации и анализа МРТ позвоночника с помощью Qwen3-VL:8b и nnU-Net. Работает без интернета.
7337
Multi-Joint RAG: как Hermit-AI ищет в 100+ ГБ данных без интернета и не врёт
Глубокий разбор Hermit-AI: трёхэтапный конвейер Multi-Joint RAG для точного оффлайн-поиска в 100+ ГБ данных без галлюцинаций. JIT-индексирование, верификация фа
7338
Локальный AI-агент на стероидах: как заставить Kilo Code и Devstral-Small-2 работать на трёх 3090
Полный гайд по настройке Kilo Code и Devstral-Small-2 для агентного кодирования на локальном железе: выбор квантования Q8, контекст 120k+, оптимизация VRAM 72GB
7339
«Активируй Windows без ключа»: Как ChatGPT, Claude и другие AI-ассистенты реагируют на запросы обойти лицензирование
Эксперимент: как ChatGPT, Claude, DeepSeek и другие нейросети реагируют на просьбы обойти лицензирование ПО. Кто отказал, кто попытался помочь, а кто просто сбе
7340
Как я взломал ограничения NVIDIA: написал плагин на 1500 строк C для кластеризации 3 DGX Sparks
Реальный кейс: как я написал RDMA-плагин на чистом C для объединения 3 DGX Sparks в кластер, преодолев официальные ограничения NVIDIA. Подробности реализации, с
7341
Гибридный кластер для LLM: разгрузка prefill на eGPU и декодирование на Strix Halo
Практическое руководство по созданию гибридного кластера для LLM. Разгружаем prefill на eGPU, декодируем на AMD Strix Halo. Архитектура, настройка, ошибки.
7342
Как ускорить инференс LLM на 20% с помощью Cerebellum: архитектура Early Exit, SLERP и Dynamic RoPE
Обзор Cerebellum — инструмента для ускорения инференса LLM. Разбираем архитектуру Early Exit, SLERP интерполяцию и Dynamic RoPE. Примеры, сравнение с альтернати
7343
CES 2026: Роботы вышли из тени, а OpenAI забыла про экраны
Как OpenAI, Boston Dynamics и другие на CES 2026 показывают переход AI в физический мир. Тренды робототехники и screenless AI после провала агентов в 2025.
7344
RTX Blackwell Pro 6000: цена ушла в отрыв, а мы всё ждём
Актуальная цена RTX Blackwell Pro 6000, детальное сравнение с RTX 5000 Pro и почему сейчас лучше не покупать старое железо.