Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7333 Создаем AI-компаньона с памятью, который учится сам и видит сны Пошаговое руководство по созданию AI-компаньона для рабочего стола с долговременной памятью, автономным обучением и интеграцией Grok API. 8 мин чтения 7334 Цитируй или умри: как выбрать локальную LLM для советов по здоровью и карьере Практическое сравнение локальных LLM с цитированием для медицинских и карьерных советов. Qwen3, GPT OSS, DeepSeek - что выбрать для интеграции с Weaviate и вект 8 мин чтения 7335 Обзор Ollie: локальный AI-редактор кода с прозрачностью и без подписки Ollie - локальный AI-редактор кода с интеграцией Ollama, одноразовой покупкой и полной прозрачностью токенов. Обзор возможностей, сравнение и примеры использова 3 мин чтения 7336 MRI-GPT: Собираем локальный ИИ-ассистент для анализа МРТ позвоночника Пошаговый гайд по сборке MRI-GPT — локального инструмента для сегментации и анализа МРТ позвоночника с помощью Qwen3-VL:8b и nnU-Net. Работает без интернета. 7 мин чтения 7337 Multi-Joint RAG: как Hermit-AI ищет в 100+ ГБ данных без интернета и не врёт Глубокий разбор Hermit-AI: трёхэтапный конвейер Multi-Joint RAG для точного оффлайн-поиска в 100+ ГБ данных без галлюцинаций. JIT-индексирование, верификация фа 7 мин чтения 7338 Локальный AI-агент на стероидах: как заставить Kilo Code и Devstral-Small-2 работать на трёх 3090 Полный гайд по настройке Kilo Code и Devstral-Small-2 для агентного кодирования на локальном железе: выбор квантования Q8, контекст 120k+, оптимизация VRAM 72GB 7 мин чтения 7339 «Активируй Windows без ключа»: Как ChatGPT, Claude и другие AI-ассистенты реагируют на запросы обойти лицензирование Эксперимент: как ChatGPT, Claude, DeepSeek и другие нейросети реагируют на просьбы обойти лицензирование ПО. Кто отказал, кто попытался помочь, а кто просто сбе 4 мин чтения 7340 Как я взломал ограничения NVIDIA: написал плагин на 1500 строк C для кластеризации 3 DGX Sparks Реальный кейс: как я написал RDMA-плагин на чистом C для объединения 3 DGX Sparks в кластер, преодолев официальные ограничения NVIDIA. Подробности реализации, с 5 мин чтения 7341 Гибридный кластер для LLM: разгрузка prefill на eGPU и декодирование на Strix Halo Практическое руководство по созданию гибридного кластера для LLM. Разгружаем prefill на eGPU, декодируем на AMD Strix Halo. Архитектура, настройка, ошибки. 7 мин чтения 7342 Как ускорить инференс LLM на 20% с помощью Cerebellum: архитектура Early Exit, SLERP и Dynamic RoPE Обзор Cerebellum — инструмента для ускорения инференса LLM. Разбираем архитектуру Early Exit, SLERP интерполяцию и Dynamic RoPE. Примеры, сравнение с альтернати 5 мин чтения 7343 CES 2026: Роботы вышли из тени, а OpenAI забыла про экраны Как OpenAI, Boston Dynamics и другие на CES 2026 показывают переход AI в физический мир. Тренды робототехники и screenless AI после провала агентов в 2025. 5 мин чтения 7344 RTX Blackwell Pro 6000: цена ушла в отрыв, а мы всё ждём Актуальная цена RTX Blackwell Pro 6000, детальное сравнение с RTX 5000 Pro и почему сейчас лучше не покупать старое железо. 6 мин чтения