Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
1993
Три в одном: Nvidia Star Elastic — как 12B, 23B и 30B живут в одном файле, и зачем тебе Zero-Shot Slicing
Nvidia Star Elastic хранит три модели в одном чекпоинте. Узнайте, как работает Zero-Shot Slicing, и получите пошаговое руководство по запуску на своем железе.
1994
OncoAgent: open-source мультиагентная система для онкологии на LangGraph и QLoRA
Обзор OncoAgent — мультиагентной системы на LangGraph и QLoRA для анализа рака. Приватное развертывание на AMD MI300X. Сравнение с Med-PaLM, примеры.
1995
LazyWeb: бесплатный MCP-сервер для AI-дизайна интерфейсов с пулом из 257 000 экранов реальных приложений
Бесплатный MCP-сервер LazyWeb с пулом из 257 000 реальных скриншотов приложений. Решает проблему AI-look, помогает генерировать уникальные интерфейсы через Clau
1996
BeeLlama.cpp: форк llama.cpp с TurboQuant и DFlash – ускорение Qwen 27B до 135 tps на 3090
Обзор форка llama.cpp с TurboQuant и DFlash: как выжать 135 tps из Qwen 27B на RTX 3090. Детали квантования Q5, контекст 200k, сравнение с альтернативами.
1997
Как автоматизировать SEO-статьи для Яндекса: от семантики до публикации без копирайтеров
Разбираем, как автоматизировать SEO-контент: семантика, микроинтенты, генерация, публикация, обновление и вставка офферов на примере SerpJet.
1998
Как исправить временную слепоту RAG: добавляем временной слой для работы с устаревшими данными
Узнайте, как добавить временной слой в RAG, чтобы перестать получать устаревшие данные. Пошаговое руководство с примерами ошибок на май 2026.
1999
Как запустить MiMo-V2.5 с контекстом 1M на локальном ПК: тест производительности и настройка
Пошаговый гайд по запуску MiMo-V2.5 с контекстом 1M токенов. Оптимизация памяти, команды для llama-server, тесты скорости и реальные сценарии использования.
2000
Caliby: новая open-source векторная БД для AI-агентов, превосходящая pgvector и FAISS
Обзор Caliby — встраиваемой векторной БД, которая обгоняет pgvector и FAISS по скорости и эффективности на диске. Примеры, сравнения, рекомендации.
2001
Как построить легковесного AI-агента для администрирования сервера: опыт двух месяцев с openLight
Практическая ретроспектива создания локального AI-агента openLight на Go, SQLite и Ollama. Реальные уроки, архитектура, безопасность и результаты двух месяцев а
2002
CyberSecQwen-4B: маленькая, злая и полностью ваша. Локальная LLM для безопасности
CyberSecQwen-4B - 4-миллиардная модель для SOC и пентестеров. Работает офлайн, не сливает данные, понимает логи, атаки, уязвимости. Полный обзор и сравнение с а
2003
Как запустить CUDA-инференс на Apple Silicon Mac: полный гайд по PCI Passthrough
Полный гайд по запуску CUDA на Mac M1/M2/M3 с внешней NVIDIA GPU: установка Asahi Linux, настройка eGPU, проброс PCIe, инференс LLM. Актуально на 2026.
2004
Claude Code: полное руководство для начинающих — установка, настройка и практические советы
Пошаговое руководство по установке и настройке Claude Code — агентного AI-инструмента от Anthropic. Узнайте, как работать через CLI, десктоп-приложение и ускори