Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1993 Три в одном: Nvidia Star Elastic — как 12B, 23B и 30B живут в одном файле, и зачем тебе Zero-Shot Slicing Nvidia Star Elastic хранит три модели в одном чекпоинте. Узнайте, как работает Zero-Shot Slicing, и получите пошаговое руководство по запуску на своем железе. 6 мин чтения 1994 OncoAgent: open-source мультиагентная система для онкологии на LangGraph и QLoRA Обзор OncoAgent — мультиагентной системы на LangGraph и QLoRA для анализа рака. Приватное развертывание на AMD MI300X. Сравнение с Med-PaLM, примеры. 6 мин чтения 1995 LazyWeb: бесплатный MCP-сервер для AI-дизайна интерфейсов с пулом из 257 000 экранов реальных приложений Бесплатный MCP-сервер LazyWeb с пулом из 257 000 реальных скриншотов приложений. Решает проблему AI-look, помогает генерировать уникальные интерфейсы через Clau 5 мин чтения 1996 BeeLlama.cpp: форк llama.cpp с TurboQuant и DFlash – ускорение Qwen 27B до 135 tps на 3090 Обзор форка llama.cpp с TurboQuant и DFlash: как выжать 135 tps из Qwen 27B на RTX 3090. Детали квантования Q5, контекст 200k, сравнение с альтернативами. 6 мин чтения 1997 Как автоматизировать SEO-статьи для Яндекса: от семантики до публикации без копирайтеров Разбираем, как автоматизировать SEO-контент: семантика, микроинтенты, генерация, публикация, обновление и вставка офферов на примере SerpJet. 10 мин чтения 1998 Как исправить временную слепоту RAG: добавляем временной слой для работы с устаревшими данными Узнайте, как добавить временной слой в RAG, чтобы перестать получать устаревшие данные. Пошаговое руководство с примерами ошибок на май 2026. 7 мин чтения 1999 Как запустить MiMo-V2.5 с контекстом 1M на локальном ПК: тест производительности и настройка Пошаговый гайд по запуску MiMo-V2.5 с контекстом 1M токенов. Оптимизация памяти, команды для llama-server, тесты скорости и реальные сценарии использования. 6 мин чтения 2000 Caliby: новая open-source векторная БД для AI-агентов, превосходящая pgvector и FAISS Обзор Caliby — встраиваемой векторной БД, которая обгоняет pgvector и FAISS по скорости и эффективности на диске. Примеры, сравнения, рекомендации. 5 мин чтения 2001 Как построить легковесного AI-агента для администрирования сервера: опыт двух месяцев с openLight Практическая ретроспектива создания локального AI-агента openLight на Go, SQLite и Ollama. Реальные уроки, архитектура, безопасность и результаты двух месяцев а 9 мин чтения 2002 CyberSecQwen-4B: маленькая, злая и полностью ваша. Локальная LLM для безопасности CyberSecQwen-4B - 4-миллиардная модель для SOC и пентестеров. Работает офлайн, не сливает данные, понимает логи, атаки, уязвимости. Полный обзор и сравнение с а 5 мин чтения 2003 Как запустить CUDA-инференс на Apple Silicon Mac: полный гайд по PCI Passthrough Полный гайд по запуску CUDA на Mac M1/M2/M3 с внешней NVIDIA GPU: установка Asahi Linux, настройка eGPU, проброс PCIe, инференс LLM. Актуально на 2026. 7 мин чтения 2004 Claude Code: полное руководство для начинающих — установка, настройка и практические советы Пошаговое руководство по установке и настройке Claude Code — агентного AI-инструмента от Anthropic. Узнайте, как работать через CLI, десктоп-приложение и ускори 9 мин чтения