Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3949 Как собрать RDMA-кластер для локальных LLM: сравнение Thunderbolt, RoCE v2 и Mellanox ConnectX-6 Полное руководство по сборке RDMA-кластера для локальных LLM. Сравнение Thunderbolt, RoCE v2 и Mellanox ConnectX-6. Настройка, тесты, ошибки. 10 мин чтения 3950 Как настроить локальную RAG-систему на ноутбуке: индексация 10 тысяч PDF-файлов с Ollama Полный гайд по сборке приватной RAG-системы на ноутбуке с RTX 5060. Индексация 10000 PDF с Ollama и 4-битными моделями без облаков. 10 мин чтения 3951 Метод ARA (Arbitrary-Rank Ablation): как Heretic победил цензуру в GPT-OSS Как метод Arbitrary-Rank Ablation в Heretic убирает цензуру из языковых моделей. Примеры использования и сравнение с альтернативами. 5 мин чтения 3952 Как снять ограничения с моделей LiquidAI LFM 2.5: руководство по аблитерации и готовые модели Рабочий Python-скрипт для аблитерации LiquidAI LFM 2.5, где искать готовые safetensors и GGUF версии. Сравнение с Surgical Removal и Refusal Steering. Актуально 5 мин чтения 3953 Как избежать катастрофического забывания при последовательной тонкой настройке LLM: метод CRMA для Mistral-7B Подробное руководство по методу Constrained Residual Adapter для последовательной тонкой настройки Mistral-7B без потери предыдущих знаний. Практическая реализа 8 мин чтения 3954 QuillCode: разбор архитектуры своего кодинг-агента, выбор инструментов и анализ ошибок Пошаговый разбор архитектуры своего AI-агента для программирования. Выбор инструментов, AST-анализ, ratatui интерфейс и патчинг через diff. 10 мин чтения 3955 Кто ответит, когда AI-агент сломает ваш бизнес? Модели ответственности от инструмента до автономии Разбираем модели ответственности за ошибки AI-агентов: инструмент vs супервизируемая автономия. Практические советы для бизнеса по внедрению ИИ в критические пр 6 мин чтения 3956 CodeGraphContext: когда файловый поиск бессилен против 14 языков кода Полный обзор CodeGraphContext — MCP сервера, который строит символьный граф кода на 14 языках, режет токены в 120 раз и заставляет AI понимать архитектуру. 5 мин чтения 3957 MCP в llama.cpp: Агенты выходят из тени после слияния PR Слияние PR добавило Model Context Protocol в llama.cpp. Как это открывает эпоху локальных AI-агентов с tool calls для WebUI и автоматизации. 4 мин чтения 3958 ASUS GX10 для локальных LLM: анализ производительности, сравнение с GPT5-mini и Claude Sonnet Полный разбор ноутбука ASUS GX10 для запуска локальных LLM. Производительность с Qwen3.5 122B и MiniMax-M2.5 230B, прямое сравнение с GPT5-mini и Claude Sonnet, 8 мин чтения 3959 Как защитить голосового AI от prompt injection в реальных звонках: разбор случая и архитектура защиты Разбор реальной атаки на голосового AI в продакшене. Многоуровневая архитектура защиты с использованием dograh ai и Vapi. Шаги реализации. 10 мин чтения 3960 Cicikuş v2-3B: тестируем легкую модель с Behavioral Consciousness Engine Тест модели Cicikuş v2-3B на базе Llama 3.2 3B. Behavioral Consciousness Engine, Secret Chain-of-Thought, 4.5 GB VRAM. Сравнение с Gemma 3 4B и MiniCPM-o-4.5. 4 мин чтения