Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3949
Как собрать RDMA-кластер для локальных LLM: сравнение Thunderbolt, RoCE v2 и Mellanox ConnectX-6
Полное руководство по сборке RDMA-кластера для локальных LLM. Сравнение Thunderbolt, RoCE v2 и Mellanox ConnectX-6. Настройка, тесты, ошибки.
3950
Как настроить локальную RAG-систему на ноутбуке: индексация 10 тысяч PDF-файлов с Ollama
Полный гайд по сборке приватной RAG-системы на ноутбуке с RTX 5060. Индексация 10000 PDF с Ollama и 4-битными моделями без облаков.
3951
Метод ARA (Arbitrary-Rank Ablation): как Heretic победил цензуру в GPT-OSS
Как метод Arbitrary-Rank Ablation в Heretic убирает цензуру из языковых моделей. Примеры использования и сравнение с альтернативами.
3952
Как снять ограничения с моделей LiquidAI LFM 2.5: руководство по аблитерации и готовые модели
Рабочий Python-скрипт для аблитерации LiquidAI LFM 2.5, где искать готовые safetensors и GGUF версии. Сравнение с Surgical Removal и Refusal Steering. Актуально
3953
Как избежать катастрофического забывания при последовательной тонкой настройке LLM: метод CRMA для Mistral-7B
Подробное руководство по методу Constrained Residual Adapter для последовательной тонкой настройки Mistral-7B без потери предыдущих знаний. Практическая реализа
3954
QuillCode: разбор архитектуры своего кодинг-агента, выбор инструментов и анализ ошибок
Пошаговый разбор архитектуры своего AI-агента для программирования. Выбор инструментов, AST-анализ, ratatui интерфейс и патчинг через diff.
3955
Кто ответит, когда AI-агент сломает ваш бизнес? Модели ответственности от инструмента до автономии
Разбираем модели ответственности за ошибки AI-агентов: инструмент vs супервизируемая автономия. Практические советы для бизнеса по внедрению ИИ в критические пр
3956
CodeGraphContext: когда файловый поиск бессилен против 14 языков кода
Полный обзор CodeGraphContext — MCP сервера, который строит символьный граф кода на 14 языках, режет токены в 120 раз и заставляет AI понимать архитектуру.
3957
MCP в llama.cpp: Агенты выходят из тени после слияния PR
Слияние PR добавило Model Context Protocol в llama.cpp. Как это открывает эпоху локальных AI-агентов с tool calls для WebUI и автоматизации.
3958
ASUS GX10 для локальных LLM: анализ производительности, сравнение с GPT5-mini и Claude Sonnet
Полный разбор ноутбука ASUS GX10 для запуска локальных LLM. Производительность с Qwen3.5 122B и MiniMax-M2.5 230B, прямое сравнение с GPT5-mini и Claude Sonnet,
3959
Как защитить голосового AI от prompt injection в реальных звонках: разбор случая и архитектура защиты
Разбор реальной атаки на голосового AI в продакшене. Многоуровневая архитектура защиты с использованием dograh ai и Vapi. Шаги реализации.
3960
Cicikuş v2-3B: тестируем легкую модель с Behavioral Consciousness Engine
Тест модели Cicikuş v2-3B на базе Llama 3.2 3B. Behavioral Consciousness Engine, Secret Chain-of-Thought, 4.5 GB VRAM. Сравнение с Gemma 3 4B и MiniCPM-o-4.5.