Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6637 SentinLLM: 100 строк кода против утечек персональных данных в RAG Обзор SentinLLM - Python-библиотеки для скрабинга персональных данных перед отправкой в LLM. Сравнение с Presidio, примеры использования для RAG-систем. 7 мин чтения 6638 Qwen2.5 7B против задач ARC-AGI: как маленькая модель ломает большие головоломки Практический гайд по созданию retrieval-системы на Qwen2.5 7B для декомпозиции сложных задач ARC-AGI на примитивы. Архитектура, калибровка, метрики на январь 20 5 мин чтения 6639 Llama, Ministral или GPT-OSS20B: какая локальная модель лучше генерирует синтетические данные в 2026? Тесты и бенчмарки синтетической генерации данных на локальных LLM в 2026 году. Какая модель лучше для BERT и приватных датасетов без облаков. 7 мин чтения 6640 64 ГБ RAM, чистая CPU и MoE-модели: кто выживает в спартанских условиях Практический гайд: какие MoE-модели реально работают на 64 ГБ RAM без видеокарты. Тесты GLM-4.7-Flash, Nemotron-3-Nano-30B-A3B, Qwen3-Coder-30B-A3B для кодинга, 9 мин чтения 6641 RTX 3090 для LLM: сборка кластера, замена термопасты, тесты SLI и драйверы Nvidia Практическое руководство по сборке бюджетного кластера для LLM на RTX 3090. Замена термопасты, тесты SLI, выбор драйверов Nvidia и оптимизация PCIe. 8 мин чтения 6642 Консалтинг без утечек: собираем локальную фабрику анализа документов за £30K Полный гайд по сборке рабочей станции на 3× RTX Pro 6000 для анализа конфиденциальных документов. RAG архитектура, долгоконтекстные модели, бизнес-автоматизация 8 мин чтения 6643 Claude Code против Llama-4 Scout: когда 1М токенов — это иллюзия, а LiteLLM — единственный путь Экспертный разбор реальной работы сверхдлинного контекста. Настройка vLLM + LiteLLM прокси, коллапс эффективного контекста и практические тесты качества рассужд 8 мин чтения 6644 Когда память кончается: как заставить локальный AI помнить больше 8К токенов Техническое решение проблемы ограниченного контекста через агентские подпрограммы, суммаризацию и скользящее окно контекста для локальных LLM. 9 мин чтения 6645 Как заставить локальные модели работать умнее: mcpx и экономия 40K токенов контекста Практическое руководство по реализации паттерна Anthropic Advanced Tool Use с mcpx для локальных моделей. Экономьте 40K токенов контекста, избегайте перегрузки 6 мин чтения 6646 Кейс-предупреждение: как слепая вера в ИИ завела на 40 км от цели (Франкфурт, навигация) Реальный кейс из Франкфурта: как доверие к ИИ-навигации привело к ошибке на 40 км. Анализ галлюцинаций ИИ и почему валидация ответов LLM - ваш щит. 5 мин чтения 6647 Temple Vault: файловая система вместо векторных баз как память для LLM через MCP Обзор Temple Vault - MCP сервера, который заменяет векторные базы данных на файловую систему для долгосрочной памяти AI-агентов. Установка, сравнение с MemGPT. 4 мин чтения 6648 Модифицированные GPU под локальные LLM: когда апгрейд памяти становится экстремальным спортом Полное руководство по модифицированным GPU с увеличенной VRAM для локальных LLM. Безопасность, производительность, где искать 4090 48GB и 5090 96GB на Alibaba. 8 мин чтения