Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5065
REAP против q2: когда память важнее точности? Реальные тесты на 120B моделях
Практическое сравнение REAP и низкого квантования (q2, q4) для моделей >30GB. Тесты потребления RAM, скорости генерации и качества ответов на реальном железе.
5066
Первый ИИ-вирус PromptLock: как шифровальщик на gpt-oss-20b меняет правила игры
Разбор PromptLock — первого шифровальщика, созданного ИИ. Как работает атака на gpt-oss-20b за <$1, почему это новая эра угроз и как защититься. Актуально на 12
5067
Китайские open-source модели (Qwen, DeepSeek, Kimi) обгоняют Llama: анализ скачиваний на Hugging Face и ценовая стратегия
Qwen, DeepSeek и Kimi лидируют по скачиваниям на Hugging Face. Анализ ценовой стратегии и почему Meta теряет позиции в open-source AI.
5068
Как настроить DDoS-защиту и WAF, чтобы не блокировать легитимных ботов и нейрокраулеров
Практическое руководство по настройке DDoS-защиты и WAF в 2026 году без блокировки поисковых роботов и AI-краулеров. Шаги, правила, ошибки.
5069
Kreuzberg против Tika, Unstructured, Docling: кто выжимает текст из документов лучше всех?
Тестируем Rust-фреймворк Kreuzberg против Apache Tika, Unstructured и Docling в 2026. Скорость, точность и поддержка форматов для RAG и AI пайплайнов.
5070
Cache-aware prefill–decode disaggregation: как ускорить обработку длинного контекста в LLM на 40%
Новая методика оптимизации инференса LLM с длинным контекстом: 40% QPS, снижение TTFT, принцип разделения нагрузки
5071
Запускаем Mistral на Intel NPU: реальные токены в секунду против CPU и iGPU
Пошаговый туториал по запуску Mistral-7B на Intel NPU Core Ultra. Сравнение производительности с CPU и iGPU. Установка за 3 команды.
5072
AI Factory: как настроить проект для работы с Claude Code за 5 минут вместо часа
Обзор AI Factory - инструмента для автоматической настройки проектов под Claude Code. Сравнение с ручной настройкой, примеры использования и рекомендации.
5073
Как собрать бюджетную систему для локальных AI-агентов: 2x AMD R9700, 64GB VRAM и Clojure-разработка
Как собрать систему с 2x AMD R9700, 64GB VRAM для локальных AI-агентов и разработки на Clojure. Пошаговый гайд по железу и софту на 2026 год.
5074
Когда JTAG становится красной чертой: как GLM-5 думает о взломе и говорит "нет"
Полный разбор работы guardrails в GLM-5 на примере запроса о JTAG. Как модель анализирует намерения, использует reasoning traces и принимает решение о блокировк
5075
GLM-5 захватывает трон: как июньский CLI проиграл китайской модели
Сравнительный анализ GLM-5, Minimax M2.5 и GPT-5.3-Codex с агентами Droid и CLI. Какая связка модель+агент сейчас лучшая для разработки.
5076
MarkItDown: Microsoft сбросила бомбу в мир RAG, и все вздохнули с облегчением
Обзор MarkItDown — нового open-source инструмента Microsoft для конвертации документов и мультимедиа в Markdown. Идеальный препроцессор для RAG-систем и LLM.