Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5065 REAP против q2: когда память важнее точности? Реальные тесты на 120B моделях Практическое сравнение REAP и низкого квантования (q2, q4) для моделей >30GB. Тесты потребления RAM, скорости генерации и качества ответов на реальном железе. 6 мин чтения 5066 Первый ИИ-вирус PromptLock: как шифровальщик на gpt-oss-20b меняет правила игры Разбор PromptLock — первого шифровальщика, созданного ИИ. Как работает атака на gpt-oss-20b за <$1, почему это новая эра угроз и как защититься. Актуально на 12 4 мин чтения 5067 Китайские open-source модели (Qwen, DeepSeek, Kimi) обгоняют Llama: анализ скачиваний на Hugging Face и ценовая стратегия Qwen, DeepSeek и Kimi лидируют по скачиваниям на Hugging Face. Анализ ценовой стратегии и почему Meta теряет позиции в open-source AI. 4 мин чтения 5068 Как настроить DDoS-защиту и WAF, чтобы не блокировать легитимных ботов и нейрокраулеров Практическое руководство по настройке DDoS-защиты и WAF в 2026 году без блокировки поисковых роботов и AI-краулеров. Шаги, правила, ошибки. 6 мин чтения 5069 Kreuzberg против Tika, Unstructured, Docling: кто выжимает текст из документов лучше всех? Тестируем Rust-фреймворк Kreuzberg против Apache Tika, Unstructured и Docling в 2026. Скорость, точность и поддержка форматов для RAG и AI пайплайнов. 5 мин чтения 5070 Cache-aware prefill–decode disaggregation: как ускорить обработку длинного контекста в LLM на 40% Новая методика оптимизации инференса LLM с длинным контекстом: 40% QPS, снижение TTFT, принцип разделения нагрузки 9 мин чтения 5071 Запускаем Mistral на Intel NPU: реальные токены в секунду против CPU и iGPU Пошаговый туториал по запуску Mistral-7B на Intel NPU Core Ultra. Сравнение производительности с CPU и iGPU. Установка за 3 команды. 6 мин чтения 5072 AI Factory: как настроить проект для работы с Claude Code за 5 минут вместо часа Обзор AI Factory - инструмента для автоматической настройки проектов под Claude Code. Сравнение с ручной настройкой, примеры использования и рекомендации. 6 мин чтения 5073 Как собрать бюджетную систему для локальных AI-агентов: 2x AMD R9700, 64GB VRAM и Clojure-разработка Как собрать систему с 2x AMD R9700, 64GB VRAM для локальных AI-агентов и разработки на Clojure. Пошаговый гайд по железу и софту на 2026 год. 6 мин чтения 5074 Когда JTAG становится красной чертой: как GLM-5 думает о взломе и говорит "нет" Полный разбор работы guardrails в GLM-5 на примере запроса о JTAG. Как модель анализирует намерения, использует reasoning traces и принимает решение о блокировк 7 мин чтения 5075 GLM-5 захватывает трон: как июньский CLI проиграл китайской модели Сравнительный анализ GLM-5, Minimax M2.5 и GPT-5.3-Codex с агентами Droid и CLI. Какая связка модель+агент сейчас лучшая для разработки. 7 мин чтения 5076 MarkItDown: Microsoft сбросила бомбу в мир RAG, и все вздохнули с облегчением Обзор MarkItDown — нового open-source инструмента Microsoft для конвертации документов и мультимедиа в Markdown. Идеальный препроцессор для RAG-систем и LLM. 6 мин чтения