Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3229
Как анонимизация данных влияет на качество LLM-агентов: эксперимент с маскированием и псевдонимами
Практическое исследование влияния анонимизации на качество LLM-агентов. Методы маскирования, псевдонимы, инструменты Hivetrace Dataclean 3.2 и DeepEval 2.0 на 2
3230
Разоблачение бенчмарков для ИИ-кода: что скрывают графики Cursor и почему токены важнее процента решений
Критика CursorBench и SWE-bench: почему стоимость токенов и задержка генерации решают всё при выборе модели для продакшена. Актуально на март 2026.
3231
Savant Commander 48B MOE: руководство по установке и тестированию дистилляций Claude, Gemini и OpenAI в одной модели
Полное руководство по Savant Commander 48B MOE - модели, объединяющей дистилляции Claude, Gemini и OpenAI. Установка, тестирование, сравнение с альтернативами.
3232
Delta-KV для llama.cpp: как сжать KV-кеш до 4 бит почти без потерь на Llama 70B
Техника дельта-квантования сжимает KV-кеш в 8 раз, позволяя запускать Llama 70B на слабом железе без потери качества. Интеграция в llama.cpp.
3233
FlashAttention-4: разгон инференса в 2.7 раза, поддержка в vLLM и жёсткие требования к железу
Обзор FlashAttention-4: как работает, интеграция с vLLM 0.17.0, поддержка Blackwell и Hopper GPU, сравнение с альтернативами.
3234
oQ: data-driven mixed-precision квантование для Apple Silicon — обзор, установка и калибровка
Обзор инструмента oQ для data-driven mixed-precision квантования моделей под Apple Silicon. Установка, калибровка, сравнение с аналогами и примеры использования
3235
Как стать Agentic AI Engineer с локальным стеком: план обучения, проекты и собеседования
Пошаговый план, чтобы стать Agentic AI Engineer. Локальный стек на Ollama, ChromaDB, LangGraph. Какие проекты собрать в портфолио и как пройти собеседование.
3236
Qwen3.5 27B: лучшие практики оптимизации скорости и качества от сообщества LocalLLaMA
Полное руководство по ускорению и настройке Qwen3.5 27B на 23.03.2026. Квантование, конфиги llama.cpp, оптимизация железа и исправление ошибок от сообщества.
3237
Асимметричный скептицизм: как LLM стали цензорами по умолчанию
Новое исследование от 23.03.2026 показывает, как Claude 3.5, Gemini Ultra 2.0 и GPT-4o защищают официальные нарративы. Модели сами признают свою системную предв
3238
Шаблон системного промпта для Qwen: как структурировать запросы, чтобы ИИ понимал вас с первого раза
Готовый шаблон системного промпта для Qwen 3.5-Plus. Узнайте, как структурировать запросы, чтобы получать точные ответы от ИИ с первого раза. Примеры и советы.
3239
Пошаговый гайд: интеграция Amazon Bedrock AgentCore со Slack для бизнес-агентов
Подробная инструкция по подключению AI-агента из Bedrock AgentCore к Slack с использованием AWS CDK и Lambda. Разбор ошибок и лучшие практики.
3240
Детерминированные LLM от Artificial Genius: как Amazon Nova борется с галлюцинациями в финансах и медицине
Обзор Amazon Nova от Artificial Genius. Как детерминированный ИИ решает проблему галлюцинаций в финансовых и медицинских LLM. Сравнение с GPT-5.2 и примеры испо