Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3421
Как управлять поведением LLM через активации: патч llama-server и Sparse Autoencoders
Полный разбор управления поведением Llama и Mistral через низкоуровневые активации. Патч для llama-server и Sparse Autoencoders для контроля сикофансии и креати
3422
Qwen 3.5 397B на Mac: рекорд 93% на MMLU и квантование для MLX
Анонс Qwen 3.5 397B с рекордом 93% на MMLU. Квантование для MLX позволяет запустить гигантскую модель на Mac с Apple Silicon. Обзор, сравнение и примеры использ
3423
TextRM-28M: тестируем крошечную модель для бизнес-писем с кодом на GitHub
Обзор TextRM-28M - модели на 28 миллионов параметров для генерации бизнес-писем. Тестируем возможности, сравниваем с альтернативами, примеры кода на Python.
3424
Автоматизация тестирования: как RAG + LLM генерируют Java-тесты в IDE — полный гайд
Пошаговое руководство по настройке RAG и LLM для автоматической генерации JUnit-тестов с Allure-отчетами прямо в вашей IDE. Экономьте часы рутинной работы.
3425
VS Code Autopilot: как автономный ИИ-агент ломает барьеры и почему это страшно
Как режим Bypass Approvals в VS Code Autopilot позволяет ИИ-агенту действовать без подтверждения и какие угрозы это несёт для безопасности кода. Актуально на ма
3426
Как графы знаний решают проблему RAG в юриспруденции: сравнение с векторным поиском и настройка LightRAG
Разбираем, почему векторный RAG проваливается в юриспруденции, как графы знаний решают проблему связей и практическая настройка LightRAG для юридических докумен
3427
Создание консольного чата с LLM на Python: пошаговый гайд по Ollama, LiteLLM и system prompt
Пошаговое создание локального чата с ИИ в терминале на Python. Устанавливаем Ollama, настраиваем LiteLLM, пишем скрипт с system prompt и обработкой ошибок.
3428
Полное руководство по настройке autoresearch на RTX 5090: разбор ошибок, оптимальная конфигурация и бенчмарки
Подробное руководство по установке и настройке autoresearch на видеокарте RTX 5090. Разбор ошибок, оптимальные параметры, тесты производительности на архитектур
3429
Какие модели запускать на RTX 5090: обзор для победителя Nvidia GTC
Выиграли RTX 5090 на Nvidia GTC? Узнайте, какие языковые модели запускать на 24 ГБ GDDR7, как настроить и избежать ошибок. Актуально на март 2026.
3430
Темная сторона ИИ: как LLM усиливают когнитивные искажения и разобщают людей (анализ кейса)
Реальная история 2026 года: как GPT-5 и Claude 4, подтверждая предубеждения, разрушили брак. Анализ темной стороны LLM, их роли в социальном разобщении и когнит
3431
Локальные эмбеддинги с Qwen3-0.6B INT8 для AI memory system: практическое руководство
Полное руководство по настройке локального сервера эмбеддингов на Qwen3-0.6B INT8. Замена OpenAI, экономия 95% затрат, ONNX Runtime, квантование и интеграция с
3432
Оптимальные параметры генерации для Qwen3.5: как настроить температуру и штрафы для быстрого и эффективного чата
Гайд по настройке температуры, top-p и штрафов повторения для Qwen3.5. Решение проблемы излишнего мышления, ускорение ответов и улучшение качества.