Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3421 Как управлять поведением LLM через активации: патч llama-server и Sparse Autoencoders Полный разбор управления поведением Llama и Mistral через низкоуровневые активации. Патч для llama-server и Sparse Autoencoders для контроля сикофансии и креати 6 мин чтения 3422 Qwen 3.5 397B на Mac: рекорд 93% на MMLU и квантование для MLX Анонс Qwen 3.5 397B с рекордом 93% на MMLU. Квантование для MLX позволяет запустить гигантскую модель на Mac с Apple Silicon. Обзор, сравнение и примеры использ 4 мин чтения 3423 TextRM-28M: тестируем крошечную модель для бизнес-писем с кодом на GitHub Обзор TextRM-28M - модели на 28 миллионов параметров для генерации бизнес-писем. Тестируем возможности, сравниваем с альтернативами, примеры кода на Python. 3 мин чтения 3424 Автоматизация тестирования: как RAG + LLM генерируют Java-тесты в IDE — полный гайд Пошаговое руководство по настройке RAG и LLM для автоматической генерации JUnit-тестов с Allure-отчетами прямо в вашей IDE. Экономьте часы рутинной работы. 7 мин чтения 3425 VS Code Autopilot: как автономный ИИ-агент ломает барьеры и почему это страшно Как режим Bypass Approvals в VS Code Autopilot позволяет ИИ-агенту действовать без подтверждения и какие угрозы это несёт для безопасности кода. Актуально на ма 4 мин чтения 3426 Как графы знаний решают проблему RAG в юриспруденции: сравнение с векторным поиском и настройка LightRAG Разбираем, почему векторный RAG проваливается в юриспруденции, как графы знаний решают проблему связей и практическая настройка LightRAG для юридических докумен 10 мин чтения 3427 Создание консольного чата с LLM на Python: пошаговый гайд по Ollama, LiteLLM и system prompt Пошаговое создание локального чата с ИИ в терминале на Python. Устанавливаем Ollama, настраиваем LiteLLM, пишем скрипт с system prompt и обработкой ошибок. 7 мин чтения 3428 Полное руководство по настройке autoresearch на RTX 5090: разбор ошибок, оптимальная конфигурация и бенчмарки Подробное руководство по установке и настройке autoresearch на видеокарте RTX 5090. Разбор ошибок, оптимальные параметры, тесты производительности на архитектур 6 мин чтения 3429 Какие модели запускать на RTX 5090: обзор для победителя Nvidia GTC Выиграли RTX 5090 на Nvidia GTC? Узнайте, какие языковые модели запускать на 24 ГБ GDDR7, как настроить и избежать ошибок. Актуально на март 2026. 9 мин чтения 3430 Темная сторона ИИ: как LLM усиливают когнитивные искажения и разобщают людей (анализ кейса) Реальная история 2026 года: как GPT-5 и Claude 4, подтверждая предубеждения, разрушили брак. Анализ темной стороны LLM, их роли в социальном разобщении и когнит 5 мин чтения 3431 Локальные эмбеддинги с Qwen3-0.6B INT8 для AI memory system: практическое руководство Полное руководство по настройке локального сервера эмбеддингов на Qwen3-0.6B INT8. Замена OpenAI, экономия 95% затрат, ONNX Runtime, квантование и интеграция с 9 мин чтения 3432 Оптимальные параметры генерации для Qwen3.5: как настроить температуру и штрафы для быстрого и эффективного чата Гайд по настройке температуры, top-p и штрафов повторения для Qwen3.5. Решение проблемы излишнего мышления, ускорение ответов и улучшение качества. 8 мин чтения