Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3361
Attention Residuals от Kimi: как замена сложения вниманием ломает архитектуру трансформеров
Новое исследование Kimi: Attention Residuals улучшают LLM на 3-7.5 пунктов и экономят вычисления. Сравнение с DeepSeek mHC и будущее архитектуры трансформеров.
3362
SeeQL: Как построить open-source интерфейс для общения с SQL-базой на естественном языке
Обзор SeeQL — локального интерфейса для запросов к SQL на русском языке. Технологии OpenUI Lang, MCP server и современные LLM. Установка и примеры.
3363
Рефакторинг кода на Java с помощью LLM: практический гайд по миграции Feature Flags
Пошаговая инструкция по использованию LLM для автоматической миграции Feature Flags в Java-коде. Готовые промпты, примеры кода до и после, актуальные инструмент
3364
Как управлять поведением LLM через активации: патч llama-server и Sparse Autoencoders
Полный разбор управления поведением Llama и Mistral через низкоуровневые активации. Патч для llama-server и Sparse Autoencoders для контроля сикофансии и креати
3365
Qwen 3.5 397B на Mac: рекорд 93% на MMLU и квантование для MLX
Анонс Qwen 3.5 397B с рекордом 93% на MMLU. Квантование для MLX позволяет запустить гигантскую модель на Mac с Apple Silicon. Обзор, сравнение и примеры использ
3366
TextRM-28M: тестируем крошечную модель для бизнес-писем с кодом на GitHub
Обзор TextRM-28M - модели на 28 миллионов параметров для генерации бизнес-писем. Тестируем возможности, сравниваем с альтернативами, примеры кода на Python.
3367
Автоматизация тестирования: как RAG + LLM генерируют Java-тесты в IDE — полный гайд
Пошаговое руководство по настройке RAG и LLM для автоматической генерации JUnit-тестов с Allure-отчетами прямо в вашей IDE. Экономьте часы рутинной работы.
3368
VS Code Autopilot: как автономный ИИ-агент ломает барьеры и почему это страшно
Как режим Bypass Approvals в VS Code Autopilot позволяет ИИ-агенту действовать без подтверждения и какие угрозы это несёт для безопасности кода. Актуально на ма
3369
Как графы знаний решают проблему RAG в юриспруденции: сравнение с векторным поиском и настройка LightRAG
Разбираем, почему векторный RAG проваливается в юриспруденции, как графы знаний решают проблему связей и практическая настройка LightRAG для юридических докумен
3370
Создание консольного чата с LLM на Python: пошаговый гайд по Ollama, LiteLLM и system prompt
Пошаговое создание локального чата с ИИ в терминале на Python. Устанавливаем Ollama, настраиваем LiteLLM, пишем скрипт с system prompt и обработкой ошибок.
3371
Полное руководство по настройке autoresearch на RTX 5090: разбор ошибок, оптимальная конфигурация и бенчмарки
Подробное руководство по установке и настройке autoresearch на видеокарте RTX 5090. Разбор ошибок, оптимальные параметры, тесты производительности на архитектур
3372
Какие модели запускать на RTX 5090: обзор для победителя Nvidia GTC
Выиграли RTX 5090 на Nvidia GTC? Узнайте, какие языковые модели запускать на 24 ГБ GDDR7, как настроить и избежать ошибок. Актуально на март 2026.