Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3361 Attention Residuals от Kimi: как замена сложения вниманием ломает архитектуру трансформеров Новое исследование Kimi: Attention Residuals улучшают LLM на 3-7.5 пунктов и экономят вычисления. Сравнение с DeepSeek mHC и будущее архитектуры трансформеров. 4 мин чтения 3362 SeeQL: Как построить open-source интерфейс для общения с SQL-базой на естественном языке Обзор SeeQL — локального интерфейса для запросов к SQL на русском языке. Технологии OpenUI Lang, MCP server и современные LLM. Установка и примеры. 5 мин чтения 3363 Рефакторинг кода на Java с помощью LLM: практический гайд по миграции Feature Flags Пошаговая инструкция по использованию LLM для автоматической миграции Feature Flags в Java-коде. Готовые промпты, примеры кода до и после, актуальные инструмент 7 мин чтения 3364 Как управлять поведением LLM через активации: патч llama-server и Sparse Autoencoders Полный разбор управления поведением Llama и Mistral через низкоуровневые активации. Патч для llama-server и Sparse Autoencoders для контроля сикофансии и креати 6 мин чтения 3365 Qwen 3.5 397B на Mac: рекорд 93% на MMLU и квантование для MLX Анонс Qwen 3.5 397B с рекордом 93% на MMLU. Квантование для MLX позволяет запустить гигантскую модель на Mac с Apple Silicon. Обзор, сравнение и примеры использ 4 мин чтения 3366 TextRM-28M: тестируем крошечную модель для бизнес-писем с кодом на GitHub Обзор TextRM-28M - модели на 28 миллионов параметров для генерации бизнес-писем. Тестируем возможности, сравниваем с альтернативами, примеры кода на Python. 3 мин чтения 3367 Автоматизация тестирования: как RAG + LLM генерируют Java-тесты в IDE — полный гайд Пошаговое руководство по настройке RAG и LLM для автоматической генерации JUnit-тестов с Allure-отчетами прямо в вашей IDE. Экономьте часы рутинной работы. 7 мин чтения 3368 VS Code Autopilot: как автономный ИИ-агент ломает барьеры и почему это страшно Как режим Bypass Approvals в VS Code Autopilot позволяет ИИ-агенту действовать без подтверждения и какие угрозы это несёт для безопасности кода. Актуально на ма 4 мин чтения 3369 Как графы знаний решают проблему RAG в юриспруденции: сравнение с векторным поиском и настройка LightRAG Разбираем, почему векторный RAG проваливается в юриспруденции, как графы знаний решают проблему связей и практическая настройка LightRAG для юридических докумен 10 мин чтения 3370 Создание консольного чата с LLM на Python: пошаговый гайд по Ollama, LiteLLM и system prompt Пошаговое создание локального чата с ИИ в терминале на Python. Устанавливаем Ollama, настраиваем LiteLLM, пишем скрипт с system prompt и обработкой ошибок. 7 мин чтения 3371 Полное руководство по настройке autoresearch на RTX 5090: разбор ошибок, оптимальная конфигурация и бенчмарки Подробное руководство по установке и настройке autoresearch на видеокарте RTX 5090. Разбор ошибок, оптимальные параметры, тесты производительности на архитектур 6 мин чтения 3372 Какие модели запускать на RTX 5090: обзор для победителя Nvidia GTC Выиграли RTX 5090 на Nvidia GTC? Узнайте, какие языковые модели запускать на 24 ГБ GDDR7, как настроить и избежать ошибок. Актуально на март 2026. 9 мин чтения