Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2593 Илон Маск проиграл суд: закон о раскрытии данных обучения угрожает xAI Илон Маск проиграл суд против закона Калифорнии AB 2013, требующего раскрытия данных обучения ИИ. Что это значит для xAI, Grok и будущего регулирования. 5 мин чтения 2594 Запуск MoE моделей на SSD: как GLM-5 работает с 1/3 весов на диске благодаря кэшированию Пошаговый гайд по запуску больших MoE-моделей типа GLM-5 с кэшированием весов на SSD. Экономия оперативной памяти до 2/3. Актуально на 11.04.2026. 9 мин чтения 2595 Per-weight mixed precision: ускорение вывода LLM в 2 раза с индивидуальным квантованием весов Глубокое руководство по per-weight mixed precision квантованию. Узнайте, как ускорить вывод больших моделей в 2 раза, сохранив точность. Практическая реализация 9 мин чтения 2596 Исправление tool calling в Qwen 3.5: исчерпывающий Jinja-шаблон и разбор нативных тегов <think> Полный гайд по починке сломанного tool calling в Qwen 3.5. Рабочий Jinja-шаблон, разбор нативных тегов <think> и сравнение с альтернативами на 11.04.2026. 6 мин чтения 2597 Gemma 4 26B A4B: тестирование длинного контекста и стабильность на 94% заполнения Результаты тестирования Gemma 4 26B с квантованием A4B на длинном контексте. Как модель держит стабильность при почти полном заполнении контекстного окна. 5 мин чтения 2598 Сравнение эмбеддинг-моделей Harrier-27B, Voyage-4 и Zembed-1: методика оценки на 24 датасетах Практическое сравнение трех ведущих эмбеддинг-моделей 2026 года. Методология с 24 датасетами и 3 LLM-судьями. Результаты для RAG-систем и бинарной классификации 10 мин чтения 2599 Мега-гид: 550+ бесплатных инструментов для работы с LLM - от локальных моделей до API и IDE Полный гид по 550+ бесплатным инструментам для работы с LLM: локальные модели (Ollama), API (OpenRouter), IDE (Cursor), RAG фреймворки и инструменты разработчик 7 мин чтения 2600 Настройка workflow на двух GPU A100X: когда две карты работают как четыре (или как одна) Экспертная настройка workflow на двух GPU A100X для локальных задач. Разбираем оптимизацию инференса, пайплайна обработки и утилизацию железа с нуля. 8 мин чтения 2601 GLM 5.1: новый китайский лидер в агентских задачах и генерации кода Китайская модель GLM 5.1 от Zhipu AI заняла первое место в рейтинге Code Arena и показывает прорыв в агентских задачах при стоимости в три раза ниже Claude Opus 3 мин чтения 2602 Cross-Encoders и Reranking: тихий геноцид посредственного поиска в RAG Пошаговое руководство по внедрению cross-encoders и reranking в RAG-пайплайн. Код, сравнение моделей, разбор ошибок. Улучшение точности поиска на 30-60%. 7 мин чтения 2603 Ловушки и решения при работе с пользовательскими календарями в Power BI и табличных моделях Глубокий разбор ошибок при работе с календарями в Power BI. Как настроить таблицу дат, избежать интерференции календарей и правильно считать недели. 10 мин чтения 2604 MLOps: как диагностировать режим забывания моделей - шоки против плавной деградации Практический метод на основе R² для определения, как деградирует ваша модель - внезапными шоками или плавно. Пошаговый план внедрения в MLOps. Актуально на 10.0 7 мин чтения