Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
433
Bento: презентации в JSON внутри HTML — офлайн-редактор, коллаборация и конвертация PPTX
Bento упаковывает презентацию в один HTML-файл (640 КБ) с JSON-ядром, офлайн-редактором и зашифрованной коллаборацией. Конвертируйте PPTX через LLM, работайте б
434
Z.ai GLM 5.5: что известно о будущем флагмане до официального анонса
Все слухи и утечки о Z.ai GLM 5.5 в одном материале. Предполагаемая дата выхода — август 2026, архитектура MoE с динамическим разрежением, контекст 256K+ и цена
435
Оценка AI-агентов для длинных отчётов: кейс Similarweb и уроки внедрения LangSmith
Разбираем кейс Similarweb: как оценить качество длинных исследовательских отчётов от AI-агентов с помощью LLM-as-judge, проверки faithfulness и трейсинга в Lang
436
Ускорение GLM-5.2 в llama.cpp: поддержка спекулятивного декодирования NextN/MTP
В llama.cpp добавлена поддержка спекулятивного декодирования NextN/MTP для GLM-5.2. Метод генерирует несколько токенов за один проход, ускоряя инференс до 2x бе
437
Claude Opus 5: разбор бенчмарков, архитектуры усилий и сравнение с Fable 5 — что стоит за лидерством в Artificial Analysis
Claude Opus 5 занял первое место в Intelligence Index от Artificial Analysis с 61 баллом, обойдя Fable 5. Разбираем бенчмарки Frontier-Bench, GDPval-AA и ARC-AG
438
Разгоняем MoE на CPU: Архитектура для 100 токенов/с на 10B модели
Как достичь 100 токенов/с на 10B модели без GPU? Разбираем архитектуру с гранулярным MoE, LUT MLP и троичными весами. Тесты прототипа на Ryzen 3600X: 848 ток./с
439
ALNS для задач маршрутизации: решение крупных Pickup-and-Delivery с учётом времени и отдыха водителей
Разбираем Adaptive Large Neighborhood Search (ALNS) для сложных задач маршрутизации: операторы разрушения и восстановления, реализация на Python, кейс из нефтег
440
Как читать технический отчет Kimi K3: гид по подготовке от основ до архитектуры
Пошаговый гид по чтению технического отчета Kimi K3: от линейных трансформеров и Fast Weight Programmers до архитектуры KDA, Stable LatentMoE с 896 экспертами и
441
Community Library Creator: как Microsoft передает сообществам контроль над данными для ИИ
Microsoft запустила Community Library Creator — платформу, где сообщества сами создают курируемые наборы изображений для обучения ИИ. Узнайте, как это устраняет
442
Перенос экспертизы CUDA на Apple Silicon: как K-Search с MLX-бэкендом достигает 97% производительности нативных ядер и 20x ускорения префилла
IBM Research и UC Berkeley адаптировали эволюционный фреймворк K-Search для Apple MLX. Автоматически сгенерированное ядро Attention достигает 97% производительн
443
AI-агенты, обучающиеся на лучших кейсах продаж: как Encore AI анализирует звонки и CRM
Encore AI привлекла $30 млн на платформу, которая анализирует звонки, переписку и CRM для выявления лучших техник продаж. Система формирует плейбуки для AI-аген
444
Гонка за локальным AI: почему RTX 5090 достаточно, а серверные карты — удел специфичных задач
RTX 5090 закрывает 95% задач локального AI: инференс 70B-моделей, файнтюнинг 13B, генерация изображений. Сравнили с RTX 6000 Ada по бенчмаркам и TCO, разобрали