Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

433 Bento: презентации в JSON внутри HTML — офлайн-редактор, коллаборация и конвертация PPTX Bento упаковывает презентацию в один HTML-файл (640 КБ) с JSON-ядром, офлайн-редактором и зашифрованной коллаборацией. Конвертируйте PPTX через LLM, работайте б 8 мин чтения 434 Z.ai GLM 5.5: что известно о будущем флагмане до официального анонса Все слухи и утечки о Z.ai GLM 5.5 в одном материале. Предполагаемая дата выхода — август 2026, архитектура MoE с динамическим разрежением, контекст 256K+ и цена 8 мин чтения 435 Оценка AI-агентов для длинных отчётов: кейс Similarweb и уроки внедрения LangSmith Разбираем кейс Similarweb: как оценить качество длинных исследовательских отчётов от AI-агентов с помощью LLM-as-judge, проверки faithfulness и трейсинга в Lang 9 мин чтения 436 Ускорение GLM-5.2 в llama.cpp: поддержка спекулятивного декодирования NextN/MTP В llama.cpp добавлена поддержка спекулятивного декодирования NextN/MTP для GLM-5.2. Метод генерирует несколько токенов за один проход, ускоряя инференс до 2x бе 8 мин чтения 437 Claude Opus 5: разбор бенчмарков, архитектуры усилий и сравнение с Fable 5 — что стоит за лидерством в Artificial Analysis Claude Opus 5 занял первое место в Intelligence Index от Artificial Analysis с 61 баллом, обойдя Fable 5. Разбираем бенчмарки Frontier-Bench, GDPval-AA и ARC-AG 10 мин чтения 438 Разгоняем MoE на CPU: Архитектура для 100 токенов/с на 10B модели Как достичь 100 токенов/с на 10B модели без GPU? Разбираем архитектуру с гранулярным MoE, LUT MLP и троичными весами. Тесты прототипа на Ryzen 3600X: 848 ток./с 8 мин чтения 439 ALNS для задач маршрутизации: решение крупных Pickup-and-Delivery с учётом времени и отдыха водителей Разбираем Adaptive Large Neighborhood Search (ALNS) для сложных задач маршрутизации: операторы разрушения и восстановления, реализация на Python, кейс из нефтег 8 мин чтения 440 Как читать технический отчет Kimi K3: гид по подготовке от основ до архитектуры Пошаговый гид по чтению технического отчета Kimi K3: от линейных трансформеров и Fast Weight Programmers до архитектуры KDA, Stable LatentMoE с 896 экспертами и 7 мин чтения 441 Community Library Creator: как Microsoft передает сообществам контроль над данными для ИИ Microsoft запустила Community Library Creator — платформу, где сообщества сами создают курируемые наборы изображений для обучения ИИ. Узнайте, как это устраняет 8 мин чтения 442 Перенос экспертизы CUDA на Apple Silicon: как K-Search с MLX-бэкендом достигает 97% производительности нативных ядер и 20x ускорения префилла IBM Research и UC Berkeley адаптировали эволюционный фреймворк K-Search для Apple MLX. Автоматически сгенерированное ядро Attention достигает 97% производительн 8 мин чтения 443 AI-агенты, обучающиеся на лучших кейсах продаж: как Encore AI анализирует звонки и CRM Encore AI привлекла $30 млн на платформу, которая анализирует звонки, переписку и CRM для выявления лучших техник продаж. Система формирует плейбуки для AI-аген 6 мин чтения 444 Гонка за локальным AI: почему RTX 5090 достаточно, а серверные карты — удел специфичных задач RTX 5090 закрывает 95% задач локального AI: инференс 70B-моделей, файнтюнинг 13B, генерация изображений. Сравнили с RTX 6000 Ada по бенчмаркам и TCO, разобрали 9 мин чтения