Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1645 MTP merging в llama.cpp: как ускорение мульти-токен предикшена изменит локальный инференс Разбираемся, как слияние PR Multi-Token Prediction в llama.cpp ускоряет генерацию на 30-50% и меняет правила игры для локальных LLM. 5 мин чтения 1646 Как заставить LLM перестать подлизываться: sycophancy, fine-tuning и наш опыт Sycophancy — главная проблема LLM: модели льстят, а не говорят правду. Разбираем причины, методы fine-tuning и даем работающие рецепты на основе Llama 4, Mistra 1 мин чтения 1647 Рефлексия Claude Opus о промпт-инжиниринге: 4 ключевых инсайта для эффективной работы с LLM Узнайте 4 ключевых инсайта от Claude Opus (май 2026) о том, как на самом деле работают промпты и как общаться с LLM максимально эффективно. 5 мин чтения 1648 Полностью офлайн робот на Jetson Orin и Gemma 4: как собрать, производительность и архитектура Пошаговый гайд по созданию автономного робота на Jetson Orin NX с локальной Gemma 4 VLA 12B. Измеренная задержка ~200ms, 30+ сенсоров, полная автономность без о 7 мин чтения 1649 Архитектура AI-копирайтера на базе Notion, RAG и Telegram: автоматизация контента для ресторанной сети Разбираем архитектуру AI-копирайтера для ресторанной сети: Notion как база знаний, RAG для генерации, Telegram-бот для запросов. Полный гайд с кодом и нюансами. 7 мин чтения 1650 Orthrus-Qwen3-8B: 7.8x ускорение инференса без потери качества на локальном GPU Как ускорить Qwen3-8B в 7.8 раз с сохранением точности 100%? Orthrus — speculative decoding с frozen backbone. Пошаговый гайд для локального запуска LLM. 5 мин чтения 1651 Axera AX650N на стероидах: как китайский SoC за $100 уделывает Jetson в YOLO, Depth Anything и Qwen3 Полный бенчмарк платы MaiX4 Hat на Axera AX650N: 36.8 TOPS NPU, YOLOv12 (140 fps), Depth Anything v3 (87 fps), Qwen3-1.8B (23 tok/s). Сравнение с Jetson Orin Na 6 мин чтения 1652 Waypoint-1.5: интерактивные миры на обычных GPU – обзор и запуск на RTX 3090-5090 Полный обзор Waypoint-1.5 — модели, превращающей текст в интерактивные 3D-миры на потребительских GPU. Тесты на RTX 3090, 4090, 5090, сравнение с аналогами, инс 6 мин чтения 1653 Anthropic расширяет Claude Code: новые лимиты и доступ к суперкомпьютеру SpaceX Anthropic удваивает rate limits для Claude Code и открывает доступ к GPU-кластеру SpaceX Colossus с 220k чипов. Подробности и даты. 1 мин чтения 1654 Grapheteria и другие: обзор опенсорсных GUI для управления AI-агентами Обзор Grapheteria — визуального конструктора агентов с MCP-серверами. Сравнение с Agno, AgentCommander, OpenAgent и UI-TARS. Кому подойдут и как упрощают жизнь. 5 мин чтения 1655 Claude решил задачу Кнута за час: как OpenArx меняет научную инфраструктуру Дональд Кнут признал мощь Claude: нейросеть за час решила его задачу благодаря OpenArx — открытой MCP-инфраструктуре. Как это изменит научные исследования? 3 мин чтения 1656 Локальный Qwen 3.6 против топовых моделей: тест на генерацию HTML Canvas анимации — результаты и GIF Сравнение Qwen 3.6, GPT-4o, Claude 4, Gemini 3 в генерации HTML Canvas анимации. Результаты, GIF, пошаговый запуск локально. Что выбрал DevOps. 7 мин чтения