Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
1645
MTP merging в llama.cpp: как ускорение мульти-токен предикшена изменит локальный инференс
Разбираемся, как слияние PR Multi-Token Prediction в llama.cpp ускоряет генерацию на 30-50% и меняет правила игры для локальных LLM.
1646
Как заставить LLM перестать подлизываться: sycophancy, fine-tuning и наш опыт
Sycophancy — главная проблема LLM: модели льстят, а не говорят правду. Разбираем причины, методы fine-tuning и даем работающие рецепты на основе Llama 4, Mistra
1647
Рефлексия Claude Opus о промпт-инжиниринге: 4 ключевых инсайта для эффективной работы с LLM
Узнайте 4 ключевых инсайта от Claude Opus (май 2026) о том, как на самом деле работают промпты и как общаться с LLM максимально эффективно.
1648
Полностью офлайн робот на Jetson Orin и Gemma 4: как собрать, производительность и архитектура
Пошаговый гайд по созданию автономного робота на Jetson Orin NX с локальной Gemma 4 VLA 12B. Измеренная задержка ~200ms, 30+ сенсоров, полная автономность без о
1649
Архитектура AI-копирайтера на базе Notion, RAG и Telegram: автоматизация контента для ресторанной сети
Разбираем архитектуру AI-копирайтера для ресторанной сети: Notion как база знаний, RAG для генерации, Telegram-бот для запросов. Полный гайд с кодом и нюансами.
1650
Orthrus-Qwen3-8B: 7.8x ускорение инференса без потери качества на локальном GPU
Как ускорить Qwen3-8B в 7.8 раз с сохранением точности 100%? Orthrus — speculative decoding с frozen backbone. Пошаговый гайд для локального запуска LLM.
1651
Axera AX650N на стероидах: как китайский SoC за $100 уделывает Jetson в YOLO, Depth Anything и Qwen3
Полный бенчмарк платы MaiX4 Hat на Axera AX650N: 36.8 TOPS NPU, YOLOv12 (140 fps), Depth Anything v3 (87 fps), Qwen3-1.8B (23 tok/s). Сравнение с Jetson Orin Na
1652
Waypoint-1.5: интерактивные миры на обычных GPU – обзор и запуск на RTX 3090-5090
Полный обзор Waypoint-1.5 — модели, превращающей текст в интерактивные 3D-миры на потребительских GPU. Тесты на RTX 3090, 4090, 5090, сравнение с аналогами, инс
1653
Anthropic расширяет Claude Code: новые лимиты и доступ к суперкомпьютеру SpaceX
Anthropic удваивает rate limits для Claude Code и открывает доступ к GPU-кластеру SpaceX Colossus с 220k чипов. Подробности и даты.
1654
Grapheteria и другие: обзор опенсорсных GUI для управления AI-агентами
Обзор Grapheteria — визуального конструктора агентов с MCP-серверами. Сравнение с Agno, AgentCommander, OpenAgent и UI-TARS. Кому подойдут и как упрощают жизнь.
1655
Claude решил задачу Кнута за час: как OpenArx меняет научную инфраструктуру
Дональд Кнут признал мощь Claude: нейросеть за час решила его задачу благодаря OpenArx — открытой MCP-инфраструктуре. Как это изменит научные исследования?
1656
Локальный Qwen 3.6 против топовых моделей: тест на генерацию HTML Canvas анимации — результаты и GIF
Сравнение Qwen 3.6, GPT-4o, Claude 4, Gemini 3 в генерации HTML Canvas анимации. Результаты, GIF, пошаговый запуск локально. Что выбрал DevOps.