Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6445 Marble World Labs: Fei-Fei Li превращает Gaussian Splatting в конструктор 3D-миров Как Fei-Fei Li и Marble World Labs используют Gaussian Splatting и NeRF для мгновенной генерации 3D-миров. Экспорт в Unity, VR, сравнение с альтернативами. 5 мин чтения 6446 Лаборатория в коде: как когнитивная ОС превращает LLM из чат-игрушки в думающего коллегу Обзор TypeScript-фреймворка с многослойным мышлением, реляционным графом памяти и интеграцией LM Studio. Замена векторным базам и статусным чатам. 7 мин чтения 6447 Claude Code течет как решето: что на самом деле уходит в облако при 'локальном' запуске Проверка сетевого трафика Claude Code. Какие данные отправляются в Anthropic при локальном использовании и как полностью отключить облачные соединения. 7 мин чтения 6448 Запускаем Claude Code локально с GLM-4.7 Flash: полный гайд с Docker и автовыгрузкой VRAM Пошаговый гайд по запуску GLM-4.7 Flash локально через llama.cpp server с Docker, автовыгрузкой VRAM и полной заменой Claude Code API. Конфигурация, параметры, 9 мин чтения 6449 Как настроить observability для LLM-агентов: трассировка, мониторинг затрат и анализ производительности с Langfuse Полное руководство по настройке observability для LLM-агентов в 2026 году. Трассировка, мониторинг токенов, анализ стоимости и производительности с Langfuse. 11 мин чтения 6450 AI Gateway против кастомных решений: Vercel, LiteLLM и OpenRouter для продакшн-приложений Полное техническое сравнение AI Gateway решений для продакшн-приложений. Vercel AI Gateway, LiteLLM и OpenRouter: архитектура, ограничения и streaming-консистен 7 мин чтения 6451 Заклинание драконов: как заставить NVIDIA и Intel ARC работать вместе для LLM Полное руководство по запуску LLM на смешанных GPU. Pipeline и tensor параллелизм, распределение нагрузки, оценка оверхеда, актуальные инструменты на 2026 год. 8 мин чтения 6452 SGLang против vLLM: битва за миллисекунды в инференсе LLM Полный разбор SGLang (RadixArk) и vLLM: архитектура, производительность, настройка для высоконагруженных LLM-систем. Актуально на январь 2026. 8 мин чтения 6453 Рынок чипов для ИИ в 2025: как NVIDIA, Intel и Groq перекроили доступность железа для локальных LLM Анализ рынка чипов для ИИ в 2025: как события у NVIDIA, Intel и Groq повлияли на цены и доступность GPU для локальных языковых моделей. Экспортные ограничения, 6 мин чтения 6454 Ephemeral vs Ray: Сравнение подходов к загрузке моделей и утилизации GPU в продакшене Глубокий разбор двух архитектур для AI-инференса: эфемерные модели против оркестрации Ray. Как поднять утилизацию GPU с 15% до 85% и убить холодные старты. 9 мин чтения 6455 Constitutional AI Антропик: как работает обновлённая «Конституция» Клода и причём тут сознание Как Anthropic обновила Constitutional AI для Claude в 2026 году. Принципы работы, связь с сознанием ИИ и почему это важно для безопасности. 6 мин чтения 6456 Тестирование RK3588 NPU vs Raspberry Pi 5: реальная производительность Llama 3.1, Qwen и DeepSeek Сравнительный тест RK3588 NPU и Raspberry Pi 5 для запуска Llama 3.1, Qwen и DeepSeek. Реальные цифры токенов в секунду, проблемы конвертации и выбор платформы. 6 мин чтения