Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6445
Marble World Labs: Fei-Fei Li превращает Gaussian Splatting в конструктор 3D-миров
Как Fei-Fei Li и Marble World Labs используют Gaussian Splatting и NeRF для мгновенной генерации 3D-миров. Экспорт в Unity, VR, сравнение с альтернативами.
6446
Лаборатория в коде: как когнитивная ОС превращает LLM из чат-игрушки в думающего коллегу
Обзор TypeScript-фреймворка с многослойным мышлением, реляционным графом памяти и интеграцией LM Studio. Замена векторным базам и статусным чатам.
6447
Claude Code течет как решето: что на самом деле уходит в облако при 'локальном' запуске
Проверка сетевого трафика Claude Code. Какие данные отправляются в Anthropic при локальном использовании и как полностью отключить облачные соединения.
6448
Запускаем Claude Code локально с GLM-4.7 Flash: полный гайд с Docker и автовыгрузкой VRAM
Пошаговый гайд по запуску GLM-4.7 Flash локально через llama.cpp server с Docker, автовыгрузкой VRAM и полной заменой Claude Code API. Конфигурация, параметры,
6449
Как настроить observability для LLM-агентов: трассировка, мониторинг затрат и анализ производительности с Langfuse
Полное руководство по настройке observability для LLM-агентов в 2026 году. Трассировка, мониторинг токенов, анализ стоимости и производительности с Langfuse.
6450
AI Gateway против кастомных решений: Vercel, LiteLLM и OpenRouter для продакшн-приложений
Полное техническое сравнение AI Gateway решений для продакшн-приложений. Vercel AI Gateway, LiteLLM и OpenRouter: архитектура, ограничения и streaming-консистен
6451
Заклинание драконов: как заставить NVIDIA и Intel ARC работать вместе для LLM
Полное руководство по запуску LLM на смешанных GPU. Pipeline и tensor параллелизм, распределение нагрузки, оценка оверхеда, актуальные инструменты на 2026 год.
6452
SGLang против vLLM: битва за миллисекунды в инференсе LLM
Полный разбор SGLang (RadixArk) и vLLM: архитектура, производительность, настройка для высоконагруженных LLM-систем. Актуально на январь 2026.
6453
Рынок чипов для ИИ в 2025: как NVIDIA, Intel и Groq перекроили доступность железа для локальных LLM
Анализ рынка чипов для ИИ в 2025: как события у NVIDIA, Intel и Groq повлияли на цены и доступность GPU для локальных языковых моделей. Экспортные ограничения,
6454
Ephemeral vs Ray: Сравнение подходов к загрузке моделей и утилизации GPU в продакшене
Глубокий разбор двух архитектур для AI-инференса: эфемерные модели против оркестрации Ray. Как поднять утилизацию GPU с 15% до 85% и убить холодные старты.
6455
Constitutional AI Антропик: как работает обновлённая «Конституция» Клода и причём тут сознание
Как Anthropic обновила Constitutional AI для Claude в 2026 году. Принципы работы, связь с сознанием ИИ и почему это важно для безопасности.
6456
Тестирование RK3588 NPU vs Raspberry Pi 5: реальная производительность Llama 3.1, Qwen и DeepSeek
Сравнительный тест RK3588 NPU и Raspberry Pi 5 для запуска Llama 3.1, Qwen и DeepSeek. Реальные цифры токенов в секунду, проблемы конвертации и выбор платформы.