Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4377 материалов
01 Инференс 550B-модели на устаревших GPU: сборка из AMD MI50 и NVIDIA P40 через RPC Запуск Nemotron Ultra 550B на гетерогенном кластере из AMD MI50 и NVIDIA P40 через 100GbE RPC: реальные бенчмарки throughput до 126K токенов, настройка pipeline 10 мин чтения 02 Квантизация Laguna S 2.1 через Unsloth: гайд по 4-bit и 8-bit для быстрого инференса Запустите Laguna S 2.1 на одной видеокарте: практическое руководство по 4-bit и 8-bit квантизации через Unsloth с готовыми конфигами, тестами перплексии и замер 8 мин чтения 03 Когда MTP ускоряет, а когда тормозит: бенчмарк Qwen3.6-27B NVFP4 на одной и двух RTX 5090 Практический бенчмарк Multi-Token Prediction (MTP) для Qwen3.6-27B NVFP4 на RTX 5090 с vLLM. Узнайте, когда MTP даёт +82% скорости, а при каких нагрузках его лу 7 мин чтения 04 Воспроизводимое LoRA-дообучение OpenVLA в Colab: пошаговое руководство с проверкой метрик Запустите LoRA-дообучение OpenVLA на датасете LIBERO spatial за 20 минут в Google Colab. Пошаговая инструкция с кодом, интерпретацией метрик (train_loss, l1_los 8 мин чтения 05 Pi 0.81.0: нативная поддержка llama.cpp — как это упрощает работу с моделями в 2026 Релиз pi 0.81.0 с нативной поддержкой llama-server router убирает ручную правку конфигов и заменяет расширение huggingface/pi-llama. Разбираем, как это сокращае 8 мин чтения 06 Прототипирование интерфейсов с помощью ИИ: руководство для системного аналитика 2026 Как системному аналитику создавать кликабельные HTML/CSS/JS прототипы за 30 минут с помощью Vercel v0, Claude Artifacts и GPT-4o. Практическое руководство с гот 10 мин чтения 07 Личный ИИ-агент как новый член семьи: почему Claude Code и Codex — лишь первый шаг Claude Code и Codex заперты в IDE, а личные ИИ-агенты живут в мессенджере, помнят контекст и управляют проектами 24/7. Реальный опыт Openclaw, архитектурные отл 7 мин чтения 08 Сравнительный тест малых MoE-моделей в генерации кода: кто лучше напишет симулятор полета? Сравнили 7 компактных MoE-моделей (26B–35B) в задаче генерации симулятора полета на HTML. Qwen3.6-27B лидирует с первой попытки, Gemma-4-26B и DeepSeek-V2-Lite 10 мин чтения 09 Система управления знаниями в AI-эру: практическое руководство для стартапов и команд разработки Пошаговое руководство по созданию системы управления знаниями для команд, работающих с AI-агентами. Нейробаза, выбор хранилища (ECS, графы, векторы), безопаснос 6 мин чтения 10 Полная наблюдаемость голосовых AI-агентов через LangSmith: практический обзор интеграций Как добавить мониторинг голосовых AI-агентов через LangSmith: захват аудио, замер задержек STT и TTS, фиксация прерываний и вызовов инструментов в едином трейсе 9 мин чтения 11 Language Model Builder: Бесплатное Mac-приложение для обучения LLM с нуля Felix Rieseberg выпустил бесплатное Mac-приложение для обучения языковых моделей с нуля. Узнайте, как за неделю на MacBook Pro M5 Max получить модель уровня GPT 6 мин чтения 12 Gemini 3.5 Flash Cyber: легковесная модель Google для автоматического поиска уязвимостей Gemini 3.5 Flash Cyber от Google — легковесная LLM, которая находит RCE и ошибки памяти в production-коде за 2 часа. 55 подтверждённых уязвимостей в движке V8, 7 мин чтения