Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4407 материалов
01 Провал и успех: почему статистический синтез данных для Hinglish LLM даёт качество 0.69 и что делать Почему GaussianCopula даёт AUC 0.95, но качество Hinglish LLM всего 0.6897. Практический гайд по синтезу данных для индийских языков в 2026 году. 7 мин чтения 02 Обзор LLM для геймдизайна: какие модели запустить на MacBook Pro M4 и стоит ли бояться китайских аналогов Подробный гайд по выбору локальных LLM для геймдизайна на MacBook Pro M4. Сравнение Qwen, DeepSeek, GLM, тесты производительности и советы по китайским моделям. 5 мин чтения 03 Выравнивание LLM: от RLHF до DPO, SimPO и KTO — что выбрать в 2026 году Полное руководство по методам выравнивания языковых моделей. Сравнение RLHF, DPO, SimPO, KTO, GRPO. Какой метод выбрать для вашего проекта в 2026 году. 8 мин чтения 04 Как создать локальный переводчик команд CLI на Gemma 3: тонкая настройка QLoRA, тесты на Docker и сравнение 1B/4B моделей Пошаговый гайд по созданию локального переводчика Docker команд с помощью тонкой настройки Gemma 3 1B и 4B через QLoRA. Тесты скорости, сравнение точности 76% v 10 мин чтения 05 Параметр strict в VLLM и llama.cpp: почему он ничего не делает и как с этим жить Разбираемся, почему параметр strict в VLLM и llama.cpp не работает, как обойти проблемы с tool calling и заставить модели генерировать валидный JSON в 2026 году 6 мин чтения 06 GPU-as-a-Service на своем железе: строим корпоративную ML-платформу на Cisco UCS и OpenShift Пошаговый гайд по созданию внутренней GPU-as-a-Service платформы на Cisco UCS C845A, NVIDIA RTX PRO 6000 Blackwell и Single Node OpenShift. Self-service инфраст 9 мин чтения 07 Как заставить ИИ писать как ТАСС, Медуза или VC: полный разбор стилизации LLM через RAG и промпты Пошаговый разбор: как научить GPT-4, Claude 3.5 или локальную модель писать в стиле конкретного издания. RAG против файн-тюнинга, промпты, корпус текстов, ошибк 10 мин чтения 08 Как создать стабильный runtime для AI-агентов: архитектура промежуточного слоя между ИИ и ОС Глубокий разбор архитектуры runtime для AI-агентов: как создать стабильный промежуточный слой между LLM и операционной системой для детерминизма и безопасности. 11 мин чтения 09 Strix Halo для разработки: замена облачным ИИ-сервисам на примере Qwen3-Coder-Next 80B Полный гайд по замене Claude Codex на локальный Qwen3-Coder-Next 80B на Strix Halo. Контекст 128K, реальные тесты, настройка, сравнение с RTX 3090. 9 мин чтения 10 Собираем ПК за $1300 для локального ИИ: разбираем сборку от Gemini и показываем реальные альтернативы Подробный разбор сборки ПК за $1300 для запуска LLM локально. Анализируем рекомендации Gemini, проверяем совместимость на PCPartPicker, показываем реальные альт 8 мин чтения 11 MCP-сервер для проверки доменов: интеграция с Cursor и автоматизация подбора свободных имён Пошаговый гайд по созданию MCP-сервера для проверки доменов через Cursor. Автоматизация WHOIS-запросов, подбор свободных имён, конфигурация mcp.json на 2026 год 9 мин чтения 12 Семантический граф знаний из юридических документов: от австралийского права до ваших данных Пошаговый гайд по созданию семантического графа знаний из юридических документов с Kanon 2 Enricher и австралийским правом. Извлечение цитат, нормализация, эмбе 11 мин чтения