Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4365 материалов
01 Open Source AI Game Jam: как прошёл первый джем по созданию игр с открытыми ИИ-моделями Разбор первого Open Source AI Game Jam от Hugging Face: 88 игр за 48 часов, победитель Snip It на Stable Diffusion, финалисты с генетическими алгоритмами и текс 6 мин чтения 02 Stable Diffusion XL на Mac: продвинутая Core ML квантизация для локального запуска Запуск Stable Diffusion XL на Mac без свопинга: сжимаем UNet с 4.8 ГБ до 1.4 ГБ через смешанно-битную палеттизацию Core ML. Пошаговая конвертация, тесты на M1 M 10 мин чтения 03 Дистилляция знаний для сжатия Stable Diffusion: опыт Segmind с SD-Small и SD-Tiny SD-Small и SD-Tiny от Segmind: сжатие Stable Diffusion на 35–55% методом дистилляции знаний. Разбор архитектуры UNet, функция потерь на совпадение выходов, бенч 7 мин чтения 04 Открытый ML и EU AI Act: пять рекомендаций для разработчиков С 2026 года EU AI Act меняет правила для открытого ML. Разбираем пять поправок от Hugging Face, GitHub, Eleuther AI и других: как защитить публичные репозитории 7 мин чтения 05 Эволюция Diffusers за год: как библиотека Hugging Face изменила генеративный ИИ За первый год библиотека Diffusers прошла путь от эксперимента до промышленного стандарта: фотореализм SDXL и DeepFloyd IF, видеогенерация, 3D-модели Shap-E и у 11 мин чтения 06 Llama 2: открытая альтернатива ChatGPT — обзор, возможности и практическое применение Разбираем Llama 2 от Meta: открытая LLM с коммерческой лицензией, сопоставимая с ChatGPT по качеству. Примеры инференса, тонкая настройка с QLoRA на одной GPU, 9 мин чтения 07 Автоматизированный ИИ-телеканал: архитектура, промптинг и непрерывная трансляция на open-source моделях Полный разбор архитектуры автоматизированного ИИ-телеканала на open-source моделях Zeroscope и MusicGen. Готовые схемы генерации сценариев через LLM, промптинга 10 мин чтения 08 DeepSeek поднимает цены: как это меняет рынок локального хостинга AI-моделей DeepSeek изменил тарифы API и урезал бесплатный доступ. Разбираем новые цены, считаем окупаемость локального сервера на GPU NVIDIA и показываем, при каком объём 8 мин чтения 09 Loop Engineering for Cross-References: Как RAG-пайплайны разрешают «см. раздел 7.2» и выдают полные ответы RAG-система отвечает «см. раздел 7.2» вместо фактов? Разбираем архитектуру с контуром обратной связи, которая находит, извлекает и дополняет ответ содержимым пе 7 мин чтения 10 2.36× ускорение prefill на RTX 3090: гибридный CPU offload и батч-тюнинг для MoE моделей Разбираем эксперимент с Qwen3.6-35B-A3B Q6 на 24GB RTX 3090: перенос восьми слоёв MoE-экспертов на CPU позволил увеличить батч с 512 до 1024 и микро-батч с 128 7 мин чтения 11 DeepSeek V4 Flash на Colibri: тест производительности на GPU от 128 ГБ VRAM DeepSeek V4 Flash на Colibri: скорость префилла до 2300 токенов/с на контекстах 200k+, задержка первого токена 4–7 секунд и стоимость $0.09 за миллион токенов. 9 мин чтения 12 Реверс-инжиниринг Huawei S6330 с LLM-агентами: от shell к root за 4 доллара Пошаговый разбор получения shell и root-доступа на коммутаторе Huawei S6330 (V200R021) с использованием LLM-агентов. Как обойти фильтрацию Python в OPS через op 8 мин чтения