Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4365
материалов
01
Open Source AI Game Jam: как прошёл первый джем по созданию игр с открытыми ИИ-моделями
Разбор первого Open Source AI Game Jam от Hugging Face: 88 игр за 48 часов, победитель Snip It на Stable Diffusion, финалисты с генетическими алгоритмами и текс
02
Stable Diffusion XL на Mac: продвинутая Core ML квантизация для локального запуска
Запуск Stable Diffusion XL на Mac без свопинга: сжимаем UNet с 4.8 ГБ до 1.4 ГБ через смешанно-битную палеттизацию Core ML. Пошаговая конвертация, тесты на M1 M
03
Дистилляция знаний для сжатия Stable Diffusion: опыт Segmind с SD-Small и SD-Tiny
SD-Small и SD-Tiny от Segmind: сжатие Stable Diffusion на 35–55% методом дистилляции знаний. Разбор архитектуры UNet, функция потерь на совпадение выходов, бенч
04
Открытый ML и EU AI Act: пять рекомендаций для разработчиков
С 2026 года EU AI Act меняет правила для открытого ML. Разбираем пять поправок от Hugging Face, GitHub, Eleuther AI и других: как защитить публичные репозитории
05
Эволюция Diffusers за год: как библиотека Hugging Face изменила генеративный ИИ
За первый год библиотека Diffusers прошла путь от эксперимента до промышленного стандарта: фотореализм SDXL и DeepFloyd IF, видеогенерация, 3D-модели Shap-E и у
06
Llama 2: открытая альтернатива ChatGPT — обзор, возможности и практическое применение
Разбираем Llama 2 от Meta: открытая LLM с коммерческой лицензией, сопоставимая с ChatGPT по качеству. Примеры инференса, тонкая настройка с QLoRA на одной GPU,
07
Автоматизированный ИИ-телеканал: архитектура, промптинг и непрерывная трансляция на open-source моделях
Полный разбор архитектуры автоматизированного ИИ-телеканала на open-source моделях Zeroscope и MusicGen. Готовые схемы генерации сценариев через LLM, промптинга
08
DeepSeek поднимает цены: как это меняет рынок локального хостинга AI-моделей
DeepSeek изменил тарифы API и урезал бесплатный доступ. Разбираем новые цены, считаем окупаемость локального сервера на GPU NVIDIA и показываем, при каком объём
09
Loop Engineering for Cross-References: Как RAG-пайплайны разрешают «см. раздел 7.2» и выдают полные ответы
RAG-система отвечает «см. раздел 7.2» вместо фактов? Разбираем архитектуру с контуром обратной связи, которая находит, извлекает и дополняет ответ содержимым пе
10
2.36× ускорение prefill на RTX 3090: гибридный CPU offload и батч-тюнинг для MoE моделей
Разбираем эксперимент с Qwen3.6-35B-A3B Q6 на 24GB RTX 3090: перенос восьми слоёв MoE-экспертов на CPU позволил увеличить батч с 512 до 1024 и микро-батч с 128
11
DeepSeek V4 Flash на Colibri: тест производительности на GPU от 128 ГБ VRAM
DeepSeek V4 Flash на Colibri: скорость префилла до 2300 токенов/с на контекстах 200k+, задержка первого токена 4–7 секунд и стоимость $0.09 за миллион токенов.
12
Реверс-инжиниринг Huawei S6330 с LLM-агентами: от shell к root за 4 доллара
Пошаговый разбор получения shell и root-доступа на коммутаторе Huawei S6330 (V200R021) с использованием LLM-агентов. Как обойти фильтрацию Python в OPS через op