Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4376
материалов
01
Запуск Qwen 3.6 35B MoE на Xiaomi 12 Pro: реальная скорость, ограничения и перспективы BigMoeOnEdge
Qwen 3.6 35B MoE запущена на Xiaomi 12 Pro через BigMoeOnEdge: генерация 2.4 токена/с, префилл 4.4 токена/с, контекст до 8192 токенов. Детальный разбор распреде
02
SINN: как спектрально-информированная нейросеть решает многомерные PDE точнее на 99.6%
SINN от AIRI и Сколтеха: спектрально-информированная нейросеть для многомерных PDE. Улучшение точности до 99.6% на уравнении Шрёдингера. Обходит PirateNets и Na
03
Борьба с оптимизатором: как в C++ гарантировать вызов инициализации с помощью инлайн-ассемблера
GCC 14.2 с LTO вырезает extern-зависимости и InitToken при статической инициализации. Разбираем рабочий метод с asm volatile и статическим полем класса, который
04
Как запускать кодинг-агентов на Claude Code более 24 часов: 4 рабочих подхода
Четыре рабочих подхода для непрерывной работы кодинг-агентов Claude Code и Codex более 24 часов: sandbox-изоляция с root-доступом, автоматическая верификация ко
05
Как с помощью ИИ создавать продающие фото товаров для маркетплейсов: готовые промпты и чек-лист
Готовые промпты для генерации фото товаров через ИИ: студийные пэкшоты, лайфстайл-креативы и сезонные баннеры. Чек-лист оценки качества, сравнение ChatGPT Image
06
Архитектура Kimi K3: Stable LatentMoE, Gated MLA и другие техники SOTA-модели
Детальный разбор четырёх ключевых технологий Kimi K3: Stable LatentMoE с Quantile Balancing, Gated MLA как модификация KV-компрессии DeepSeek, KimiDeltaAttentio
07
YouTube против AI-ферм: как новые правила монетизации 2026 изменят правила игры
С 16 июля 2026 YouTube вводит три категории неаутентичного контента, запрещенного к монетизации: шаблонные AI-видео, эмоциональные манипуляции и AI-персоны в чу
08
Запуск ASR-модели на ESP32-S3 за $10: архитектура, квантизация и реальные ограничения
Портирование 13.1M-параметрической Conformer ASR-модели на ESP32-S3 за $10: дистилляция, INT8-квантизация, аппаратное ускорение и реальные цифры WER. Инференс 8
09
Qwen 3.8 Max Preview: Эффективность токенов и системный анализ против Minimax M3 и GPT 5.6
Qwen 3.8 Max Preview снижает расход входных токенов на 35-40% в многошаговых задачах по сравнению с Minimax M3 и GPT 5.6. Системный анализ, цифры из LangSmith и
10
Сравнение SVG-генерации флагманских AI-моделей: кто лучше анимирует сложные сцены?
Свежий тест SVG-генерации: сравниваем GPT-4o, Gemini 2.0 Flash, DeepSeek-V3, Kimi K3 и Qwen 3.8 на анимированной сцене с фламинго и лунной походкой. Оценки визу
11
Управляемые AI-агенты в enterprise: как LLM gateway обеспечивает контроль, безопасность и compliance
Как внедрить управляемых AI-агентов в enterprise без риска утечек и неконтролируемых расходов. Разбираем архитектуру LLM gateway, три сценария governance и прак
12
IssueBench: как LangChain измеряет качество агента-диагноста с помощью синтетического бенчмарка
Разбираем IssueBench — синтетический бенчмарк LangChain для оценки агента-диагноста LangSmith Engine. 15 задач в трёх доменах, четыре критерия оценки, кросс-дом