Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4371
материалов
01
Inflect v2: Пайплайн для тонкой настройки малых TTS-моделей под голос и новый язык
Открытый пайплайн Inflect v2 для supervised adaptation малых TTS-моделей (Nano 3.96M, Micro 9.36M) под новый голос и язык. Warm-start, автооценка, экспорт в PyT
02
Как Guardoc Health использует Amazon Nova для обработки медицинской документации: точность, снижение затрат и соответствие требованиям
Разбор архитектуры пайплайна Guardoc Health: Amazon Textract, Titan Embeddings и Nova Pro для анализа клинической документации. Результаты: -46% ошибок, -70% шт
03
IAM Temporary Delegation: как Deepgram ускорила поддержку SageMaker AI и отказалась от screen-share
Разбираем, как Deepgram внедрила IAM Temporary Delegation для кратковременного доступа к эндпоинтам SageMaker AI. Пошаговый процесс, сравнение с традиционными м
04
Архитектура LLM-пайплайна: от свободного текста к исполняемому графу действий на примере D&D-бота
Разбираем архитектуру LLM-пайплайна для детерминированной обработки текста: атомизация запроса, роутинг агентов и граф зависимостей на примере D&D-бота. Решаем
05
Kimi K3: архитектура, бенчмарки и подводные камни отчета Moonshot AI
Детальный разбор Kimi K3 от Moonshot AI: архитектура с 896 экспертами, гибридное внимание KDA/MLA и реальные ограничения. Критика отчёта — ускорение 2,5× без до
06
AI-ассистированный реверс-инжиниринг прошивок сетевого оборудования: метод за 3 промпта
Практический кейс: LLM-агент Cursor с Composer 2.5 Fast за 3 промпта распаковал прошивку коммутатора SNR-2990X-24FQ, дизассемблировал все бинарники и нашёл скры
07
Эволюция спектра возможностей нейросетей: от узких задач к универсальным моделям
Как нейросети превращаются в универсальные инструменты: мультимодальность, длинные контексты, агентные способности и снижение цены инференса. Сравнение GPT-5.6
08
Запуск Gemma 4 и Qwen 3.6 MoE на APU AMD 6800H: бенчмарки и настройка llama.cpp с Vulkan
Реальные бенчмарки Gemma 4 26B и Qwen 3.6 MoE 35B на APU Ryzen 7 6800H с iGPU Radeon 680M. Сравнение NVFP4, Q4_K и Q8_0: скорость до 5.1 t/s, пошаговая сборка l
09
Kimi K3 под микроскопом: визуализация графа модели и атлас 896 экспертов в HF Viewer
HF Viewer визуализирует полную архитектуру Kimi K3: разбираем граф модели на всех уровнях детализации и публикуем результаты анализа 896 экспертов MoE. Паттерны
10
Microsoft MAI-Cyber-1-Flash и Perception: первая специализированная ИИ-модель и агентная платформа для кибербезопасности
Детальный разбор MAI-Cyber-1-Flash и Perception от Microsoft: архитектура, бенчмарки Cyber Gym, сравнение с OpenAI и Anthropic, практическое применение для защи
11
Утечка данных Claude: почему публичные ссылки на чаты оказались в поиске Google и как защитить свои проекты
26 июля 2026 года сотни приватных чатов Claude с медицинскими записями, юридическими консультациями и корпоративными документами обнаружились в поиске Google и
12
Бенчмарк 35B моделей для кодинга: KAT-Coder vs Qwen vs Ornith — 120 прогонов, прозрачная методология и неожиданный лидер по эффективности
Сравнили KAT-Coder-V2.5-Dev, Qwen3.5-35B, Qwen3.6-35B и Ornith в 120 прогонах на 6 самопроверяемых задачах. KAT-Coder — 0 ошибок вызовов, 29/30 успех и вдвое ме