Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

577 Архитектура LLM-пайплайна: от свободного текста к исполняемому графу действий на примере D&D-бота Разбираем архитектуру LLM-пайплайна для детерминированной обработки текста: атомизация запроса, роутинг агентов и граф зависимостей на примере D&D-бота. Решаем 7 мин чтения 578 Kimi K3: архитектура, бенчмарки и подводные камни отчета Moonshot AI Детальный разбор Kimi K3 от Moonshot AI: архитектура с 896 экспертами, гибридное внимание KDA/MLA и реальные ограничения. Критика отчёта — ускорение 2,5× без до 6 мин чтения 579 AI-ассистированный реверс-инжиниринг прошивок сетевого оборудования: метод за 3 промпта Практический кейс: LLM-агент Cursor с Composer 2.5 Fast за 3 промпта распаковал прошивку коммутатора SNR-2990X-24FQ, дизассемблировал все бинарники и нашёл скры 8 мин чтения 580 Эволюция спектра возможностей нейросетей: от узких задач к универсальным моделям Как нейросети превращаются в универсальные инструменты: мультимодальность, длинные контексты, агентные способности и снижение цены инференса. Сравнение GPT-5.6 8 мин чтения 581 Запуск Gemma 4 и Qwen 3.6 MoE на APU AMD 6800H: бенчмарки и настройка llama.cpp с Vulkan Реальные бенчмарки Gemma 4 26B и Qwen 3.6 MoE 35B на APU Ryzen 7 6800H с iGPU Radeon 680M. Сравнение NVFP4, Q4_K и Q8_0: скорость до 5.1 t/s, пошаговая сборка l 10 мин чтения 582 Kimi K3 под микроскопом: визуализация графа модели и атлас 896 экспертов в HF Viewer HF Viewer визуализирует полную архитектуру Kimi K3: разбираем граф модели на всех уровнях детализации и публикуем результаты анализа 896 экспертов MoE. Паттерны 9 мин чтения 583 Microsoft MAI-Cyber-1-Flash и Perception: первая специализированная ИИ-модель и агентная платформа для кибербезопасности Детальный разбор MAI-Cyber-1-Flash и Perception от Microsoft: архитектура, бенчмарки Cyber Gym, сравнение с OpenAI и Anthropic, практическое применение для защи 7 мин чтения 584 Утечка данных Claude: почему публичные ссылки на чаты оказались в поиске Google и как защитить свои проекты 26 июля 2026 года сотни приватных чатов Claude с медицинскими записями, юридическими консультациями и корпоративными документами обнаружились в поиске Google и 9 мин чтения 585 Бенчмарк 35B моделей для кодинга: KAT-Coder vs Qwen vs Ornith — 120 прогонов, прозрачная методология и неожиданный лидер по эффективности Сравнили KAT-Coder-V2.5-Dev, Qwen3.5-35B, Qwen3.6-35B и Ornith в 120 прогонах на 6 самопроверяемых задачах. KAT-Coder — 0 ошибок вызовов, 29/30 успех и вдвое ме 6 мин чтения 586 Ninfer: 700+ токенов/с на RTX 5090 — тест кастомного инференса для Qwen 3.6 Тестируем опенсорсный движок Ninfer для RTX 5090: скорость 550–720 токенов/с на Qwen 3.6 27B/35B в однопоточном режиме без батчинга. Сравнение с Cerebras, требо 4 мин чтения 587 Позиция Meta на модели с открытыми весами: анализ стратегии и влияние на рынок AI в 2026 году Детальный разбор официальной позиции Meta по открытым весам: почему компания выбрала этот путь, как LLaMA меняет экономику AI-разработки и какие риски безопасно 14 мин чтения 588 OpenAI отказалась от Open Secure AI Alliance: стратегический разворот или внутренний раскол? OpenAI отказалась от альянса безопасности Дженсена Хуанга — сотрудники в ярости. Почему компания выбрала закрытость, как это связано с инцидентом взлома Hugging 6 мин чтения