Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
577
Архитектура LLM-пайплайна: от свободного текста к исполняемому графу действий на примере D&D-бота
Разбираем архитектуру LLM-пайплайна для детерминированной обработки текста: атомизация запроса, роутинг агентов и граф зависимостей на примере D&D-бота. Решаем
578
Kimi K3: архитектура, бенчмарки и подводные камни отчета Moonshot AI
Детальный разбор Kimi K3 от Moonshot AI: архитектура с 896 экспертами, гибридное внимание KDA/MLA и реальные ограничения. Критика отчёта — ускорение 2,5× без до
579
AI-ассистированный реверс-инжиниринг прошивок сетевого оборудования: метод за 3 промпта
Практический кейс: LLM-агент Cursor с Composer 2.5 Fast за 3 промпта распаковал прошивку коммутатора SNR-2990X-24FQ, дизассемблировал все бинарники и нашёл скры
580
Эволюция спектра возможностей нейросетей: от узких задач к универсальным моделям
Как нейросети превращаются в универсальные инструменты: мультимодальность, длинные контексты, агентные способности и снижение цены инференса. Сравнение GPT-5.6
581
Запуск Gemma 4 и Qwen 3.6 MoE на APU AMD 6800H: бенчмарки и настройка llama.cpp с Vulkan
Реальные бенчмарки Gemma 4 26B и Qwen 3.6 MoE 35B на APU Ryzen 7 6800H с iGPU Radeon 680M. Сравнение NVFP4, Q4_K и Q8_0: скорость до 5.1 t/s, пошаговая сборка l
582
Kimi K3 под микроскопом: визуализация графа модели и атлас 896 экспертов в HF Viewer
HF Viewer визуализирует полную архитектуру Kimi K3: разбираем граф модели на всех уровнях детализации и публикуем результаты анализа 896 экспертов MoE. Паттерны
583
Microsoft MAI-Cyber-1-Flash и Perception: первая специализированная ИИ-модель и агентная платформа для кибербезопасности
Детальный разбор MAI-Cyber-1-Flash и Perception от Microsoft: архитектура, бенчмарки Cyber Gym, сравнение с OpenAI и Anthropic, практическое применение для защи
584
Утечка данных Claude: почему публичные ссылки на чаты оказались в поиске Google и как защитить свои проекты
26 июля 2026 года сотни приватных чатов Claude с медицинскими записями, юридическими консультациями и корпоративными документами обнаружились в поиске Google и
585
Бенчмарк 35B моделей для кодинга: KAT-Coder vs Qwen vs Ornith — 120 прогонов, прозрачная методология и неожиданный лидер по эффективности
Сравнили KAT-Coder-V2.5-Dev, Qwen3.5-35B, Qwen3.6-35B и Ornith в 120 прогонах на 6 самопроверяемых задачах. KAT-Coder — 0 ошибок вызовов, 29/30 успех и вдвое ме
586
Ninfer: 700+ токенов/с на RTX 5090 — тест кастомного инференса для Qwen 3.6
Тестируем опенсорсный движок Ninfer для RTX 5090: скорость 550–720 токенов/с на Qwen 3.6 27B/35B в однопоточном режиме без батчинга. Сравнение с Cerebras, требо
587
Позиция Meta на модели с открытыми весами: анализ стратегии и влияние на рынок AI в 2026 году
Детальный разбор официальной позиции Meta по открытым весам: почему компания выбрала этот путь, как LLaMA меняет экономику AI-разработки и какие риски безопасно
588
OpenAI отказалась от Open Secure AI Alliance: стратегический разворот или внутренний раскол?
OpenAI отказалась от альянса безопасности Дженсена Хуанга — сотрудники в ярости. Почему компания выбрала закрытость, как это связано с инцидентом взлома Hugging