Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

37 llama.cpp в 2026: какие CPU, RAM и Hybrid-направления меняют локальный инференс Разбираем, что уже подтверждено для гибридного инференса llama.cpp через RPC, CUDA, CPU backend и tensor-split. Показываем ограничения на примере Mistral и Mixt 9 мин чтения 38 Qwen3.8 Flash Next: что дают новые imatrix-кванты GGUF и кому нужен Q4-релиз Новые imatrix-кванты GGUF для Qwen3.8 Flash Next обещают компактный Q4 без преждевременного перехода на Q3. Разбираем, чем они отличаются от простого снижения b 8 мин чтения 39 4 полезных сценария применения Claude для дата-сайентиста в 2026 году Как дата-сайентисту использовать Claude в 2026 году: исследование методов для временных рядов, stakeholder brief, Claude Design для презентаций и документация M 4 мин чтения 40 Как увеличить контекст LLM без дообучения: RoPE, YaRN и NTK-aware scaling на практике Разбираем, как расширить контекст LLM без дообучения: RoPE scaling, Position Interpolation, NTK-aware, YaRN и LongRoPE. Практические советы по настройке, ограни 8 мин чтения 41 Почему AI в биотехе упирается не в модели, а в данные и клиническую валидацию Почему мощная AI-модель ещё не решает задачу разработки лекарств? Разбираем, как экспериментальные данные, лабораторный screening и клиническая валидация ограни 8 мин чтения 42 DeepSeek Flash v4 на двух ASUS GX10: что дают высокая скорость генерации и низкая задержка Разбираем, когда два ASUS GX10 могут оправдать запуск DeepSeek Flash v4 локально, и почему одних tokens/s недостаточно для выбора железа. В статье: prompt eval, 11 мин чтения 43 Почему benchmark card Ling-3.0-flash-Fin важнее как методика, чем как таблица победителей Разбираем benchmark card Ling-3.0-flash-Fin и показываем, почему ее нельзя читать как простой рейтинг LLM. Настройки temperature, top_p и reasoning effort, ReAc 12 мин чтения 44 ARC-AGI-3: тест на интеллект или на инженерную обвязку вокруг LLM 100% на ARC-AGI-3 ещё не значит AGI. Разбираем, что измеряет бенчмарк: способность модели к обобщению или качество инженерной обвязки. Как отличить настоящее по 5 мин чтения 45 Как ИИ-агент нашел уязвимость в домашнем роутере и довел ее до CVE ИИ-агент в режиме read-only обнаружил в домашнем роутере доступ к конфигурационному дампу без аутентификации. Разбираем цепочку риска, границы автоматизированно 11 мин чтения 46 Как выбрать первую локальную модель для агентного кодинга на ПК с большой RAM и ограниченной VRAM Практическое руководство по выбору первой локальной модели для агентного кодинга на ПК с большой RAM и ограниченной VRAM. Узнайте, почему начать стоит с 7-13B Q 6 мин чтения 47 Sony Music и Warner Music подали новый иск против Anthropic из-за предполагаемого пиратского сбора данных для Claude Sony Music и Warner Music обвинили Anthropic в предполагаемом незаконном скачивании музыкальных произведений для Claude. Разбираем суть нового иска, отличие от 7 мин чтения 48 Qwen3.8-27B на MacBook Pro M5 Max: зачем отключать reasoning и что это меняет Разбираем, что меняет thinking off у Qwen3.8-27B на MacBook Pro с M5 Max: задержку ответа, расход токенов, нагрузку и качество результата. Показываем, для каких 7 мин чтения