Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
37
llama.cpp в 2026: какие CPU, RAM и Hybrid-направления меняют локальный инференс
Разбираем, что уже подтверждено для гибридного инференса llama.cpp через RPC, CUDA, CPU backend и tensor-split. Показываем ограничения на примере Mistral и Mixt
38
Qwen3.8 Flash Next: что дают новые imatrix-кванты GGUF и кому нужен Q4-релиз
Новые imatrix-кванты GGUF для Qwen3.8 Flash Next обещают компактный Q4 без преждевременного перехода на Q3. Разбираем, чем они отличаются от простого снижения b
39
4 полезных сценария применения Claude для дата-сайентиста в 2026 году
Как дата-сайентисту использовать Claude в 2026 году: исследование методов для временных рядов, stakeholder brief, Claude Design для презентаций и документация M
40
Как увеличить контекст LLM без дообучения: RoPE, YaRN и NTK-aware scaling на практике
Разбираем, как расширить контекст LLM без дообучения: RoPE scaling, Position Interpolation, NTK-aware, YaRN и LongRoPE. Практические советы по настройке, ограни
41
Почему AI в биотехе упирается не в модели, а в данные и клиническую валидацию
Почему мощная AI-модель ещё не решает задачу разработки лекарств? Разбираем, как экспериментальные данные, лабораторный screening и клиническая валидация ограни
42
DeepSeek Flash v4 на двух ASUS GX10: что дают высокая скорость генерации и низкая задержка
Разбираем, когда два ASUS GX10 могут оправдать запуск DeepSeek Flash v4 локально, и почему одних tokens/s недостаточно для выбора железа. В статье: prompt eval,
43
Почему benchmark card Ling-3.0-flash-Fin важнее как методика, чем как таблица победителей
Разбираем benchmark card Ling-3.0-flash-Fin и показываем, почему ее нельзя читать как простой рейтинг LLM. Настройки temperature, top_p и reasoning effort, ReAc
44
ARC-AGI-3: тест на интеллект или на инженерную обвязку вокруг LLM
100% на ARC-AGI-3 ещё не значит AGI. Разбираем, что измеряет бенчмарк: способность модели к обобщению или качество инженерной обвязки. Как отличить настоящее по
45
Как ИИ-агент нашел уязвимость в домашнем роутере и довел ее до CVE
ИИ-агент в режиме read-only обнаружил в домашнем роутере доступ к конфигурационному дампу без аутентификации. Разбираем цепочку риска, границы автоматизированно
46
Как выбрать первую локальную модель для агентного кодинга на ПК с большой RAM и ограниченной VRAM
Практическое руководство по выбору первой локальной модели для агентного кодинга на ПК с большой RAM и ограниченной VRAM. Узнайте, почему начать стоит с 7-13B Q
47
Sony Music и Warner Music подали новый иск против Anthropic из-за предполагаемого пиратского сбора данных для Claude
Sony Music и Warner Music обвинили Anthropic в предполагаемом незаконном скачивании музыкальных произведений для Claude. Разбираем суть нового иска, отличие от
48
Qwen3.8-27B на MacBook Pro M5 Max: зачем отключать reasoning и что это меняет
Разбираем, что меняет thinking off у Qwen3.8-27B на MacBook Pro с M5 Max: задержку ответа, расход токенов, нагрузку и качество результата. Показываем, для каких