Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5617
Qwen 3 Coder Next не звонит: как починить сломанный tool calling, найти работающие квантования и не сойти с ума
Полное руководство по исправлению багов tool calling в Qwen 3 Coder Next. Работающие GGUF квантования, правильные шаблоны, локальный запуск на llama.cpp.
5618
12 нейросетей для картинок в 2026: кто нарисует сюрреалистичный кошмар по одному промпту
Тест 12 нейросетей на сложном сюрреалистичном промпте. Сравниваем Midjourney, Nano Banano, DALL-E 4, Flux 2.0 и другие. Результаты и выводы на 2026 год.
5619
Step 3.5 Flash: быстрая, но нестабильная модель. Как исправить галлюцинации tool calls?
Практический обзор Step 3.5 Flash: как исправить галлюцинации tool calls, повторяющиеся reasoning traces и сравнение с GLM 4.7. Актуально на 04.02.2026.
5620
Yuan 3.0 Flash 40B: китайский мультимодальный снайпер для RAG, который помещается в 8 ГБ VRAM
Тестируем Yuan 3.0 Flash 40B — китайскую мультимодальную модель 3.7B параметров, оптимизированную для RAG. Совместимость с llama.cpp, GGUF и сравнение с аналога
5621
Positron vs Nvidia: как стартап с $230 млн бросает вызов монополии на AI-чипы
Positron привлек $230 млн от Qatar Investment Authority. Их чипы с высокоскоростной памятью бросают вызов Nvidia в 2026 году. Анализ технологии и шансов.
5622
Как ИИ меняет кибербезопасность в 2026 году: от дипфейков до автоматизации атак
Прогноз на 2026: как теневой ИИ, дипфейки нового поколения и автономные агенты переписывают правила кибервойны. Защита от AllFix и фишинг-вишинга.
5623
Ghidra MCP Server: 110 инструментов для AI-реверса и поиска функций между версиями
Как подключить 110 инструментов Ghidra к Claude через MCP для анализа бинарников, нормализованного хеширования функций и поиска между версиями ПО.
5624
Январь 2025: ChatGPT начал показывать рекламу, Илон Маск подал в суд, а OpenAI создал врача
Реклама в ChatGPT, медицинский ассистент от OpenAI, судебный иск Илона Маска и другие главные события января 2025 года в мире искусственного интеллекта.
5625
Контекстный рот в AI-агентах: когда скользящее окно не спасает
Практические техники борьбы с контекстным ротом в AI-агентах: от суммаризации до fine-tuning. Как сохранить память в диалогах 50+ сообщений.
5626
GGML реализация Qwen3-ASR: локальное распознавание речи с квантованием Q8 и forced alignment
Обзор GGML реализации Qwen3-ASR с квантованием Q8 для локального распознавания речи на 52 языках. Сравнение с Whisper, экономия памяти до 2 ГБ.
5627
Почему Qwen3-4B-Instruct отвечает «Да» на всё: анализ «сломанных» квантований и обходов цензуры
Разбираем баг Qwen3-4B-Instruct: почему квантованные GGUF версии отвечают «Да» на любые вопросы, как это связано с обходом цензуры и что делать.
5628
Старые GPU ещё живы: Tensor Parallel на P40 и Pascal — битва фреймворков 2026
Полное руководство по запуску современных LLM на P40 и Pascal GPU. Сравнение производительности ik_llama, exllama v3, vLLM и llama.cpp в Tensor Parallel режиме.