Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5617 Qwen 3 Coder Next не звонит: как починить сломанный tool calling, найти работающие квантования и не сойти с ума Полное руководство по исправлению багов tool calling в Qwen 3 Coder Next. Работающие GGUF квантования, правильные шаблоны, локальный запуск на llama.cpp. 8 мин чтения 5618 12 нейросетей для картинок в 2026: кто нарисует сюрреалистичный кошмар по одному промпту Тест 12 нейросетей на сложном сюрреалистичном промпте. Сравниваем Midjourney, Nano Banano, DALL-E 4, Flux 2.0 и другие. Результаты и выводы на 2026 год. 10 мин чтения 5619 Step 3.5 Flash: быстрая, но нестабильная модель. Как исправить галлюцинации tool calls? Практический обзор Step 3.5 Flash: как исправить галлюцинации tool calls, повторяющиеся reasoning traces и сравнение с GLM 4.7. Актуально на 04.02.2026. 6 мин чтения 5620 Yuan 3.0 Flash 40B: китайский мультимодальный снайпер для RAG, который помещается в 8 ГБ VRAM Тестируем Yuan 3.0 Flash 40B — китайскую мультимодальную модель 3.7B параметров, оптимизированную для RAG. Совместимость с llama.cpp, GGUF и сравнение с аналога 4 мин чтения 5621 Positron vs Nvidia: как стартап с $230 млн бросает вызов монополии на AI-чипы Positron привлек $230 млн от Qatar Investment Authority. Их чипы с высокоскоростной памятью бросают вызов Nvidia в 2026 году. Анализ технологии и шансов. 5 мин чтения 5622 Как ИИ меняет кибербезопасность в 2026 году: от дипфейков до автоматизации атак Прогноз на 2026: как теневой ИИ, дипфейки нового поколения и автономные агенты переписывают правила кибервойны. Защита от AllFix и фишинг-вишинга. 5 мин чтения 5623 Ghidra MCP Server: 110 инструментов для AI-реверса и поиска функций между версиями Как подключить 110 инструментов Ghidra к Claude через MCP для анализа бинарников, нормализованного хеширования функций и поиска между версиями ПО. 5 мин чтения 5624 Январь 2025: ChatGPT начал показывать рекламу, Илон Маск подал в суд, а OpenAI создал врача Реклама в ChatGPT, медицинский ассистент от OpenAI, судебный иск Илона Маска и другие главные события января 2025 года в мире искусственного интеллекта. 5 мин чтения 5625 Контекстный рот в AI-агентах: когда скользящее окно не спасает Практические техники борьбы с контекстным ротом в AI-агентах: от суммаризации до fine-tuning. Как сохранить память в диалогах 50+ сообщений. 10 мин чтения 5626 GGML реализация Qwen3-ASR: локальное распознавание речи с квантованием Q8 и forced alignment Обзор GGML реализации Qwen3-ASR с квантованием Q8 для локального распознавания речи на 52 языках. Сравнение с Whisper, экономия памяти до 2 ГБ. 6 мин чтения 5627 Почему Qwen3-4B-Instruct отвечает «Да» на всё: анализ «сломанных» квантований и обходов цензуры Разбираем баг Qwen3-4B-Instruct: почему квантованные GGUF версии отвечают «Да» на любые вопросы, как это связано с обходом цензуры и что делать. 9 мин чтения 5628 Старые GPU ещё живы: Tensor Parallel на P40 и Pascal — битва фреймворков 2026 Полное руководство по запуску современных LLM на P40 и Pascal GPU. Сравнение производительности ik_llama, exllama v3, vLLM и llama.cpp в Tensor Parallel режиме. 8 мин чтения