Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
1957
Multi-Token Prediction на Qwen3-27B: ускорение в 2.5x с Unsloth UD XL и квантованными GGUFs
Как запустить Multi-Token Prediction на Qwen3-27B с Unsloth UD XL и получить 2.5x прироста скорости. Инструкция, бенчмарки, сравнение с vLLM и llama.cpp.
1958
Как получить 2.5x ускорение инференса Qwen 3.6 27B с помощью MTP: полное руководство для локальных кодинг-агентов
Пошаговое руководство по настройке Multi-Token Prediction для Qwen 3.6 27B. Конвертация в GGUF, запуск в llama.cpp, оптимизация для VRAM 48 ГБ и исправление cha
1959
FSRS для Obsidian: как забывать реже, а учиться — в своем хранилище
Обзор плагина FSRS для Obsidian: алгоритм нового поколения, до 30% меньше повторений, все данные в .md файлах. Сравнение с Anki и RemNote.
1960
ASR-гонка вооружений: как Appen и DataoceanAI зачищают лидерборды от читеров
Open ASR Leaderboard добавляет приватные датасеты от Appen и DataoceanAI, чтобы остановить benchmaxxing. Как это меняет гонку за WER и почему разработчикам стои
1961
Как заменить диктора open-source TTS-моделью: тестируем OmniVoice на русском для бизнес-сценариев
Практическое тестирование OmniVoice на русском языке: числа, даты, ФИО, паузы. Пошаговый гайд, нюансы и сравнение с аналогами. Узнайте, стоит ли заменять диктор
1962
Solidity LM на основе Qwen 3.6 превзошёл Opus: как запустить модель 27B для смарт-контрактов
Новинка: Solidity LM на Qwen 3.6 - 27B модель обходит Opus. Гайд по запуску, сравнение с альтернативами и примеры для разработчиков смарт-контрактов.
1963
Критическая утечка памяти в Ollama: уязвимость Bleeding Llama и меры защиты
Уязвимость Bleeding Llama в Ollama позволяет злоумышленникам вытягивать чувствительные данные из памяти модели. Рассказываем, как защититься.
1964
SAP вкидывает €1 млрд в Prior Labs: табличные модели теперь не шутка
SAP инвестирует 1 миллиард евро в Prior Labs. Разбираемся, почему табличные фундаментальные модели (TFM) могут перевернуть enterprise AI и что это значит для би
1965
SubQ 12M: Маркетинговый атомный взрыв или мыльный пузырь?
Разбираем скандал вокруг заявленного 12M контекстного окна SubQ. Реальность или маркетинг? Тесты, факты, альтернативы.
1966
Битва код-агентов: Claude Code Opus 4.7 против OpenCode qwen3.6 — кто создаст играбельную RPG из пустого каталога?
Сравнение AI-агентов Claude Code Opus 4.7 и OpenCode qwen3.6 в задаче генерации полноценной roguelike-игры. Результаты, бенчмарки и выводы для разработчиков на
1967
Apple iOS 27: пользователи смогут выбирать AI-модели от Google и Anthropic через 'Extensions'
Apple открывает экосистему для сторонних AI: в iOS 27 появится Extensions — система выбора моделей от Google и Anthropic. Что это значит для Siri и приватности?
1968
SocratiCode: MCP-сервер, который научит ИИ-агента шарить в вашем коде
Обзор SocratiCode — open-source MCP-сервера для семантического поиска по коду. AST-чанкинг, гибридный search (Qdrant + Ollama), сравнение с Ragex и Code-memory.