Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1957 Multi-Token Prediction на Qwen3-27B: ускорение в 2.5x с Unsloth UD XL и квантованными GGUFs Как запустить Multi-Token Prediction на Qwen3-27B с Unsloth UD XL и получить 2.5x прироста скорости. Инструкция, бенчмарки, сравнение с vLLM и llama.cpp. 5 мин чтения 1958 Как получить 2.5x ускорение инференса Qwen 3.6 27B с помощью MTP: полное руководство для локальных кодинг-агентов Пошаговое руководство по настройке Multi-Token Prediction для Qwen 3.6 27B. Конвертация в GGUF, запуск в llama.cpp, оптимизация для VRAM 48 ГБ и исправление cha 7 мин чтения 1959 FSRS для Obsidian: как забывать реже, а учиться — в своем хранилище Обзор плагина FSRS для Obsidian: алгоритм нового поколения, до 30% меньше повторений, все данные в .md файлах. Сравнение с Anki и RemNote. 6 мин чтения 1960 ASR-гонка вооружений: как Appen и DataoceanAI зачищают лидерборды от читеров Open ASR Leaderboard добавляет приватные датасеты от Appen и DataoceanAI, чтобы остановить benchmaxxing. Как это меняет гонку за WER и почему разработчикам стои 4 мин чтения 1961 Как заменить диктора open-source TTS-моделью: тестируем OmniVoice на русском для бизнес-сценариев Практическое тестирование OmniVoice на русском языке: числа, даты, ФИО, паузы. Пошаговый гайд, нюансы и сравнение с аналогами. Узнайте, стоит ли заменять диктор 7 мин чтения 1962 Solidity LM на основе Qwen 3.6 превзошёл Opus: как запустить модель 27B для смарт-контрактов Новинка: Solidity LM на Qwen 3.6 - 27B модель обходит Opus. Гайд по запуску, сравнение с альтернативами и примеры для разработчиков смарт-контрактов. 5 мин чтения 1963 Критическая утечка памяти в Ollama: уязвимость Bleeding Llama и меры защиты Уязвимость Bleeding Llama в Ollama позволяет злоумышленникам вытягивать чувствительные данные из памяти модели. Рассказываем, как защититься. 4 мин чтения 1964 SAP вкидывает €1 млрд в Prior Labs: табличные модели теперь не шутка SAP инвестирует 1 миллиард евро в Prior Labs. Разбираемся, почему табличные фундаментальные модели (TFM) могут перевернуть enterprise AI и что это значит для би 5 мин чтения 1965 SubQ 12M: Маркетинговый атомный взрыв или мыльный пузырь? Разбираем скандал вокруг заявленного 12M контекстного окна SubQ. Реальность или маркетинг? Тесты, факты, альтернативы. 3 мин чтения 1966 Битва код-агентов: Claude Code Opus 4.7 против OpenCode qwen3.6 — кто создаст играбельную RPG из пустого каталога? Сравнение AI-агентов Claude Code Opus 4.7 и OpenCode qwen3.6 в задаче генерации полноценной roguelike-игры. Результаты, бенчмарки и выводы для разработчиков на 6 мин чтения 1967 Apple iOS 27: пользователи смогут выбирать AI-модели от Google и Anthropic через 'Extensions' Apple открывает экосистему для сторонних AI: в iOS 27 появится Extensions — система выбора моделей от Google и Anthropic. Что это значит для Siri и приватности? 1 мин чтения 1968 SocratiCode: MCP-сервер, который научит ИИ-агента шарить в вашем коде Обзор SocratiCode — open-source MCP-сервера для семантического поиска по коду. AST-чанкинг, гибридный search (Qdrant + Ollama), сравнение с Ragex и Code-memory. 6 мин чтения