Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2053
ФСТЭК прижал ИИ: разбор методики к приказу №117 — что делать госорганам и КИИ
Разбираем пункт 3.18, скрытые риски и практические шаги для госорганов и объектов КИИ. Как подготовиться к проверкам в 2026 году.
2054
Gemma 4 26B на двух машинах: Decoupled Attention с помощью Larql для обхода лимитов локальной памяти
Как запустить Gemma 4 26B на двух слабых GPU с помощью Larql и техники Decoupled Attention. Рабочий код, сравнение с альтернативами, пример конфигурации.
2055
Multi-Token Prediction на Qwen3-27B: ускорение в 2.5x с Unsloth UD XL и квантованными GGUFs
Как запустить Multi-Token Prediction на Qwen3-27B с Unsloth UD XL и получить 2.5x прироста скорости. Инструкция, бенчмарки, сравнение с vLLM и llama.cpp.
2056
Как получить 2.5x ускорение инференса Qwen 3.6 27B с помощью MTP: полное руководство для локальных кодинг-агентов
Пошаговое руководство по настройке Multi-Token Prediction для Qwen 3.6 27B. Конвертация в GGUF, запуск в llama.cpp, оптимизация для VRAM 48 ГБ и исправление cha
2057
FSRS для Obsidian: как забывать реже, а учиться — в своем хранилище
Обзор плагина FSRS для Obsidian: алгоритм нового поколения, до 30% меньше повторений, все данные в .md файлах. Сравнение с Anki и RemNote.
2058
ASR-гонка вооружений: как Appen и DataoceanAI зачищают лидерборды от читеров
Open ASR Leaderboard добавляет приватные датасеты от Appen и DataoceanAI, чтобы остановить benchmaxxing. Как это меняет гонку за WER и почему разработчикам стои
2059
Как заменить диктора open-source TTS-моделью: тестируем OmniVoice на русском для бизнес-сценариев
Практическое тестирование OmniVoice на русском языке: числа, даты, ФИО, паузы. Пошаговый гайд, нюансы и сравнение с аналогами. Узнайте, стоит ли заменять диктор
2060
Solidity LM на основе Qwen 3.6 превзошёл Opus: как запустить модель 27B для смарт-контрактов
Новинка: Solidity LM на Qwen 3.6 - 27B модель обходит Opus. Гайд по запуску, сравнение с альтернативами и примеры для разработчиков смарт-контрактов.
2061
Критическая утечка памяти в Ollama: уязвимость Bleeding Llama и меры защиты
Уязвимость Bleeding Llama в Ollama позволяет злоумышленникам вытягивать чувствительные данные из памяти модели. Рассказываем, как защититься.
2062
SAP вкидывает €1 млрд в Prior Labs: табличные модели теперь не шутка
SAP инвестирует 1 миллиард евро в Prior Labs. Разбираемся, почему табличные фундаментальные модели (TFM) могут перевернуть enterprise AI и что это значит для би
2063
SubQ 12M: Маркетинговый атомный взрыв или мыльный пузырь?
Разбираем скандал вокруг заявленного 12M контекстного окна SubQ. Реальность или маркетинг? Тесты, факты, альтернативы.
2064
Битва код-агентов: Claude Code Opus 4.7 против OpenCode qwen3.6 — кто создаст играбельную RPG из пустого каталога?
Сравнение AI-агентов Claude Code Opus 4.7 и OpenCode qwen3.6 в задаче генерации полноценной roguelike-игры. Результаты, бенчмарки и выводы для разработчиков на