Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7885
LoongFlow от Baidu: как китайский фреймворк для эволюции промптов бьет AlphaEvolve от Google
Сравнительный обзор LoongFlow от Baidu и AlphaEvolve от Google. Какой фреймворк для автоматического инжиниринга промптов лучше в 2025 году.
7886
Как выделить 128 ГБ памяти для AMD iGPU в Linux через GTT: гайд для разработчиков AI
Пошаговое руководство по настройке Graphics Translation Table для выделения 128 ГБ памяти под AMD iGPU в Linux. Решение проблем с VRAM для разработки AI моделей
7887
LM Studio MCP: Запускаем AI-агента для автоматизации новостей на GPT-OSS 20B — без API, денег и слежки
Пошаговый гайд по настройке локального AI-агента в LM Studio с MCP для автоматического сбора и анализа новостей без API и облаков.
7888
LFM2 2.6B-Exp на Android: установка llama.cpp и настройка для 40+ токенов в секунду
Пошаговая инструкция по запуску LFM2 2.6B-Exp на Android через llama.cpp. Настройка Termux, компиляция, параметры сэмплера для 40+ токенов в секунду.
7889
Interleaved Thinking в Minimax M2.1: как работают теги и настройка клиентов
Полное руководство по Interleaved Thinking в Minimax M2.1. Настройка chat template, работа с reasoning tokens, интеграция с Open-WebUI, SillyTavern и EXL3 квант
7890
IQuest-Coder-V1 — фальшивка или прорыв? Технический детектив, который взорвал AI-сообщество
Полный разбор скандала с IQuest-Coder-V1. Как обнаружили подделку через анализ конфигураций, SwiGLU и intermediate_size. Признаки плагиата Qwen2.5.
7891
Polyglot-r2: суффиксный подход к трансформации текста без промптов - обзор и практическое применение
Обзор модели Polyglot-r2, которая использует суффиксы для детерминированной обработки текста без промптов. Примеры использования и сравнение с альтернативами.
7892
Tuneable Attention: как расширение, а не сжатие внимания ускоряет обучение LLM
Практическое руководство по Tuneable Attention - техника ускорения обучения языковых моделей на бюджетном железе через расширение механизма внимания.
7893
ISON против JSON: как выжать из LLM-контекста максимум, сократив токены на 70%
ISON — новый табличный формат для LLM. Сравниваем с JSON, YAML, MessagePack. Примеры, синтаксис, тесты на экономию токенов и точность парсинга.
7894
Как запустить DeepSeek V3.2 в llama.cpp: патч для конвертации и тестирования без sparse attention
Пошаговое руководство по применению патча для конвертации DeepSeek V3.2 в GGUF и запуску в llama.cpp без поддержки sparse attention.
7895
IQuestCoder-40B: когда 40 миллиардов параметров решают всё
Тестируем IQuestCoder-40B — новую модель для программирования с SOTA-результатами. Сравнение с конкурентами, адаптация под GGUF/Llama.cpp и реальные примеры код
7896
Забери GigaChat домой: как запустить Ultra-Preview и Lightning на своем ноутбуке
Пошаговая инструкция по скачиванию и запуску русскоязычных MoE-моделей GigaChat Ultra-Preview и Lightning на ноутбуке. Веса, требования, примеры кода.