Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7885 LoongFlow от Baidu: как китайский фреймворк для эволюции промптов бьет AlphaEvolve от Google Сравнительный обзор LoongFlow от Baidu и AlphaEvolve от Google. Какой фреймворк для автоматического инжиниринга промптов лучше в 2025 году. 7 мин чтения 7886 Как выделить 128 ГБ памяти для AMD iGPU в Linux через GTT: гайд для разработчиков AI Пошаговое руководство по настройке Graphics Translation Table для выделения 128 ГБ памяти под AMD iGPU в Linux. Решение проблем с VRAM для разработки AI моделей 6 мин чтения 7887 LM Studio MCP: Запускаем AI-агента для автоматизации новостей на GPT-OSS 20B — без API, денег и слежки Пошаговый гайд по настройке локального AI-агента в LM Studio с MCP для автоматического сбора и анализа новостей без API и облаков. 9 мин чтения 7888 LFM2 2.6B-Exp на Android: установка llama.cpp и настройка для 40+ токенов в секунду Пошаговая инструкция по запуску LFM2 2.6B-Exp на Android через llama.cpp. Настройка Termux, компиляция, параметры сэмплера для 40+ токенов в секунду. 8 мин чтения 7889 Interleaved Thinking в Minimax M2.1: как работают теги и настройка клиентов Полное руководство по Interleaved Thinking в Minimax M2.1. Настройка chat template, работа с reasoning tokens, интеграция с Open-WebUI, SillyTavern и EXL3 квант 9 мин чтения 7890 IQuest-Coder-V1 — фальшивка или прорыв? Технический детектив, который взорвал AI-сообщество Полный разбор скандала с IQuest-Coder-V1. Как обнаружили подделку через анализ конфигураций, SwiGLU и intermediate_size. Признаки плагиата Qwen2.5. 7 мин чтения 7891 Polyglot-r2: суффиксный подход к трансформации текста без промптов - обзор и практическое применение Обзор модели Polyglot-r2, которая использует суффиксы для детерминированной обработки текста без промптов. Примеры использования и сравнение с альтернативами. 5 мин чтения 7892 Tuneable Attention: как расширение, а не сжатие внимания ускоряет обучение LLM Практическое руководство по Tuneable Attention - техника ускорения обучения языковых моделей на бюджетном железе через расширение механизма внимания. 9 мин чтения 7893 ISON против JSON: как выжать из LLM-контекста максимум, сократив токены на 70% ISON — новый табличный формат для LLM. Сравниваем с JSON, YAML, MessagePack. Примеры, синтаксис, тесты на экономию токенов и точность парсинга. 6 мин чтения 7894 Как запустить DeepSeek V3.2 в llama.cpp: патч для конвертации и тестирования без sparse attention Пошаговое руководство по применению патча для конвертации DeepSeek V3.2 в GGUF и запуску в llama.cpp без поддержки sparse attention. 5 мин чтения 7895 IQuestCoder-40B: когда 40 миллиардов параметров решают всё Тестируем IQuestCoder-40B — новую модель для программирования с SOTA-результатами. Сравнение с конкурентами, адаптация под GGUF/Llama.cpp и реальные примеры код 6 мин чтения 7896 Забери GigaChat домой: как запустить Ultra-Preview и Lightning на своем ноутбуке Пошаговая инструкция по скачиванию и запуску русскоязычных MoE-моделей GigaChat Ultra-Preview и Lightning на ноутбуке. Веса, требования, примеры кода. 6 мин чтения