Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1693 Ollama переходит на llama.cpp: что это значит для пользователей локальных моделей Смена бэкенда Ollama с GGML на llama.cpp: ускорение выхода новых моделей, спор об атрибуции и что делать пользователям. 4 мин чтения 1694 CodeSpeak: хватит учить синтаксис. Как выглядит язык, где код — это английский Ставим CodeSpeak через uv, пишем код на plain English и сравниваем с AI-ассистентами. Первые впечатления от языка, который обещает сократить код в 10 раз. 6 мин чтения 1695 ИИ-судья на Claude: как мы создали автоматический арбитраж, решивший реальный спор за 12 минут вместо 3 недель Кейс: создали ИИ-арбитр на Claude, который решил реальный спор за 12 минут вместо 3 недель. Архитектура, сравнение с альтернативами, код, кому подойдет. 5 мин чтения 1696 Qwen на M4 Max: как я выключил интернет и заставил Mac стенографировать встречи быстрее облака Пошаговый гайд по созданию полностью локального AI-секретаря для саммари встреч на Mac с Qwen 3.5/3.6 и оптимизацией под M4 Max. Без утечек данных, без задержек 1 мин чтения 1697 MIT научил AI говорить «Я не уверен»: метод RLCR решает проблему overconfidence Исследователи MIT CSAIL представили RLCR — метод Reinforcement Learning from Calibration Rewards, который учит AI-модели адекватно оценивать свою уверенность и 4 мин чтения 1698 Как прокачать Claude и сэкономить до 70% токенов на больших проектах: инструмент для точечного доступа к коду CodeSlice — инструмент для точечного доступа к коду в Claude, использующий граф зависимостей. Экономия токенов до 70%. Поддержка PHP, Python, SQLite. Сравнение 8 мин чтения 1699 SenseNova-U1: мультимодальная архитектура NEO-unify без VAE — обзор, установка и сравнение с Qwen и FLUX SenseNova-U1 с архитектурой NEO-unify не использует VAE для изображений. Как установить, сравнение с Qwen3-VL и FLUX.2, кому подойдет. 6 мин чтения 1700 Как отключить сжатие памяти в Windows 11 для ускорения LLM: решение проблемы с AMD GPU Сжатие памяти в Windows 11 (Memory Compression) может резать скорость LLM на AMD GPU до 50%. Команда Disable-MMAgent -mc за секунду отключает этот тормоз. Полны 7 мин чтения 1701 ARMageddon: Как скрестить четыре Raspberry Pi в кластер для нейросетей и не сойти с ума Пошаговое руководство по созданию кластера из Raspberry Pi 5 для распределенного инференса и федеративного обучения LLM. Реальные тесты, подводные камни, актуал 9 мин чтения 1702 Как использовать Cursor для быстрого прототипирования корпоративных модулей: режимы Agent, Plan, Debug, Ask Пошаговое руководство по режимам Cursor для быстрого прототипирования модулей в enterprise-проектах. Настройка .cursor/rules, комбинирование режимов, ошибки и л 9 мин чтения 1703 ИИ для продажников: промпты, которые реально закрывают сделки в 2026 Гайд: как с помощью ChatGPT и Perplexity готовиться к звонкам за 5 минут. Реальные промпты и методики для sales-отделов. Экономьте время и закрывайте больше сде 6 мин чтения 1704 Один промпт — целый фильм: open-source пайплайн, который положит конец инди-киностудиям От промпта до полного фильма с озвучкой и музыкой за один проход. Обзор open-source пайплайна на FLUX.2 и Wan2.2 I2V — доступно каждому. 5 мин чтения