Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

8125 Кластеризация LLM: как распределить обработку промптов между разным железом (DGX Spark + Mac Studio) Подробное руководство по созданию гетерогенного кластера LLM для распределения нагрузки между DGX Spark и Mac Studio с использованием llama.cpp и vLLM. 9 мин чтения 8126 Мульти-агентные системы: какие боли испытывают разработчики на практике Исследование основных pain points при работе с мульти-агентными системами: отладка, оркестрация, инструменты и реальные проблемы разработчиков. 6 мин чтения 8127 Minimax теряет пользователей из-за привязки к Google-аккаунту Китайский AI-стартап Minimax теряет аудиторию из-за обязательной авторизации через Google. Разбираем проблемы приватности и зависимости от экосистемы. 3 мин чтения 8128 Конфиденциальность под вопросом: что ChatGPT знает о вашем годе и как это отключить Полный гайд по приватности в ChatGPT. Узнайте, какие данные о вас хранит ИИ, как работает память чат-бота и как отключить сохранение истории разговоров. 4 мин чтения 8129 Фикс для Nemotron Nano 3: как отключить навязчивое 'мышление' модели в LM Studio Пошаговое руководство по отключению навязчивого 'мышления' модели Nemotron Nano 3 в LM Studio через фикс Jinja-шаблона и system prompt. 5 мин чтения 8130 Модели на триллионы параметров: когда они появятся и зачем они нужны? Анализ будущего больших языковых моделей: когда ждать модели на триллионы параметров, как работает архитектура MoE и зачем нужен такой масштаб. 5 мин чтения 8131 RTX 2000 Pro Blackwell 16GB: первые впечатления и сравнение с Ada для локальных LLM Первые впечатления от RTX 2000 Pro Blackwell 16GB. Сравнение производительности с Ada Lovelace для запуска локальных языковых моделей (LLM). 5 мин чтения 8132 Какие ИИ-инструменты реально используют 1С-разработчики в 2025: итоги опроса Результаты опроса 1С-разработчиков: какие ИИ-инструменты реально используют в работе в 2025 году для кодинга, документирования и отладки. 4 мин чтения 8133 llama.cpp RPC-server: дистрибутивные вычисления на старом железе — тесты и настройка Тесты производительности и настройка llama.cpp RPC-server для запуска больших языковых моделей на разнородном и устаревшем оборудовании. 7 мин чтения 8134 Генерация тегов на крошечных моделях: какой ИИ на 500M параметров справится с задачей? Практическое руководство по выбору и использованию маленьких ИИ-моделей для генерации тегов. Сравнение производительности, оптимизация и пошаговая настройка Oll 9 мин чтения 8135 Активационные функции в нейросетях: от ReLU до SwiGLU в LLM Полное руководство по активационным функциям в нейросетях: от классических ReLU до современных SwiGLU в больших языковых моделях. Сравнение, практическое примен 9 мин чтения 8136 SOCAMM2: Как новый стандарт оперативной памяти изменит AI-инфраструктуру Обзор SOCAMM2 — революционного стандарта оперативной памяти на базе LPDDR5X для AI-инфраструктуры. Как он ускорит обучение моделей и изменит железо. 5 мин чтения