Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
8125
Кластеризация LLM: как распределить обработку промптов между разным железом (DGX Spark + Mac Studio)
Подробное руководство по созданию гетерогенного кластера LLM для распределения нагрузки между DGX Spark и Mac Studio с использованием llama.cpp и vLLM.
8126
Мульти-агентные системы: какие боли испытывают разработчики на практике
Исследование основных pain points при работе с мульти-агентными системами: отладка, оркестрация, инструменты и реальные проблемы разработчиков.
8127
Minimax теряет пользователей из-за привязки к Google-аккаунту
Китайский AI-стартап Minimax теряет аудиторию из-за обязательной авторизации через Google. Разбираем проблемы приватности и зависимости от экосистемы.
8128
Конфиденциальность под вопросом: что ChatGPT знает о вашем годе и как это отключить
Полный гайд по приватности в ChatGPT. Узнайте, какие данные о вас хранит ИИ, как работает память чат-бота и как отключить сохранение истории разговоров.
8129
Фикс для Nemotron Nano 3: как отключить навязчивое 'мышление' модели в LM Studio
Пошаговое руководство по отключению навязчивого 'мышления' модели Nemotron Nano 3 в LM Studio через фикс Jinja-шаблона и system prompt.
8130
Модели на триллионы параметров: когда они появятся и зачем они нужны?
Анализ будущего больших языковых моделей: когда ждать модели на триллионы параметров, как работает архитектура MoE и зачем нужен такой масштаб.
8131
RTX 2000 Pro Blackwell 16GB: первые впечатления и сравнение с Ada для локальных LLM
Первые впечатления от RTX 2000 Pro Blackwell 16GB. Сравнение производительности с Ada Lovelace для запуска локальных языковых моделей (LLM).
8132
Какие ИИ-инструменты реально используют 1С-разработчики в 2025: итоги опроса
Результаты опроса 1С-разработчиков: какие ИИ-инструменты реально используют в работе в 2025 году для кодинга, документирования и отладки.
8133
llama.cpp RPC-server: дистрибутивные вычисления на старом железе — тесты и настройка
Тесты производительности и настройка llama.cpp RPC-server для запуска больших языковых моделей на разнородном и устаревшем оборудовании.
8134
Генерация тегов на крошечных моделях: какой ИИ на 500M параметров справится с задачей?
Практическое руководство по выбору и использованию маленьких ИИ-моделей для генерации тегов. Сравнение производительности, оптимизация и пошаговая настройка Oll
8135
Активационные функции в нейросетях: от ReLU до SwiGLU в LLM
Полное руководство по активационным функциям в нейросетях: от классических ReLU до современных SwiGLU в больших языковых моделях. Сравнение, практическое примен
8136
SOCAMM2: Как новый стандарт оперативной памяти изменит AI-инфраструктуру
Обзор SOCAMM2 — революционного стандарта оперативной памяти на базе LPDDR5X для AI-инфраструктуры. Как он ускорит обучение моделей и изменит железо.