Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

8377 Genesis-152M-Instruct: эксперимент с гибридной архитектурой для малых моделей Обзор экспериментальной модели Genesis-152M-Instruct: гибрид GLA, FoX и TTT архитектур для эффективных малых языковых моделей. Исследование ICLR 2024. 4 мин чтения 8378 Коллекция промптов для тестирования и сравнительного анализа локальных LLM Готовые промпты для тестирования локальных LLM: бенчмарки, задачи на рассуждение, код и креативность. Сравнивайте модели и оценивайте качество генерации. 6 мин чтения 8379 Liquid AI LFM2-2.6B: обзор компактной модели-чемпиона Обзор Liquid AI LFM2-2.6B — компактной нейросети с 2.6B параметров. Сравнение с Qwen2.5-3B и Phi-3, примеры использования, требования к железу. 4 мин чтения 8380 Стратегии масштабирования локальных LLM: от одной карты до кластера Исчерпывающее руководство по масштабированию локальных языковых моделей: оптимизация памяти, tensor/pipeline parallelism, кластеризация GPU. Реальные кейсы и по 9 мин чтения 8381 RTX Pro 6000 vs. RTX 4090 для локальных LLM: исчерпывающее сравнение на 2025 год Полное сравнение RTX Pro 6000 и RTX 4090 для запуска локальных LLM в 2025. Что лучше: 48 ГБ VRAM или производительность? Гайд по выбору. 9 мин чтения 8382 Практический гайд: как избежать основных ошибок при локальном запуске больших LLM Полное руководство по запуску больших языковых моделей локально. Решаем проблемы с VRAM, фрагментацией памяти, латентностью. Llama.cpp, vLLM, квантование, оптим 8 мин чтения 8383 Обзор фреймворков для локального запуска LLM в 2025: llama.cpp, vLLM, MLX, Ollama Подробное сравнение фреймворков для запуска больших языковых моделей локально в 2025 году. Производительность, простота использования, поддерживаемые модели. 6 мин чтения