Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
8377
Genesis-152M-Instruct: эксперимент с гибридной архитектурой для малых моделей
Обзор экспериментальной модели Genesis-152M-Instruct: гибрид GLA, FoX и TTT архитектур для эффективных малых языковых моделей. Исследование ICLR 2024.
8378
Коллекция промптов для тестирования и сравнительного анализа локальных LLM
Готовые промпты для тестирования локальных LLM: бенчмарки, задачи на рассуждение, код и креативность. Сравнивайте модели и оценивайте качество генерации.
8379
Liquid AI LFM2-2.6B: обзор компактной модели-чемпиона
Обзор Liquid AI LFM2-2.6B — компактной нейросети с 2.6B параметров. Сравнение с Qwen2.5-3B и Phi-3, примеры использования, требования к железу.
8380
Стратегии масштабирования локальных LLM: от одной карты до кластера
Исчерпывающее руководство по масштабированию локальных языковых моделей: оптимизация памяти, tensor/pipeline parallelism, кластеризация GPU. Реальные кейсы и по
8381
RTX Pro 6000 vs. RTX 4090 для локальных LLM: исчерпывающее сравнение на 2025 год
Полное сравнение RTX Pro 6000 и RTX 4090 для запуска локальных LLM в 2025. Что лучше: 48 ГБ VRAM или производительность? Гайд по выбору.
8382
Практический гайд: как избежать основных ошибок при локальном запуске больших LLM
Полное руководство по запуску больших языковых моделей локально. Решаем проблемы с VRAM, фрагментацией памяти, латентностью. Llama.cpp, vLLM, квантование, оптим
8383
Обзор фреймворков для локального запуска LLM в 2025: llama.cpp, vLLM, MLX, Ollama
Подробное сравнение фреймворков для запуска больших языковых моделей локально в 2025 году. Производительность, простота использования, поддерживаемые модели.