Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
601
M2 Ultra 64 ГБ против M1 Ultra 128 ГБ: что выбрать для AI-нагрузок в 2026 году?
Прямое сравнение M2 Ultra 64 ГБ и M1 Ultra 128 ГБ для инференса и тонкой настройки LLM. Тесты скорости, таблицы совместимости моделей и честный разбор, когда 12
602
RTX PRO 4500 vs RTX 5090 vs Multi-GPU: что выбрать для AI-задач в 2026 году
Сравниваем RTX PRO 4500 (300 Вт), RTX 5090 (600 Вт) и 4×RTX 3090 для AI-задач. Расчёты TCO на 3 года, экономия до 10.7 млн рублей на 100 GPU, бенчмарки инференс
603
Свой open source AI-ассистент: архитектура, E2E-шифрование RAG и тематические помощники
Детальный технический разбор опенсорсного AI-ассистента «Свой»: архитектура на Go, Vue 3 и PostgreSQL 17, долговременная память на pgvector, E2E-шифрованный RAG
604
Пределы возможностей малых моделей: упираемся ли мы в стену параметров или VRAM?
Разбираем, существует ли жёсткий предел интеллекта для малых моделей (до 48GB VRAM). Анализ факторов: параметры, VRAM, датасет. Тесты Qwen3.6-27b и прогнозы.
605
Почему GLM-5.2 с архитектурой DSA падает на длинных контекстах: разбор ошибки NaN и тест конфигураций GPU/CPU
GLM-5.2 с DSA выдаёт NaN-логиты при контексте больше 32k? Разбираем причину — переполнение f16 в indexer'е на GPU — и даём проверенные конфигурации для RTX 3060
606
Как AI-аналитика меняет спорт: разбор трёх кейсов на платформе AI4BI
Разбираем, как платформа AI4BI автоматизирует сбор и анализ данных в спорте. Прогноз финала ЧМ-2026, скаутинг хоккеистов для КХЛ и персонализированная реабилита
607
GigaChat Audio 10B: аудио-native LLM с временной локализацией — архитектура и примеры
GigaChat Audio 10B обрабатывает аудио напрямую через Conformer-энкодер и Mixture-of-Experts декодер, без транскрипции. Разбираем архитектуру, временную локализа
608
Экономика self-hosted моделей vs API: когда своё железо окупается в 2026 году
Сравниваем реальную стоимость решённой задачи на своём железе и через API. Точка безубыточности, скрытые риски и кейс с DeepSeek V3.2. Цифры, а не хайп.
609
Sapphire Radeon RX 9700: тихий инференс AI-моделей — замеры шума, сравнение с RX 7800 XT и тонкая настройка
Замеры шума Sapphire Radeon RX 9700 под нагрузкой Qwen 27B и Gemma 4 31B: 38-42 дБА в стоке, 32 дБА после андервольтинга. Сравнение с RX 7800 XT, таблицы произв
610
POCKET-35B: агентная модель 35B на CPU и смартфонах — тест производительности и сценарии развёртывания
POCKET-35B от FINAL-Bench — агентная 35B-модель, работающая на CPU через llama.cpp без CUDA. 59 токенов/с на Q2_K, запуск на сервере с 32 ГБ ОЗУ, Android с 8+ Г
611
Метод раскадровки для AI-видео: как получить управляемый сюжет вместо хаоса
Практический метод двухэтапной генерации AI-видео: от статичного сториборда к покадровой анимации. Готовые шаблоны промтов, техника стабильности персонажа и раз
612
Macaron-V1 на Qwen3.6-35B-A3B: архитектура, тесты и сравнение с Llama 3 и Qwen2.5
Macaron-V1 на Qwen3.6-35B-A3B: 35B параметров, 3B активных, 87 токенов/с на RTX 4090. Сравнили с Llama 3 и Qwen2.5 по бенчмаркам, кодингу и скорости. Готовые ко