Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

601 M2 Ultra 64 ГБ против M1 Ultra 128 ГБ: что выбрать для AI-нагрузок в 2026 году? Прямое сравнение M2 Ultra 64 ГБ и M1 Ultra 128 ГБ для инференса и тонкой настройки LLM. Тесты скорости, таблицы совместимости моделей и честный разбор, когда 12 9 мин чтения 602 RTX PRO 4500 vs RTX 5090 vs Multi-GPU: что выбрать для AI-задач в 2026 году Сравниваем RTX PRO 4500 (300 Вт), RTX 5090 (600 Вт) и 4×RTX 3090 для AI-задач. Расчёты TCO на 3 года, экономия до 10.7 млн рублей на 100 GPU, бенчмарки инференс 12 мин чтения 603 Свой open source AI-ассистент: архитектура, E2E-шифрование RAG и тематические помощники Детальный технический разбор опенсорсного AI-ассистента «Свой»: архитектура на Go, Vue 3 и PostgreSQL 17, долговременная память на pgvector, E2E-шифрованный RAG 8 мин чтения 604 Пределы возможностей малых моделей: упираемся ли мы в стену параметров или VRAM? Разбираем, существует ли жёсткий предел интеллекта для малых моделей (до 48GB VRAM). Анализ факторов: параметры, VRAM, датасет. Тесты Qwen3.6-27b и прогнозы. 8 мин чтения 605 Почему GLM-5.2 с архитектурой DSA падает на длинных контекстах: разбор ошибки NaN и тест конфигураций GPU/CPU GLM-5.2 с DSA выдаёт NaN-логиты при контексте больше 32k? Разбираем причину — переполнение f16 в indexer'е на GPU — и даём проверенные конфигурации для RTX 3060 8 мин чтения 606 Как AI-аналитика меняет спорт: разбор трёх кейсов на платформе AI4BI Разбираем, как платформа AI4BI автоматизирует сбор и анализ данных в спорте. Прогноз финала ЧМ-2026, скаутинг хоккеистов для КХЛ и персонализированная реабилита 12 мин чтения 607 GigaChat Audio 10B: аудио-native LLM с временной локализацией — архитектура и примеры GigaChat Audio 10B обрабатывает аудио напрямую через Conformer-энкодер и Mixture-of-Experts декодер, без транскрипции. Разбираем архитектуру, временную локализа 8 мин чтения 608 Экономика self-hosted моделей vs API: когда своё железо окупается в 2026 году Сравниваем реальную стоимость решённой задачи на своём железе и через API. Точка безубыточности, скрытые риски и кейс с DeepSeek V3.2. Цифры, а не хайп. 1 мин чтения 609 Sapphire Radeon RX 9700: тихий инференс AI-моделей — замеры шума, сравнение с RX 7800 XT и тонкая настройка Замеры шума Sapphire Radeon RX 9700 под нагрузкой Qwen 27B и Gemma 4 31B: 38-42 дБА в стоке, 32 дБА после андервольтинга. Сравнение с RX 7800 XT, таблицы произв 9 мин чтения 610 POCKET-35B: агентная модель 35B на CPU и смартфонах — тест производительности и сценарии развёртывания POCKET-35B от FINAL-Bench — агентная 35B-модель, работающая на CPU через llama.cpp без CUDA. 59 токенов/с на Q2_K, запуск на сервере с 32 ГБ ОЗУ, Android с 8+ Г 8 мин чтения 611 Метод раскадровки для AI-видео: как получить управляемый сюжет вместо хаоса Практический метод двухэтапной генерации AI-видео: от статичного сториборда к покадровой анимации. Готовые шаблоны промтов, техника стабильности персонажа и раз 9 мин чтения 612 Macaron-V1 на Qwen3.6-35B-A3B: архитектура, тесты и сравнение с Llama 3 и Qwen2.5 Macaron-V1 на Qwen3.6-35B-A3B: 35B параметров, 3B активных, 87 токенов/с на RTX 4090. Сравнили с Llama 3 и Qwen2.5 по бенчмаркам, кодингу и скорости. Готовые ко 7 мин чтения