Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6925 Как мы собирали датасет для ML-инструмента, который спасает жизни: этический минное поле и методология, которая работает Практический разбор сбора датасета для ML-инструмента по предотвращению суицидов. Этические ловушки, методология анонимизации, работа с психологами от команды П 8 мин чтения 6926 DGX SPARK vs Mac M3 Ultra: подробное сравнение железа для локальных LLM с контекстом 128K+ Практическое сравнение DGX SPARK и Mac M3 Ultra для работы с локальными LLM с длинным контекстом, RAG и генерацией. Тесты скорости, памяти, TTFT. 6 мин чтения 6927 Кейс: Как перевести корпоративный RAG-агент с OpenAI на локальную Llama 3 и сэкономить за 5 месяцев Детальный разбор кейса миграции корпоративного RAG-агента с дорогого OpenAI API на локальную Llama 3 70B. Расчет окупаемости за 5 месяцев, выбор железа (NVIDIA 8 мин чтения 6928 FLUX.2 [klein]: тестируем новую модель для генерации и редактирования изображений в реальном времени Black Forest Labs выпустила FLUX.2 klein — 4B модель для генерации и редактирования изображений в реальном времени. Apache 2.0, субсекундный инференс, 13 ГБ VRA 5 мин чтения 6929 Step-Audio-R1.1: тестирование аудиомодели с рекордной точностью 96.4% и временем отклика 1.51с Тестирование Step-Audio-R1.1 - аудиомодели с рекордными 96.4% на BigBench Audio и временем отклика 1.51 секунды. Архитектура, сравнение, примеры использования. 5 мин чтения 6930 Кодинг на RTX 3060 12GB: GPT-OSS-120B, MiniMax-2.1 и GLM-4.7 — кто реально пишет код, а кто жрёт память? Практический тест: какая модель лучше пишет код на RTX 3060 12GB. Сравнение квантований REAP-40, q3, производительности и качества кода. 8 мин чтения 6931 RTX 5090 + RTX Pro 4500: как собрать ПК, который не сгорит от игр и не задохнется от AI Пошаговый гайд по сборке уникального ПК с RTX 5090 для игр и RTX Pro 4500 для AI. Разделение задач, разгон, энергопотребление 2-150 Вт, производительность 30-20 8 мин чтения 6932 Обзор свежих исследований RAG: от Agentic RAG до GraphRAG и BayesRAG Подробный разбор последних исследований RAG: Agentic RAG для автономных агентов, GraphRAG для семантических связей, BayesRAG для вероятностного поиска. Сравнени 8 мин чтения 6933 Сколько VRAM реально нужно для локальных LLM: история переоценки запросов сообщества Анализ эволюции запросов к видеопамяти для локальных LLM. Почему сообщество LocalLLaMA переоценивало требования и как современные технологии меняют правила игры 7 мин чтения 6934 Бюджетный ИИ-ПК: RTX 5060 Ti 16GB против двух RTX 3060. Где спрятаны подводные камни? Практическое сравнение конфигураций для локального ИИ: одна мощная RTX 5060 Ti 16GB или две бюджетные RTX 3060. Разбираем роль системной RAM, скрытые расходы и 9 мин чтения 6935 Локальный RAG для 4 миллионов PDF: как не сломать сервер и не потерять данные Пошаговое руководство по созданию локального RAG-поисковика для миллионов PDF с OCR. Архитектура, инструменты, безопасность данных и оптимизация производительно 8 мин чтения 6936 AMD для LLM: почему все ругают, но половина всё равно покупает ROCm, драйверы, ошибки выделения памяти — разбираем реальные проблемы запуска LLM на AMD. Что работает, а что нет в 2025 году. 5 мин чтения