Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6841 Temple Bridge: ваш личный офлайн-ассистент на Apple Silicon, который не забывает ничего Полный гайд по настройке офлайн-ассистента с памятью и доступом к файлам на базе Hermes-3 и MLX для Mac. Приватность без облаков. 4 мин чтения 6842 Data Poisoning: когда ваши тренировочные данные внезапно становятся оружием против вас Как обнаружить и защититься от data poisoning атак на тренировочные данные. Практическое руководство с примерами, методами защиты и реальными кейсами взлома ML 8 мин чтения 6843 Adaptive-K Routing: практический гайд по экономии 30-52% ресурсов на MoE-моделях (Mixtral, Qwen, OLMoE) Как Adaptive-K Routing экономит 30-52% вычислений на MoE-моделях. Практическое руководство по установке, настройке и использованию с TensorRT-LLM. 6 мин чтения 6844 С нуля на PyTorch: собираем свою GPT по учебнику Рашки. Почему это сложнее, чем кажется Пошаговая реализация GPT на PyTorch по книге Sebastian Raschka: токенизатор, трансформер-блоки, MultiHeadAttention, маскирование и авторегрессионное обучение. 11 мин чтения 6845 Когда LLM врет: отлавливаем галлюцинации линейкой в векторном пространстве Практическое руководство: как находить ложь в ответах LLM через анализ геометрии эмбеддингов. Без дополнительных моделей, только векторы и математика. 7 мин чтения 6846 Почему общие LLM проваливаются в юриспруденции: разбор архитектуры LabourLawLLM и специализированного бенчмарка Китайское исследование показало, почему общие LLM не справляются с юридическими задачами. Архитектура LabourLawLLM и специализированный бенчмарк из 12 типов зад 7 мин чтения 6847 Чёрная дыра для денег или золотая жила: считаем реальную стоимость Blackwell против облачных API Практический финансовый анализ: когда покупать Blackwell выгоднее, чем платить за GPT-4o? Считаем TCO, амортизацию и точку безубыточности. 7 мин чтения 6848 Пределы роста ИИ: разбор мифа о бесконечном масштабировании от Сэма Альтмана Сэм Альтман предупредил о потолке развития LLM. Почему законы масштабирования не вечны и что ждет ИИ после экспоненциального роста? 4 мин чтения 6849 Phind.com умер. Да здравствует локальный AI-поисковик на Open WebUI и агентах Пошаговый гайд по настройке локального AI-поисковика с веб-поиском. Агенты Open WebUI, обход блокировок, оптимизация скорости. Полная замена Phind.com. 9 мин чтения 6850 KoboldCpp 1.106: MCP серверы для локальных моделей — выкиньте Claude Desktop Полное руководство по настройке MCP серверов в KoboldCpp 1.106. Замена Claude Desktop для работы с тул-коллами на локальных моделях. 4 мин чтения 6851 Mamba изнутри: почему Delta-Gating — это не просто математика, а механизм выживания в море данных Глубокий разбор математики Delta-Gating в Mamba: как работает селективный механизм, дискретизация Zero-Order Hold и почему это ломает Transformer. Примеры и инт 7 мин чтения 6852 AutoRound: практическое руководство по квантованию моделей (на примере MiniMax-M2.1-REAP-40) Пошаговое руководство по квантованию MiniMax-M2.1-REAP-40 с AutoRound. Параметры nsamples=64, seqlen=512, device_map auto. Практические примеры и типичные ошибк 6 мин чтения