Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6841
Temple Bridge: ваш личный офлайн-ассистент на Apple Silicon, который не забывает ничего
Полный гайд по настройке офлайн-ассистента с памятью и доступом к файлам на базе Hermes-3 и MLX для Mac. Приватность без облаков.
6842
Data Poisoning: когда ваши тренировочные данные внезапно становятся оружием против вас
Как обнаружить и защититься от data poisoning атак на тренировочные данные. Практическое руководство с примерами, методами защиты и реальными кейсами взлома ML
6843
Adaptive-K Routing: практический гайд по экономии 30-52% ресурсов на MoE-моделях (Mixtral, Qwen, OLMoE)
Как Adaptive-K Routing экономит 30-52% вычислений на MoE-моделях. Практическое руководство по установке, настройке и использованию с TensorRT-LLM.
6844
С нуля на PyTorch: собираем свою GPT по учебнику Рашки. Почему это сложнее, чем кажется
Пошаговая реализация GPT на PyTorch по книге Sebastian Raschka: токенизатор, трансформер-блоки, MultiHeadAttention, маскирование и авторегрессионное обучение.
6845
Когда LLM врет: отлавливаем галлюцинации линейкой в векторном пространстве
Практическое руководство: как находить ложь в ответах LLM через анализ геометрии эмбеддингов. Без дополнительных моделей, только векторы и математика.
6846
Почему общие LLM проваливаются в юриспруденции: разбор архитектуры LabourLawLLM и специализированного бенчмарка
Китайское исследование показало, почему общие LLM не справляются с юридическими задачами. Архитектура LabourLawLLM и специализированный бенчмарк из 12 типов зад
6847
Чёрная дыра для денег или золотая жила: считаем реальную стоимость Blackwell против облачных API
Практический финансовый анализ: когда покупать Blackwell выгоднее, чем платить за GPT-4o? Считаем TCO, амортизацию и точку безубыточности.
6848
Пределы роста ИИ: разбор мифа о бесконечном масштабировании от Сэма Альтмана
Сэм Альтман предупредил о потолке развития LLM. Почему законы масштабирования не вечны и что ждет ИИ после экспоненциального роста?
6849
Phind.com умер. Да здравствует локальный AI-поисковик на Open WebUI и агентах
Пошаговый гайд по настройке локального AI-поисковика с веб-поиском. Агенты Open WebUI, обход блокировок, оптимизация скорости. Полная замена Phind.com.
6850
KoboldCpp 1.106: MCP серверы для локальных моделей — выкиньте Claude Desktop
Полное руководство по настройке MCP серверов в KoboldCpp 1.106. Замена Claude Desktop для работы с тул-коллами на локальных моделях.
6851
Mamba изнутри: почему Delta-Gating — это не просто математика, а механизм выживания в море данных
Глубокий разбор математики Delta-Gating в Mamba: как работает селективный механизм, дискретизация Zero-Order Hold и почему это ломает Transformer. Примеры и инт
6852
AutoRound: практическое руководство по квантованию моделей (на примере MiniMax-M2.1-REAP-40)
Пошаговое руководство по квантованию MiniMax-M2.1-REAP-40 с AutoRound. Параметры nsamples=64, seqlen=512, device_map auto. Практические примеры и типичные ошибк