Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1669 Self-hosted MCP сервер для финансовых данных: как подключить любой локальный LLM к реальным данным SEC, 13F и биржевым инсайдам Как поднять свой MCP-сервер для финансовых данных, прикрутить к локальному LLM и получать свежие 13F, SEC filings и инсайдерские сделки без единого API-ключа. 6 мин чтения 1670 ChatGPT для личных финансов: как подключить банковские счета через Plaid и анализировать расходы Интеграция ChatGPT с Plaid: подключаем банковские счета, анализируем траты и экономим. Пошаговая инструкция, сравнение с альтернативами и подводные камни. 6 мин чтения 1671 Почему ИИ внезапно начинает говорить на корейском? Разбираем механизм переключения языков в эмбеддинг-пространстве Почему AI-ассистенты переключаются на корейский при смешивании китайского с английскими техническими терминами? Анализ embedding space, языковых аттракторов и т 3 мин чтения 1672 OpenMOSS: запускаем MOSS на чистом C++ через GGML — быстрый инференс без Python OpenMOSS — инструмент для запуска китайской модели MOSS (16B MoE) на чистом C++ с GGML. Никакого Python, только бинарник. Сравнение с альтернативами, примеры и 5 мин чтения 1673 Фикс шаблона Qwen3.5 vision в vllm: как обновиться и избежать багов с изображениями Важное исправление шаблона Qwen3.5 vision в vllm. Как обновиться, чтобы избежать багов с изображениями. Пошаговая инструкция для пользователей. 5 мин чтения 1674 Claude Code удваивает лимиты: интервью с продакт-лидом о росте 80x и стратегии 'lean harness' Рост в 80 раз, новая стратегия 'lean harness' и удвоение лимитов — продакт-лид Anthropic о будущем Claude Code. Эксклюзивное интервью. 4 мин чтения 1675 MCP протокол: как работает USB-порт для ИИ и как его использовать в своих проектах Узнайте, как Model Context Protocol превращает LLM в агентов с внешними инструментами. Архитектура, пошаговая настройка, безопасность и реальные кейсы. 8 мин чтения 1676 Три кита российского GenAI: разбираем архитектуры SimpleOne, BPMSoft и ELMA Cortex Сравниваем архитектуры корпоративных GenAI-платформ: SimpleOne GenAI, BPMSoft AI и ELMA Cortex. Как выбрать платформу для внедрения ИИ в enterprise? 4 мин чтения 1677 Тестирование NVIDIA HGX B300: бенчмарки DeepSeek, Qwen и MiniMax в форматах NVFP4 и FP8 Подробные бенчмарки NVIDIA HGX B300 с DeepSeek, Qwen 3.5 397B и MiniMax M2.5 в форматах NVFP4 и FP8. Скорость, качество, расход VRAM — всё, что нужно знать о но 5 мин чтения 1678 MiniMax M2.7 ultra uncensored heretic: ставим на свой ПК и проверяем, насколько она реально без тормозов Обзор нецензурированной версии MiniMax M2.7 в GGUF. Как установить на локальном ПК, замеры скорости, сравнение с аналогами. Результат — 4 отказа из 100. 5 мин чтения 1679 OpenArx: как открытая MCP-инфраструктура убивает платный доступ к науке и даёт агентам ключ к знаниям Обзор OpenArx — open-source MCP-сервера для научных публикаций. Интеграция с LLM-агентами, замена платному Semantic Scholar, сравнение с альтернативами. 6 мин чтения 1680 Проблема повторной обработки больших промптов в llama.cpp: причины и решения для llama-swap Глубокий разбор причин репроцессинга промптов в llama.cpp и пошаговое руководство по настройке кэширования KV-кэша через llama-swap для ускорения TTFT на больши 11 мин чтения