Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
1669
Self-hosted MCP сервер для финансовых данных: как подключить любой локальный LLM к реальным данным SEC, 13F и биржевым инсайдам
Как поднять свой MCP-сервер для финансовых данных, прикрутить к локальному LLM и получать свежие 13F, SEC filings и инсайдерские сделки без единого API-ключа.
1670
ChatGPT для личных финансов: как подключить банковские счета через Plaid и анализировать расходы
Интеграция ChatGPT с Plaid: подключаем банковские счета, анализируем траты и экономим. Пошаговая инструкция, сравнение с альтернативами и подводные камни.
1671
Почему ИИ внезапно начинает говорить на корейском? Разбираем механизм переключения языков в эмбеддинг-пространстве
Почему AI-ассистенты переключаются на корейский при смешивании китайского с английскими техническими терминами? Анализ embedding space, языковых аттракторов и т
1672
OpenMOSS: запускаем MOSS на чистом C++ через GGML — быстрый инференс без Python
OpenMOSS — инструмент для запуска китайской модели MOSS (16B MoE) на чистом C++ с GGML. Никакого Python, только бинарник. Сравнение с альтернативами, примеры и
1673
Фикс шаблона Qwen3.5 vision в vllm: как обновиться и избежать багов с изображениями
Важное исправление шаблона Qwen3.5 vision в vllm. Как обновиться, чтобы избежать багов с изображениями. Пошаговая инструкция для пользователей.
1674
Claude Code удваивает лимиты: интервью с продакт-лидом о росте 80x и стратегии 'lean harness'
Рост в 80 раз, новая стратегия 'lean harness' и удвоение лимитов — продакт-лид Anthropic о будущем Claude Code. Эксклюзивное интервью.
1675
MCP протокол: как работает USB-порт для ИИ и как его использовать в своих проектах
Узнайте, как Model Context Protocol превращает LLM в агентов с внешними инструментами. Архитектура, пошаговая настройка, безопасность и реальные кейсы.
1676
Три кита российского GenAI: разбираем архитектуры SimpleOne, BPMSoft и ELMA Cortex
Сравниваем архитектуры корпоративных GenAI-платформ: SimpleOne GenAI, BPMSoft AI и ELMA Cortex. Как выбрать платформу для внедрения ИИ в enterprise?
1677
Тестирование NVIDIA HGX B300: бенчмарки DeepSeek, Qwen и MiniMax в форматах NVFP4 и FP8
Подробные бенчмарки NVIDIA HGX B300 с DeepSeek, Qwen 3.5 397B и MiniMax M2.5 в форматах NVFP4 и FP8. Скорость, качество, расход VRAM — всё, что нужно знать о но
1678
MiniMax M2.7 ultra uncensored heretic: ставим на свой ПК и проверяем, насколько она реально без тормозов
Обзор нецензурированной версии MiniMax M2.7 в GGUF. Как установить на локальном ПК, замеры скорости, сравнение с аналогами. Результат — 4 отказа из 100.
1679
OpenArx: как открытая MCP-инфраструктура убивает платный доступ к науке и даёт агентам ключ к знаниям
Обзор OpenArx — open-source MCP-сервера для научных публикаций. Интеграция с LLM-агентами, замена платному Semantic Scholar, сравнение с альтернативами.
1680
Проблема повторной обработки больших промптов в llama.cpp: причины и решения для llama-swap
Глубокий разбор причин репроцессинга промптов в llama.cpp и пошаговое руководство по настройке кэширования KV-кэша через llama-swap для ускорения TTFT на больши