Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2101
Второй мозг для человека или для агента? Как цель строительства PKM меняет результат
Разбираем, как цель ведения заметок (для себя или для LLM) меняет подход к PKM. Obsidian, Zettelkasten, AI-агенты — кто на самом деле пользуется твоим вторым мо
2102
Спутник научился видеть огонь: пайплайн LFM2.5-VL сжимает 450M параметров VLM в бортовой детектор пожаров
Новый пайплайн LFM2.5-VL использует компактную Vision-Language модель для onboard-обработки снимков Sentinel-2. Пожары обнаруживаются без задержек на передачу д
2103
Open-source модели в Cursor: экономия без потери качества — разбор на цифрах
Реальные цифры: как open-source LLM экономят до 90% бюджета на Cursor. Сравнение с Claude Opus и GPT-5.5. Тесты качества и инструкция по настройке.
2104
Mistral-Medium-3.5-128B на мульти-GPU: 4×RTX 3080 20GB (IQ4_XS) против 3×RTX 3090 72GB (Q3_K_M) — кто выживет в локальном аду?
Подробное сравнение двух конфигураций для запуска Mistral-Medium-3.5-128B: 4×RTX 3080 20GB (IQ4_XS) против 3×RTX 3090 72GB (Q3_K_M). Тесты llama-bench, квантова
2105
5 ключевых метрик для стабильной работы self-hosted LLM в продакшене
Queue Depth, Active Workers, Latency, Context Window Utilization, GPU Memory Fragmentation — 5 метрик, которые спасут ваш продакшен. Реальный кейс: увеличение к
2106
Создаём AI-репетитора по английскому на Go с Clean Architecture и четырьмя LLM: полный разбор кода
Подробный гайд по созданию AI-репетитора английского языка на Go: Clean Architecture, интеграция GPT-4o, Claude, Mistral, Gemini. Архитектура, примеры кода, сра
2107
Как установить NVIDIA Tesla V100 SXM2 в ПК: полный гайд по адаптеру, настройке BIOS и драйверам
Полное руководство по превращению серверного ускорителя V100 SXM2 в десктопную карту: выбор адаптера, настройка BIOS, установка драйверов и типичные ошибки.
2108
Как подключить Meshtastic к локальной LLM на ноутбуке: пошаговое руководство
Пошаговое руководство по интеграции Meshtastic с Ollama на ноутбуке. Создайте децентрализованный офлайн-чатбот для удаленных регионов через LoRa.
2109
CSPNet: как разрезать карту признаков и получить больше за меньшее. Реализация с нуля и файт с DenseNet
Разбираем CSPNet — почему DenseNet перегружена, как CSP-блок режет карту пополам, насколько быстрее и точнее. Пошаговая имплементация на PyTorch 2.6, замеры на
2110
Как исправить переполнение контекста в Opencode: решение проблемы повторного чтения файлов
Проблема повторного чтения файлов в Opencode из-за переполнения контекста. Узнайте, как настроить управление контекстом, сбросить сессию и ускорить работу LLM с
2111
Inference Scaling: как reasoning модели сжигают ваши деньги и что с этим делать
Разбираем, почему reasoning модели увеличивают счета за вычисления, и предлагаем фреймворк управления Cost-Quality-Latency. Практические советы и лайфхаки.
2112
Hummingbird+: FPGA-ускоритель для LLM за $150 – обзор производительности Qwen3-30B-A3B Q4 на 24GB
FPGA-ускоритель Hummingbird+ запускает Qwen3-30B-A3B Q4 со скоростью 18 токенов/с на 24GB. Стоит $150 - реальная альтернатива GPU. Подробные тесты и сравнения.