Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2101 Второй мозг для человека или для агента? Как цель строительства PKM меняет результат Разбираем, как цель ведения заметок (для себя или для LLM) меняет подход к PKM. Obsidian, Zettelkasten, AI-агенты — кто на самом деле пользуется твоим вторым мо 5 мин чтения 2102 Спутник научился видеть огонь: пайплайн LFM2.5-VL сжимает 450M параметров VLM в бортовой детектор пожаров Новый пайплайн LFM2.5-VL использует компактную Vision-Language модель для onboard-обработки снимков Sentinel-2. Пожары обнаруживаются без задержек на передачу д 4 мин чтения 2103 Open-source модели в Cursor: экономия без потери качества — разбор на цифрах Реальные цифры: как open-source LLM экономят до 90% бюджета на Cursor. Сравнение с Claude Opus и GPT-5.5. Тесты качества и инструкция по настройке. 4 мин чтения 2104 Mistral-Medium-3.5-128B на мульти-GPU: 4×RTX 3080 20GB (IQ4_XS) против 3×RTX 3090 72GB (Q3_K_M) — кто выживет в локальном аду? Подробное сравнение двух конфигураций для запуска Mistral-Medium-3.5-128B: 4×RTX 3080 20GB (IQ4_XS) против 3×RTX 3090 72GB (Q3_K_M). Тесты llama-bench, квантова 9 мин чтения 2105 5 ключевых метрик для стабильной работы self-hosted LLM в продакшене Queue Depth, Active Workers, Latency, Context Window Utilization, GPU Memory Fragmentation — 5 метрик, которые спасут ваш продакшен. Реальный кейс: увеличение к 8 мин чтения 2106 Создаём AI-репетитора по английскому на Go с Clean Architecture и четырьмя LLM: полный разбор кода Подробный гайд по созданию AI-репетитора английского языка на Go: Clean Architecture, интеграция GPT-4o, Claude, Mistral, Gemini. Архитектура, примеры кода, сра 10 мин чтения 2107 Как установить NVIDIA Tesla V100 SXM2 в ПК: полный гайд по адаптеру, настройке BIOS и драйверам Полное руководство по превращению серверного ускорителя V100 SXM2 в десктопную карту: выбор адаптера, настройка BIOS, установка драйверов и типичные ошибки. 10 мин чтения 2108 Как подключить Meshtastic к локальной LLM на ноутбуке: пошаговое руководство Пошаговое руководство по интеграции Meshtastic с Ollama на ноутбуке. Создайте децентрализованный офлайн-чатбот для удаленных регионов через LoRa. 7 мин чтения 2109 CSPNet: как разрезать карту признаков и получить больше за меньшее. Реализация с нуля и файт с DenseNet Разбираем CSPNet — почему DenseNet перегружена, как CSP-блок режет карту пополам, насколько быстрее и точнее. Пошаговая имплементация на PyTorch 2.6, замеры на 9 мин чтения 2110 Как исправить переполнение контекста в Opencode: решение проблемы повторного чтения файлов Проблема повторного чтения файлов в Opencode из-за переполнения контекста. Узнайте, как настроить управление контекстом, сбросить сессию и ускорить работу LLM с 6 мин чтения 2111 Inference Scaling: как reasoning модели сжигают ваши деньги и что с этим делать Разбираем, почему reasoning модели увеличивают счета за вычисления, и предлагаем фреймворк управления Cost-Quality-Latency. Практические советы и лайфхаки. 7 мин чтения 2112 Hummingbird+: FPGA-ускоритель для LLM за $150 – обзор производительности Qwen3-30B-A3B Q4 на 24GB FPGA-ускоритель Hummingbird+ запускает Qwen3-30B-A3B Q4 со скоростью 18 токенов/с на 24GB. Стоит $150 - реальная альтернатива GPU. Подробные тесты и сравнения. 4 мин чтения