Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3469
Миграция с Amazon Nova 1 на Nova 2 в Bedrock: инструкция по API, контекст 1M токенов и активация Extended Thinking
Полное руководство по миграции с Amazon Nova 1 на Nova 2 в Bedrock на 18.03.2026. Контекст 1 млн токенов, Converse API, Extended Thinking, web grounding, пример
3470
Qianfan-OCR 4B: как заменить громоздкий пайплайн одной моделью для распознавания документов на 192 языках
Обзор Qianfan-OCR 4B — модели, которая распознает документы на 192 языках без сложных пайплайнов. Сравнение с Gemini, тесты OmniDocBench, квантование W8A8.
3471
Чип Nvidia для always-on распознавания лиц: архитектура, энергоэффективность и сценарии применения
Новый SoC AOV-100 от Nvidia потребляет менее 5 мВт для непрерывного распознавания лиц. Архитектура, принцип работы и реальные применения на 2026 год.
3472
AFM MLX 0.9.7: полный обзор продвинутой обёртки для локальных LLM на Mac с Telegram-ботом и грамматическим декодированием
Обзор AFM MLX 0.9.7 - инструмента для запуска локальных LLM на Apple Silicon с Telegram-ботом, грамматическим декодированием и кэшированием префиксов.
3473
SAP RPT-1: как одна табличная модель съедает целый зоопарк бизнес-ML
Разбираем SAP RPT-1 — революционную модель для табличных данных, которая может заменить сотни узких ML-решений. Что это значит для бизнес-аналитики в 2026 году.
3474
Взлом песочницы NemoClaw: запуск локального агента Nemotron 9B на одной видеокарте RTX 5090
Технический гайд: как обойти изоляцию NemoClaw, поднять локальный vLLM инстанс с Nemotron 9B на RTX 5090 и настроить tool_calls. Полный контроль вместо облака.
3475
Сравнение архитектур LLM: от GPT до DeepSeek V3 и Llama 4 — эволюция за 7 лет
Как трансформеры выросли за 7 лет: от простого внимания к RoPE, GQA и SwiGLU. Сравнение архитектур DeepSeek V3 и Llama 4 на март 2026.
3476
Как внедрить ИИ-помощник на RAG-архитектуре: разбор кейса BIM Inspector с ускорением адаптации сотрудников на 80%
Практический гайд по внедрению RAG-архитектуры для ИИ-помощника. Разбираем кейс BIM Inspector: как сократить адаптацию сотрудников с 4 недель до 5 дней. Пошагов
3477
AI-код в суде: кто платит за галлюцинации Copilot в 2026 году
IT-юрист объясняет, кто владеет кодом из Copilot и AI-ассистентов в 2026. Как избежать исков за авторские права и защитить компанию. Анализ дел и договоров.
3478
Omnicoder-Claude-4.6-Opus-Uncensored: полное руководство по мержу и квантованию разблокированных моделей Qwen 3.5
Пошаговый гайд по созданию uncensored-модели через Add Difference merge и квантование в GGUF. Актуально на март 2026.
3479
Атака на RAG-системы: как защитить ChromaDB и LM Studio от 95% отравления базы знаний
95% атак на RAG проходят успешно. Пошаговый план защиты ChromaDB и LM Studio: обнаружение аномалий эмбеддингов, настройка chunking, валидация контента.
3480
Qwen 3.5: dense или MoE? Выбор модели и железа (AMD vs NVIDIA) для локального кодирования
Полное руководство: какую архитектуру Qwen 3.5 выбрать, какое железо купить (NVIDIA RTX 5090 или AMD) и какое квантование взять для локального AI-кодинга в 2026