Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5185 SDF Protocol: как запустить локальные модели для извлечения структурированных данных из веб-страниц в JSON Руководство по SDF Protocol для извлечения структурированных данных. Запуск моделей Qwen2.5 и SmolLM3 через Ollama, квантование Q4_K_M, сравнение и примеры для 7 мин чтения 5186 Как локально обучить LLM на запрещённых датасетах (на примере MechaEpstein-8000): обход цензуры и создание GGUF Пошаговый гайд по локальному обучению LLM на этических датасетах: обход ограничений, генерация данных, создание GGUF моделей на примере MechaEpstein-8000. Полна 11 мин чтения 5187 Математика против галлюцинаций: как AWS Automated Reasoning заставляет LLM доказывать свои ответы Как использовать математические доказательства для проверки ответов LLM и борьбы с галлюцинациями. Архитектура и open-source пример от AWS на 2026 год. 5 мин чтения 5188 Qwen3-Coder-Next: обзор и тестирование лучшей локальной модели для общего общения Тестирование Qwen3-Coder-Next как универсальной модели для общения. Сравнение с альтернативами, примеры диалогов и рекомендации по использованию на 09.02.2026 6 мин чтения 5189 Промпт-инжиниринг 2026: когда магия превращается в математику Как эволюционные алгоритмы и градиентные методы заменяют интуицию в промпт-инжиниринге. TextGrad, MetaPrompt и будущее оптимизации LLM. 6 мин чтения 5190 ChatGPT vs Gemini vs Claude: стресс-тест на логику, креативность и зрение (не бенчмарки) Практическое сравнение ChatGPT 5.2, Gemini 3 и Claude 4.5 на реальных задачах: логические головоломки, креативные промпты и анализ изображений. Кто реально лучш 8 мин чтения 5191 Transformers.js v4 Preview: WebGPU-ускорение моделей на Node.js, Bun и Deno вышло из браузера Первые впечатления от Transformers.js v4 Preview: запускаем WebGPU-модели в Node.js, Bun и Deno без браузера. Установка, сравнение и примеры использования. 5 мин чтения 5192 Сборка ПК для запуска MoE-моделей в 1 триллион параметров: разбор железного плана для Kimi K2.5 Полный гайд по сборке ПК для запуска Kimi K2.5 (1.2 трлн параметров). Спецификации, распределение памяти, стратегия масштабирования. RTX PRO 6000, 1TB RAM, опти 10 мин чтения 5193 Полный стек для агентов на Amazon Bedrock: развертывание шаблона FAST (Fullstack AgentCore Solution Template) Пошаговое руководство по развертыванию FAST шаблона для AI-агентов на Amazon Bedrock. CDK, React, Cognito - готовый стек за полчаса. 6 мин чтения 5194 Как масштабировать тонкую настройку LLM с Hugging Face и Amazon SageMaker: полное руководство Практическое руководство по масштабированию fine-tuning больших языковых моделей с использованием LoRA, Hugging Face и Amazon SageMaker. Оптимизация затрат и пр 7 мин чтения 5195 ACE-Step 1.5: промпты, которые работают, а не просто болтают Конкретные техники промпт-инжиниринга для ACE-Step 1.5: разделение тегов и текста, управление структурой и ритмом. Практические примеры промптов для музыкантов 5 мин чтения 5196 InfiniMind: бывшие инженеры Google вскрывают «темные» видеоархивы Стартап бывших инженеров Google превращает терабайты неструктурированного видео в бизнес-аналитику с помощью мультимодального ИИ. Как это работает в 2026. 7 мин чтения