Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5185
SDF Protocol: как запустить локальные модели для извлечения структурированных данных из веб-страниц в JSON
Руководство по SDF Protocol для извлечения структурированных данных. Запуск моделей Qwen2.5 и SmolLM3 через Ollama, квантование Q4_K_M, сравнение и примеры для
5186
Как локально обучить LLM на запрещённых датасетах (на примере MechaEpstein-8000): обход цензуры и создание GGUF
Пошаговый гайд по локальному обучению LLM на этических датасетах: обход ограничений, генерация данных, создание GGUF моделей на примере MechaEpstein-8000. Полна
5187
Математика против галлюцинаций: как AWS Automated Reasoning заставляет LLM доказывать свои ответы
Как использовать математические доказательства для проверки ответов LLM и борьбы с галлюцинациями. Архитектура и open-source пример от AWS на 2026 год.
5188
Qwen3-Coder-Next: обзор и тестирование лучшей локальной модели для общего общения
Тестирование Qwen3-Coder-Next как универсальной модели для общения. Сравнение с альтернативами, примеры диалогов и рекомендации по использованию на 09.02.2026
5189
Промпт-инжиниринг 2026: когда магия превращается в математику
Как эволюционные алгоритмы и градиентные методы заменяют интуицию в промпт-инжиниринге. TextGrad, MetaPrompt и будущее оптимизации LLM.
5190
ChatGPT vs Gemini vs Claude: стресс-тест на логику, креативность и зрение (не бенчмарки)
Практическое сравнение ChatGPT 5.2, Gemini 3 и Claude 4.5 на реальных задачах: логические головоломки, креативные промпты и анализ изображений. Кто реально лучш
5191
Transformers.js v4 Preview: WebGPU-ускорение моделей на Node.js, Bun и Deno вышло из браузера
Первые впечатления от Transformers.js v4 Preview: запускаем WebGPU-модели в Node.js, Bun и Deno без браузера. Установка, сравнение и примеры использования.
5192
Сборка ПК для запуска MoE-моделей в 1 триллион параметров: разбор железного плана для Kimi K2.5
Полный гайд по сборке ПК для запуска Kimi K2.5 (1.2 трлн параметров). Спецификации, распределение памяти, стратегия масштабирования. RTX PRO 6000, 1TB RAM, опти
5193
Полный стек для агентов на Amazon Bedrock: развертывание шаблона FAST (Fullstack AgentCore Solution Template)
Пошаговое руководство по развертыванию FAST шаблона для AI-агентов на Amazon Bedrock. CDK, React, Cognito - готовый стек за полчаса.
5194
Как масштабировать тонкую настройку LLM с Hugging Face и Amazon SageMaker: полное руководство
Практическое руководство по масштабированию fine-tuning больших языковых моделей с использованием LoRA, Hugging Face и Amazon SageMaker. Оптимизация затрат и пр
5195
ACE-Step 1.5: промпты, которые работают, а не просто болтают
Конкретные техники промпт-инжиниринга для ACE-Step 1.5: разделение тегов и текста, управление структурой и ритмом. Практические примеры промптов для музыкантов
5196
InfiniMind: бывшие инженеры Google вскрывают «темные» видеоархивы
Стартап бывших инженеров Google превращает терабайты неструктурированного видео в бизнес-аналитику с помощью мультимодального ИИ. Как это работает в 2026.