Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Recursive Latent Forcing: как заставить Mamba2 'думать' в латентном пространстве и решать многопоточные задачи Как метод Recursive Latent Forcing заставляет Mamba2 работать в латентном пространстве, устраняя memory decay. Обзор возможностей, сравнение с Oro и Multiplex T 6 мин чтения 02 Как запустить Fish Audio S2 Pro на Mac: полный локальный TTS с клонированием голоса через MLX Пошаговое руководство по запуску Fish Audio S2 Pro на Apple Silicon с MLX. Локальный синтез речи с клонированием голоса и тегами выражения без облаков. 6 мин чтения 03 Синхронизация сессий OpenAI Codex между устройствами: обзор и установка codexSync Установка и обзор codexSync – CLI-инструмента для синхронизации сессий OpenAI Codex между разными компьютерами. Решение проблемы мультидевайсной работы. 4 мин чтения 04 Kreuzberg v4.5.0: как Rust выжал из Docling 280% скорости Обзор Kreuzberg v4.5.0 — Rust-движок для Docling с интеграцией RT-DETR v2, бенчмарками 2.8x скорости и поддержкой 12 языков программирования. 5 мин чтения 05 GPT-OSS-120B и Deepseek галлюцинируют на Mac? Вот почему и как это исправить Технический разбор причин галлюцинаций больших LLM моделей на Mac. Настройка температуры, контекста и квантования для GPT-OSS-120B и Deepseek. 5 мин чтения 06 Nemotron Cascade 2 Uncensored для Mac: обзор квантований JANG, производительность и установка Обзор квантованных версий Nemotron Cascade 2 Uncensored (JANG_4M, JANG_2L) для Mac. Производительность на M4 Ultra, сравнение с аналогами и инструкция по устано 5 мин чтения 07 SAP-RPT-1: тестируем табличную foundation-модель на Python. Архитектура и практическое применение Практический разбор SAP-RPT-1 — табличной foundation-модели от SAP. Архитектура Relational Pretrained Transformer, примеры кода на Python, сравнение с аналогами 9 мин чтения 08 SyGra Studio: визуальный конструктор AI-пайплайнов без кода — как настроить и отладить LLM-воркфлоу Как настроить сложные LLM-воркфлоу без единой строчки кода. Поддержка Ollama, vLLM, OpenAI, встроенная отладка и мониторинг затрат. 7 мин чтения 09 Paperclip: как управлять роем ИИ-агентов без потери рассудка Полный обзор open-source фреймворка Paperclip 3.0 (Node.js, PostgreSQL) для координации роя ИИ-агентов. Решение проблемы координационного налога, сравнение с ан 6 мин чтения 10 LangGraph Deploy CLI: развертывание production-агентов одной командой с Docker и CI/CD Обзор LangGraph Deploy CLI 2.1 для автоматического развертывания LangGraph агентов. Установка через uvx, команды deploy, logs, интеграция с CI/CD и Docker. 6 мин чтения 11 Nova Forge SDK: Когда кастомизация LLM перестала быть адом Практический разбор Nova Forge SDK от AWS. Как настроить модель Nova для бизнеса через SFT, RFT и DPO, избежав катастрофического забывания. Сравнение с альтерна 5 мин чтения 12 Автоматизация настройки llama.cpp для MoE-моделей: PowerShell-скрипт для поиска оптимальных nCpuMoe и batch size Готовый скрипт для автоматического подбора nCpuMoe и batch size в llama.cpp для MoE моделей типа Qwen 3.5 MOE. Экономит часы ручной настройки. 6 мин чтения