Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Recursive Latent Forcing: как заставить Mamba2 'думать' в латентном пространстве и решать многопоточные задачи
Как метод Recursive Latent Forcing заставляет Mamba2 работать в латентном пространстве, устраняя memory decay. Обзор возможностей, сравнение с Oro и Multiplex T
02
Как запустить Fish Audio S2 Pro на Mac: полный локальный TTS с клонированием голоса через MLX
Пошаговое руководство по запуску Fish Audio S2 Pro на Apple Silicon с MLX. Локальный синтез речи с клонированием голоса и тегами выражения без облаков.
03
Синхронизация сессий OpenAI Codex между устройствами: обзор и установка codexSync
Установка и обзор codexSync – CLI-инструмента для синхронизации сессий OpenAI Codex между разными компьютерами. Решение проблемы мультидевайсной работы.
04
Kreuzberg v4.5.0: как Rust выжал из Docling 280% скорости
Обзор Kreuzberg v4.5.0 — Rust-движок для Docling с интеграцией RT-DETR v2, бенчмарками 2.8x скорости и поддержкой 12 языков программирования.
05
GPT-OSS-120B и Deepseek галлюцинируют на Mac? Вот почему и как это исправить
Технический разбор причин галлюцинаций больших LLM моделей на Mac. Настройка температуры, контекста и квантования для GPT-OSS-120B и Deepseek.
06
Nemotron Cascade 2 Uncensored для Mac: обзор квантований JANG, производительность и установка
Обзор квантованных версий Nemotron Cascade 2 Uncensored (JANG_4M, JANG_2L) для Mac. Производительность на M4 Ultra, сравнение с аналогами и инструкция по устано
07
SAP-RPT-1: тестируем табличную foundation-модель на Python. Архитектура и практическое применение
Практический разбор SAP-RPT-1 — табличной foundation-модели от SAP. Архитектура Relational Pretrained Transformer, примеры кода на Python, сравнение с аналогами
08
SyGra Studio: визуальный конструктор AI-пайплайнов без кода — как настроить и отладить LLM-воркфлоу
Как настроить сложные LLM-воркфлоу без единой строчки кода. Поддержка Ollama, vLLM, OpenAI, встроенная отладка и мониторинг затрат.
09
Paperclip: как управлять роем ИИ-агентов без потери рассудка
Полный обзор open-source фреймворка Paperclip 3.0 (Node.js, PostgreSQL) для координации роя ИИ-агентов. Решение проблемы координационного налога, сравнение с ан
10
LangGraph Deploy CLI: развертывание production-агентов одной командой с Docker и CI/CD
Обзор LangGraph Deploy CLI 2.1 для автоматического развертывания LangGraph агентов. Установка через uvx, команды deploy, logs, интеграция с CI/CD и Docker.
11
Nova Forge SDK: Когда кастомизация LLM перестала быть адом
Практический разбор Nova Forge SDK от AWS. Как настроить модель Nova для бизнеса через SFT, RFT и DPO, избежав катастрофического забывания. Сравнение с альтерна
12
Автоматизация настройки llama.cpp для MoE-моделей: PowerShell-скрипт для поиска оптимальных nCpuMoe и batch size
Готовый скрипт для автоматического подбора nCpuMoe и batch size в llama.cpp для MoE моделей типа Qwen 3.5 MOE. Экономит часы ручной настройки.