Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Nex-N2-Mini-Ultra-Uncensored-Heretic: Модель, которая думает как агент и плюет на запреты Разбираем Nexus-N2-Mini-Ultra-Uncensored-Heretic — 8B модель без цензуры с agentic thinking, GGUF и safetensors. Сравнение, запуск, KLD метрика и примеры. 1 мин чтения 02 Запуск JavaScript из LLM в браузере: новая фича llama.cpp Web UI через Web Workers Разбираем новую функцию llama.cpp — выполнение JavaScript кода через Web Workers. Как это превращает локальную LLM в автономного веб-агента, риски и кому это ну 4 мин чтения 03 Qwen-AgentWorld-35B-A3B: новая модель для агентов и кодинга – обзор бенчмарков Разбираем свежую MoE-модель от Qwen: 35B параметров, но активны только 3B. Результаты на SWE-bench, MCP, AgentBench и сравнение с DeepSeek. 4 мин чтения 04 Baidu Unlimited-OCR: распознавание документов любой длины за один проход — первый обзор Новая модель Baidu Unlimited-OCR снимает ограничение по длине текста. One forward pass для сотен страниц. Сравнение с Qianfan, Nemotron и GLM-OCR. Примеры и ком 5 мин чтения 05 llama.cpp: гранит, эмбеддинги и вулкан — три кита нового релиза Свежий релиз llama.cpp: локальная речь от IBM, эмбеддинги нового поколения и прокачанный Vulkan. Как это ускоряет работу и кому реально пригодится. 1 мин чтения 06 Бесплатная связка для AI-агентов: как заменить дорогой Context7 локальным MCP-сервером (замеры 8 альтернатив) Context7 дорог и медленен? Собираем локальный MCP-сервер на @neuledge и llama.cpp. Тесты 8 альтернатив — цифры, команды, сравнение скорости и точности. 4 мин чтения 07 Qwen-AgentWorld-35B-A3B: Мир в 35 миллиардов, где активны только 3 Обзор Qwen-AgentWorld-35B-A3B — 35B MoE с 3B активными параметрами. Как World Model предсказывает состояния среды в MCP, SWE, терминале. Примеры использования и 6 мин чтения 08 650+ медицинских NER-моделей на Mac: как MLX разгоняет PyTorch в 30 раз Открытый репозиторий с 650+ медицинскими NER и деидентификационными моделями под Apache-2.0. Запускаем на Mac через MLX — ускорение до 40x против PyTorch-CPU. Б 8 мин чтения 09 GLM 5.2 на Mac Studio с 512 ГБ: префилл >100 t/s и никаких компромиссов Реальный опыт запуска GLM 5.2 в 4-bit на Mac Studio M3 Ultra с 512GB Unified Memory. Префилл >100 t/s, контекст 100k, сравнение с NVIDIA RTX 4090. 5 мин чтения 10 Как реализовать multi-tenancy с Amazon Bedrock AgentCore: пошаговое руководство с примерами кода Полное руководство по реализации мультитенантности для AI-агентов на Amazon Bedrock AgentCore. Изоляция, cost tracking, код и архитектурные паттерны. 7 мин чтения 11 VibeThinker 3B: как маленькая модель обходит Opus 4.5 в рассуждениях — разбор метода SFT+GRPO Узнайте, как открытая 3B-модель VibeThinker превосходит проприетарного гиганта Opus 4.5 благодаря комбинации SFT и GRPO. Примеры, бенчмарки, советы по запуску. 4 мин чтения 12 Создаём агентные приложения с CUGA: обзор 24 рабочих примеров на лёгком каркасе от IBM Обзор 24 готовых примеров агентных приложений на CUGA — легком каркасе от IBM. pip install cuga, архитектура, сравнение с LangChain, советы разработчикам. 6 мин чтения