Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Nex-N2-Mini-Ultra-Uncensored-Heretic: Модель, которая думает как агент и плюет на запреты
Разбираем Nexus-N2-Mini-Ultra-Uncensored-Heretic — 8B модель без цензуры с agentic thinking, GGUF и safetensors. Сравнение, запуск, KLD метрика и примеры.
02
Запуск JavaScript из LLM в браузере: новая фича llama.cpp Web UI через Web Workers
Разбираем новую функцию llama.cpp — выполнение JavaScript кода через Web Workers. Как это превращает локальную LLM в автономного веб-агента, риски и кому это ну
03
Qwen-AgentWorld-35B-A3B: новая модель для агентов и кодинга – обзор бенчмарков
Разбираем свежую MoE-модель от Qwen: 35B параметров, но активны только 3B. Результаты на SWE-bench, MCP, AgentBench и сравнение с DeepSeek.
04
Baidu Unlimited-OCR: распознавание документов любой длины за один проход — первый обзор
Новая модель Baidu Unlimited-OCR снимает ограничение по длине текста. One forward pass для сотен страниц. Сравнение с Qianfan, Nemotron и GLM-OCR. Примеры и ком
05
llama.cpp: гранит, эмбеддинги и вулкан — три кита нового релиза
Свежий релиз llama.cpp: локальная речь от IBM, эмбеддинги нового поколения и прокачанный Vulkan. Как это ускоряет работу и кому реально пригодится.
06
Бесплатная связка для AI-агентов: как заменить дорогой Context7 локальным MCP-сервером (замеры 8 альтернатив)
Context7 дорог и медленен? Собираем локальный MCP-сервер на @neuledge и llama.cpp. Тесты 8 альтернатив — цифры, команды, сравнение скорости и точности.
07
Qwen-AgentWorld-35B-A3B: Мир в 35 миллиардов, где активны только 3
Обзор Qwen-AgentWorld-35B-A3B — 35B MoE с 3B активными параметрами. Как World Model предсказывает состояния среды в MCP, SWE, терминале. Примеры использования и
08
650+ медицинских NER-моделей на Mac: как MLX разгоняет PyTorch в 30 раз
Открытый репозиторий с 650+ медицинскими NER и деидентификационными моделями под Apache-2.0. Запускаем на Mac через MLX — ускорение до 40x против PyTorch-CPU. Б
09
GLM 5.2 на Mac Studio с 512 ГБ: префилл >100 t/s и никаких компромиссов
Реальный опыт запуска GLM 5.2 в 4-bit на Mac Studio M3 Ultra с 512GB Unified Memory. Префилл >100 t/s, контекст 100k, сравнение с NVIDIA RTX 4090.
10
Как реализовать multi-tenancy с Amazon Bedrock AgentCore: пошаговое руководство с примерами кода
Полное руководство по реализации мультитенантности для AI-агентов на Amazon Bedrock AgentCore. Изоляция, cost tracking, код и архитектурные паттерны.
11
VibeThinker 3B: как маленькая модель обходит Opus 4.5 в рассуждениях — разбор метода SFT+GRPO
Узнайте, как открытая 3B-модель VibeThinker превосходит проприетарного гиганта Opus 4.5 благодаря комбинации SFT и GRPO. Примеры, бенчмарки, советы по запуску.
12
Создаём агентные приложения с CUGA: обзор 24 рабочих примеров на лёгком каркасе от IBM
Обзор 24 готовых примеров агентных приложений на CUGA — легком каркасе от IBM. pip install cuga, архитектура, сравнение с LangChain, советы разработчикам.