Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 LongConspectWriter: как выжать конспект лекции из 8 ГБ и не потерять середину Обзор мультиагентного пайплайна LongConspectWriter для локальных SLM. Как решить проблему деградации на длинных контекстах, уместиться в 8 ГБ VRAM и получить ст 6 мин чтения 02 Интеграция Nemotron 3.5 Content Safety: настройка мультимодальной безопасности для enterprise AI Разбор архитектуры Nemotron 3.5 Content Safety: настройка кастомных политик, сравнение с конкурентами, примеры кода для RAG и агентов. Актуально на июнь 2026. 4 мин чтения 03 Mistral Small 4: открытый MoE-зверь с рассуждением, картинками и кодом — как приручить локально Обзор Mistral Small 4 — 119B MoE от Mistral AI. Архитектура, мультимодальность, кодинг, рассуждения. Полный гайд по развёртыванию на своём железе. 6 мин чтения 04 Subquadratic SubQ: прорыв в скорости и контексте LLM — анализ заявлений и независимых тестов Анализ заявлений Subquadratic о модели SubQ: 12x быстрее Transformer? Независимые тесты, сравнение с альтернативами, скепсис и практические рекомендации. 4 мин чтения 05 cocoindex-code: семантический поиск по коду для AI-агентов за две команды Обзор cocoindex-code — инструмента семантического поиска по коду для AI-агентов. Установка за две команды, сравнение с аналогами, примеры использования на 2026 6 мин чтения 06 DreamX-World 1.0: Камера в кармане у модели мира — и никаких склеек DreamX-World 1.0 — 5B параметров, Apache 2.0, управление камерой и память сцен. Сравнение с Runway, Google Genie, Yume1.5. Кому нужна и как работает. 4 мин чтения 07 semantic-memory: создаём локальную базу знаний на Rust с векторным поиском и MCP сервером Обзор semantic-memory — инструмента на Rust для векторного поиска и гибридного хранения знаний через MCP. Сравнение с Mem0, Chroma и Qdrant. Примеры настройки. 1 мин чтения 08 TernML: запуск нейросетей на микроконтроллерах без FPU за 36 рублей — руководство и бенчмарки TernML позволяет запустить тернарную нейросеть на STM32G031 за 36 руб. Реальные бенчмарки, пошаговый гайд и сравнение с альтернативами. 6 мин чтения 09 GLM 5.2: Китайцы снова пытаются. На этот раз — с эффективностью 98% и вдвое меньшим расходом токенов Новый LLM от THUDM обещает революцию в токен-экономии. Реальность или маркетинг? Сравнение с альтернативами, примеры использования и кому подойдет. 4 мин чтения 10 Attention Algebra: когда грамматика текста превращается в музыку сфер Обзор Attention Algebra — открытого инструмента для перевода естественного языка в спектрограммы с помощью формальной грамматики и Jungian типов. Сравнение с эм 4 мин чтения 11 Не пудри мне мозги, grep: как cocoindex-code нашел то, что искал Claude Code Установи cocoindex-code за минуту и забудь про grep. Сравниваем с CodeGraph и SocratiCode. Как AI-агенты перестали тупить. 5 мин чтения 12 Две Radeon R9700, vLLM и проклятый long-context: как я заставил RDNA4 работать с 128K токенов Пошаговое руководство по multi-GPU конфигурации AMD Radeon R9700 на vLLM: исправление бага long-context decode с помощью AITER Unified Attention, настройка FP8 7 мин чтения