Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
LongConspectWriter: как выжать конспект лекции из 8 ГБ и не потерять середину
Обзор мультиагентного пайплайна LongConspectWriter для локальных SLM. Как решить проблему деградации на длинных контекстах, уместиться в 8 ГБ VRAM и получить ст
02
Интеграция Nemotron 3.5 Content Safety: настройка мультимодальной безопасности для enterprise AI
Разбор архитектуры Nemotron 3.5 Content Safety: настройка кастомных политик, сравнение с конкурентами, примеры кода для RAG и агентов. Актуально на июнь 2026.
03
Mistral Small 4: открытый MoE-зверь с рассуждением, картинками и кодом — как приручить локально
Обзор Mistral Small 4 — 119B MoE от Mistral AI. Архитектура, мультимодальность, кодинг, рассуждения. Полный гайд по развёртыванию на своём железе.
04
Subquadratic SubQ: прорыв в скорости и контексте LLM — анализ заявлений и независимых тестов
Анализ заявлений Subquadratic о модели SubQ: 12x быстрее Transformer? Независимые тесты, сравнение с альтернативами, скепсис и практические рекомендации.
05
cocoindex-code: семантический поиск по коду для AI-агентов за две команды
Обзор cocoindex-code — инструмента семантического поиска по коду для AI-агентов. Установка за две команды, сравнение с аналогами, примеры использования на 2026
06
DreamX-World 1.0: Камера в кармане у модели мира — и никаких склеек
DreamX-World 1.0 — 5B параметров, Apache 2.0, управление камерой и память сцен. Сравнение с Runway, Google Genie, Yume1.5. Кому нужна и как работает.
07
semantic-memory: создаём локальную базу знаний на Rust с векторным поиском и MCP сервером
Обзор semantic-memory — инструмента на Rust для векторного поиска и гибридного хранения знаний через MCP. Сравнение с Mem0, Chroma и Qdrant. Примеры настройки.
08
TernML: запуск нейросетей на микроконтроллерах без FPU за 36 рублей — руководство и бенчмарки
TernML позволяет запустить тернарную нейросеть на STM32G031 за 36 руб. Реальные бенчмарки, пошаговый гайд и сравнение с альтернативами.
09
GLM 5.2: Китайцы снова пытаются. На этот раз — с эффективностью 98% и вдвое меньшим расходом токенов
Новый LLM от THUDM обещает революцию в токен-экономии. Реальность или маркетинг? Сравнение с альтернативами, примеры использования и кому подойдет.
10
Attention Algebra: когда грамматика текста превращается в музыку сфер
Обзор Attention Algebra — открытого инструмента для перевода естественного языка в спектрограммы с помощью формальной грамматики и Jungian типов. Сравнение с эм
11
Не пудри мне мозги, grep: как cocoindex-code нашел то, что искал Claude Code
Установи cocoindex-code за минуту и забудь про grep. Сравниваем с CodeGraph и SocratiCode. Как AI-агенты перестали тупить.
12
Две Radeon R9700, vLLM и проклятый long-context: как я заставил RDNA4 работать с 128K токенов
Пошаговое руководство по multi-GPU конфигурации AMD Radeon R9700 на vLLM: исправление бага long-context decode с помощью AITER Unified Attention, настройка FP8