Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
1920
материалов
01
Psyche Network Architecture: как арендовать чужую RTX за копейки и обучить свою LLM
Psyche Network Architecture позволяет объединить GPU геймеров для обучения LLM. Разбираем, как это работает, плюсы и минусы, кому подойдет, и как это меняет рын
02
Qualcomm GenieX: 20 токен/с на Windows — ноутбук на Snapdragon наконец-то думает быстрее, чем вы печатаете
Обзор GenieX SDK от Qualcomm: запуск Gemma 4 26B и Qwen 3.6 27B на Windows с производительностью до 20 токен/с. Сравнение с llama.cpp, Ollama и облачными решени
03
eval-harness: персонализированные оценки для локальных моделей и агентов — инструкция по применению
Разбираем eval-harness — open-source CLI для кастомных бенчмарков LLM. Примеры, сравнение с альтернативами, лайфхаки для локальных и агентных систем.
04
Supra-Router-51M: компактная модель для маршрутизации промптов между LLM
Обзор Supra-Router-51M — крошечной модели для выбора нужной LLM под задачу. Сравнение с альтернативами, примеры кода, рекомендации для разработчиков.
05
Agents-A1 GGUF на Mac: 262K контекста без компромиссов
Как запустить модель Agents-A1 в GGUF с полным контекстом 262K на M1 Max и других Mac на Apple Silicon. Инструкция, бенчмарки, сравнение с альтернативами.
06
Gemini Spark на Mac: как я отдал рутину агенту и перестал кликать сам
Обзор Gemini Spark на macOS — always-on агент для файлов, задач и Google Keep. Сравнение с Claude Desktop, Copilot. Примеры автоматизации.
07
NVFP4: Секретное оружие Blackwell, которое разгоняет LLM до предела
Разбираем NVFP4 — новый формат точности на Blackwell. Почему он делает инференс LLM в 2 раза быстрее INT4 и как настроить его в llama.cpp. Тесты, сравнения, инс
08
FFASR Leaderboard: лаборатория против реальности — кто кого?
Первый открытый сообщественный лидерборд для оценки ASR в реверберации и шуме. Сравнение с Open ASR, метрики WER/RTFx, результаты Apriel v1.6. Кому нужен и как
09
Prompt Warrior: как превратить логи Claude Code в геймифицированный психологический портрет
Узнайте, как Prompt Warrior превращает сырые логи Claude Code в психологический профиль и ачивки. Опенсорс-инструмент для самоанализа и геймификации работы с AI
10
Context Engineering для RAG: четыре типизированных входа от Karpathy и LangChain — GitHub ноутбуки, которые меняют правила игры
Разбираем четыре типизированных входа для RAG от Karpathy и LangChain. Практические ноутбуки на GitHub, код, примеры. Как не дать LLM врать и сэкономить контекс
11
Ecom-RLVE: Как выдрессировать e-commerce агента с помощью RL, чтобы он перестал болтать и начал продавать
Разбираем Ecom-RLVE — фреймворк для обучения мульти-турных e-commerce агентов на Qwen 3 8B с помощью DAPO и верифицируемых сред. Код, конфиги, результаты.
12
GLM-5.2: Обзор модели с 1M контекстом и архитектурой IndexShare для длительных задач
Разбираем GLM-5.2: архитектура IndexShare снижает FLOPs в 2.9x, 1M контекст, speculative decoding. Сравнение с DeepSeek V4, Ling-2.5-1T, бенчмарки FrontierSWE.