Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 Psyche Network Architecture: как арендовать чужую RTX за копейки и обучить свою LLM Psyche Network Architecture позволяет объединить GPU геймеров для обучения LLM. Разбираем, как это работает, плюсы и минусы, кому подойдет, и как это меняет рын 5 мин чтения 02 Qualcomm GenieX: 20 токен/с на Windows — ноутбук на Snapdragon наконец-то думает быстрее, чем вы печатаете Обзор GenieX SDK от Qualcomm: запуск Gemma 4 26B и Qwen 3.6 27B на Windows с производительностью до 20 токен/с. Сравнение с llama.cpp, Ollama и облачными решени 6 мин чтения 03 eval-harness: персонализированные оценки для локальных моделей и агентов — инструкция по применению Разбираем eval-harness — open-source CLI для кастомных бенчмарков LLM. Примеры, сравнение с альтернативами, лайфхаки для локальных и агентных систем. 5 мин чтения 04 Supra-Router-51M: компактная модель для маршрутизации промптов между LLM Обзор Supra-Router-51M — крошечной модели для выбора нужной LLM под задачу. Сравнение с альтернативами, примеры кода, рекомендации для разработчиков. 5 мин чтения 05 Agents-A1 GGUF на Mac: 262K контекста без компромиссов Как запустить модель Agents-A1 в GGUF с полным контекстом 262K на M1 Max и других Mac на Apple Silicon. Инструкция, бенчмарки, сравнение с альтернативами. 6 мин чтения 06 Gemini Spark на Mac: как я отдал рутину агенту и перестал кликать сам Обзор Gemini Spark на macOS — always-on агент для файлов, задач и Google Keep. Сравнение с Claude Desktop, Copilot. Примеры автоматизации. 7 мин чтения 07 NVFP4: Секретное оружие Blackwell, которое разгоняет LLM до предела Разбираем NVFP4 — новый формат точности на Blackwell. Почему он делает инференс LLM в 2 раза быстрее INT4 и как настроить его в llama.cpp. Тесты, сравнения, инс 4 мин чтения 08 FFASR Leaderboard: лаборатория против реальности — кто кого? Первый открытый сообщественный лидерборд для оценки ASR в реверберации и шуме. Сравнение с Open ASR, метрики WER/RTFx, результаты Apriel v1.6. Кому нужен и как 4 мин чтения 09 Prompt Warrior: как превратить логи Claude Code в геймифицированный психологический портрет Узнайте, как Prompt Warrior превращает сырые логи Claude Code в психологический профиль и ачивки. Опенсорс-инструмент для самоанализа и геймификации работы с AI 4 мин чтения 10 Context Engineering для RAG: четыре типизированных входа от Karpathy и LangChain — GitHub ноутбуки, которые меняют правила игры Разбираем четыре типизированных входа для RAG от Karpathy и LangChain. Практические ноутбуки на GitHub, код, примеры. Как не дать LLM врать и сэкономить контекс 7 мин чтения 11 Ecom-RLVE: Как выдрессировать e-commerce агента с помощью RL, чтобы он перестал болтать и начал продавать Разбираем Ecom-RLVE — фреймворк для обучения мульти-турных e-commerce агентов на Qwen 3 8B с помощью DAPO и верифицируемых сред. Код, конфиги, результаты. 8 мин чтения 12 GLM-5.2: Обзор модели с 1M контекстом и архитектурой IndexShare для длительных задач Разбираем GLM-5.2: архитектура IndexShare снижает FLOPs в 2.9x, 1M контекст, speculative decoding. Сравнение с DeepSeek V4, Ling-2.5-1T, бенчмарки FrontierSWE. 8 мин чтения