Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 barebrowse: дайте локальному агенту браузер без Playwright — обрезанные ARIA снимки для экономии токенов Обзор barebrowse: инструмент для подключения локальных LLM-агентов к браузеру через CDP, использует pruned ARIA snapshot для экономии контекста. Сравнение с аль 6 мин чтения 02 Silicon Office: как превратить ИИ-агентов в пиксельный офис — создание десктоп-обертки для Claude Code Обзор Silicon Office — десктоп-обертки для Claude Code на Electron. Как визуализировать работу ИИ-агентов в стиле пиксельного офиса. Сравнение с альтернативами, 6 мин чтения 03 6x MI50 против 6x P40: кто быстрее тащит MiniMax 139B? Сравнение 6x AMD MI50 и 6x NVIDIA P40 для инференса MiniMax M2.7 REAP 139B. Реальные бенчмарки, советы по сборке сервера и модификации BIOS. Выбираем бюджетную 5 мин чтения 04 MOSS-Transcribe-Diarize: open-source модель, которая убивает двух зайцев — транскрипцию и диаризацию Разбираем MOSS-Transcribe-Diarize — новую open-source модель на Hugging Face, которая объединяет распознавание речи и разделение дикторов. Сравнение с Cohere Tr 4 мин чтения 05 NVIDIA Puzzle-75B-A9B NVFP4: 132 токена/с на 3×RTX 3090 — обзор и настройка Разбираем NVFP4-квантование модели Puzzle-75B: как на трех RTX 3090 получить 132 токена/с. Реальная альтернатива Llama 3.1 и Qwen2.5. Гайд по запуску. 5 мин чтения 06 OpenMed 1.8: локальная клиническая деидентификация на Android, iOS и в браузере — Apache-2.0 инструмент, который не просит интернета Обзор OpenMed 1.8 — полностью локального инструмента с открытым кодом для деидентификации PHI на смартфонах и в браузере. Apache-2.0, ONNX Runtime, ML Kit. Срав 5 мин чтения 07 Создание 140 ГБ IQ2_XXS REAP квантизации GLM 5.2 для кодинга: полный гайд с imatrix и кодом Детальный разбор создания 140 ГБ IQ2_XXS REAP квантизации модели GLM 5.2 (179B) для локального запуска на кодинг-задачах. Сборка imatrix, код и сравнение с Q2_K 7 мин чтения 08 GPT-Live-1: OpenAI сделала голосовой диалог быстрее, чем ваш собеседник. Разбор полного дуплекса Разбираем GPT-Live-1 — новую full-duplex модель OpenAI с интеграцией GPT-5.5. Задержка 150 мс, прерывания, контекст. Сравнение с MichiAI и PersonaPlex. Кому реа 8 мин чтения 09 Ускорение инференса: запуск моделей transformers в vLLM с нативной производительностью (команды и бенчмарки) Пошаговая инструкция: как перевести Qwen3 на vLLM, реальные бенчмарки скорости, сравнение с PyTorch и TGI, типичные ошибки и советы по настройке. 8 мин чтения 10 Robostral Navigate: навигация робота с одной камерой и Mistral AI — обзор и код Полный обзор Robostral Navigate — open-source инструмента для монокулярной навигации роботов на базе Mistral AI. Сравнение с ORB-SLAM3, примеры кода и советы по 5 мин чтения 11 Kodacode v1.0: почему Koda Pro на GLM 5.2 уделывает Claude Code в реальных проектах Разбираем релиз Kodacode v1.0 с моделью Koda Pro на базе GLM 5.2. Сравнение с Claude Code по SWE-bench, агентный режим, цена и реальные кейсы. Кому стоит перехо 5 мин чтения 12 MIRA: мировая модель, симулирующая Rocket League для 4 игроков — код, датасет и демо в браузере Открытая мировая модель MIRA симулирует Rocket League в мультиплеере на 4 игрока. Код, датасет и браузерное демо — прорыв в симуляции для геймдева и RL. 3 мин чтения