Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 EMO — новая MoE-модель с эмерджентной модульностью: обзор архитектуры и как использовать 12.5% экспертов Разбираем архитектуру EMO от Allen AI: как модель сама выращивает модули из данных, почему достаточно 12.5% экспертов и как запустить веса с HuggingFace. 5 мин чтения 02 z-lab взял Gemma 4 и выжал из неё DFlash: обзор, установка и первые впечатления Разбираем новое квантование DFlash для Gemma 4 26B: установка, тесты скорости, сравнение с IQ4_XS и Bartowski. Когда 4 активных миллиарда работают как 26. 4 мин чтения 03 DS4: новый инференс-движок для DeepSeek 4 Flash на MacBook с 128GB – обзор и установка DS4 – специализированный движок для запуска DeepSeek 4 Flash на Mac с 128GB. Сравнение с MLX, llama.cpp, пошаговая установка и примеры использования. 6 мин чтения 04 Быстрее молнии: тестируем MLX-AgentCore 2.0 — новый AI-движок для Apple Silicon, разгоняющий агентов до 600 ток/с Подробный обзор MLX-AgentCore 2.0 — быстрого локального AI-движка для Mac на Apple Silicon. Тесты производительности, сравнение с Ollama и vLLM-MLX, примеры аге 5 мин чтения 05 Natural Language Autoencoders от Anthropic: как заглянуть в голову Gemma 3 Natural Language Autoencoders от Anthropic: декодируем внутренние состояния Gemma 3 в текст. Примеры, сравнение с альтернативами, инструкция по запуску. 6 мин чтения 06 ZAYA1-8B: Острый скальпель вместо кувалды — обзор компактной LLM от Zyphra Разбираем ZAYA1-8B: почему 8B модель от Zyphra обходит конкурентов, как запустить локально и стоит ли переходить с Llama 3. Тесты, архитектура, советы. 5 мин чтения 07 Как запустить модель 397B в 14 ГБ ОЗУ: реализация Paged MoE на Mac Studio Подробный обзор реализации Paged MoE для запуска Qwen3-397B на Mac Studio с 14 ГБ ОЗУ. Сравнение с Flash-MoE и Apple LLM in a Flash, шаги и результаты. 5 мин чтения 08 Как создать AI-подкаст и загрузить в Spotify за 10 минут: разбираем новый CLI-инструмент PodAgent Spotify выпустил PodAgent CLI для генерации подкастов через ИИ. Установка, пример промпта, сравнение с NotebookLM. Создайте свой первый AI-подкаст за 10 минут. 5 мин чтения 09 Codex CLI /goal: как работает автономный AI-агент на GPT-5.5 и сколько это реально стоит Разбор команды /goal в Codex CLI с GPT-5.5: как работает Ralph loop, permission profiles, реальный расход токенов и стоимость. Сравнение с Claude Code и Cursor. 7 мин чтения 10 OpenSeeker-v2: открытый Deep Research агент, который выучили на 10 000 примерах без RL — и это работает OpenSeeker-v2 — открытый агент для глубокого поиска, обученный на 10 600 синтетических примерах без RL. Сравнение с OpenAI, установка и примеры использования. 5 мин чтения 11 useknockout: бесплатная open-source альтернатива remove.bg и Topaz с удалением фона, апскейлом и реставрацией лиц — деплой на Modal за одну команду Обзор бесплатного инструмента useknockout для удаления фона, апскейла и реставрации лиц. Сравнение с remove.bg и Topaz, деплой на Modal одной командой. Кому под 5 мин чтения 12 ZAYA1-8B: Первая крупная LLM на железе AMD — что она умеет и стоит ли качать ZAYA1-8B — frontier 8B модель, обученная на GPU AMD. Разбираемся с возможностями, запускаем локально и сравниваем с Llama 3, Qwen 2.5 и Gemma 4. 6 мин чтения