Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1909 Реалистичные бенчмарки для LLM: как тестировать модели с длинным контекстом и агентными сценариями Как тестировать LLM на длинном контексте и агентных задачах. Разбираем проблемы существующих бенчмарков, даем пошаговый план создания реалистичных тестов. 1 мин чтения 1910 z-lab взял Gemma 4 и выжал из неё DFlash: обзор, установка и первые впечатления Разбираем новое квантование DFlash для Gemma 4 26B: установка, тесты скорости, сравнение с IQ4_XS и Bartowski. Когда 4 активных миллиарда работают как 26. 4 мин чтения 1911 Hermes против OpenClaw: какой AI-агент выбрать? Детальное сравнение и критерии выбора Детальное сравнение Hermes Agent 4.2 и OpenClaw: производительность, стабильность, экономия токенов. Критерии выбора для разработчиков AI-агентов в 2026 году. 6 мин чтения 1912 Как ИИ-агенты помогли создать нетривиальную фичу для Ghostty: разбор процесса и стоимости токенов Реальный кейс: AI-агенты (Claude, GPT-4) написали функцию автообновления для терминала Ghostty за $0.20. Разбираем процесс, стоимость токенов и сравниваем с раб 5 мин чтения 1913 DS4: новый инференс-движок для DeepSeek 4 Flash на MacBook с 128GB – обзор и установка DS4 – специализированный движок для запуска DeepSeek 4 Flash на Mac с 128GB. Сравнение с MLX, llama.cpp, пошаговая установка и примеры использования. 6 мин чтения 1914 Создаём маркетинговый сайт без дизайнера: 5 практик с Open Design и Claude Code Соберите стильный лендинг за день без найма дизайнера. 5 проверенных практик с Open Design и Claude Code, актуальных на май 2026. 8 мин чтения 1915 Как построить централизованный AI Kit для нескольких продуктовых команд: опыт, цифры и грабли Реальный кейс: 8 команд, единый AI Kit, multi-agent CI-ревью, 47% acceptance rate, снижение времени review на 32% и цена $0.05 за PR. Грабли и решения для платф 7 мин чтения 1916 Быстрее молнии: тестируем MLX-AgentCore 2.0 — новый AI-движок для Apple Silicon, разгоняющий агентов до 600 ток/с Подробный обзор MLX-AgentCore 2.0 — быстрого локального AI-движка для Mac на Apple Silicon. Тесты производительности, сравнение с Ollama и vLLM-MLX, примеры аге 5 мин чтения 1917 Natural Language Autoencoders от Anthropic: как заглянуть в голову Gemma 3 Natural Language Autoencoders от Anthropic: декодируем внутренние состояния Gemma 3 в текст. Примеры, сравнение с альтернативами, инструкция по запуску. 6 мин чтения 1918 Skymizer HTX301: 384 ГБ памяти на одной PCIe-карте для локального LLM — прорыв или ниша? Обзор Skymizer HTX301 — PCIe инференс-карта с рекордными 384 ГБ HBM3. Сможет ли она заменить связки из нескольких RTX 4090? Анализ характеристик, цены и сценари 4 мин чтения 1919 Осторожно: скам-модель OpenOSS/privacy-filter на HuggingFace — как распознать малварь Вредоносная модель на Hugging Face маскируется под privacy-filter. Узнайте, как распознать код base64 и защитить систему от заражения. 4 мин чтения 1920 Gemma 4 Multi Token Prediction: Google обещает x2, а MLX пока молчит Google выпустил Gemma 4 с Multi Token Prediction, обещая ускорение в 2-3 раза. Однако MLX до сих пор не поддерживает эту технику. Разбираемся, что пошло не так. 5 мин чтения