Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1633 Nvidia разместит AI-микродата-центры прямо на подстанциях: пора брать энергию, пока она есть Nvidia запускает пилот распределенных микродата-центров мощностью 5-20 МВт на подстанциях. Как дешевая энергия изменит ландшафт AI-инференса. 3 мин чтения 1634 Лучший способ «промывки мозгов» LLM: сравниваем три метода SFT для персонализации Эксперимент: демонстрации, first-person statements и system prompt — какой из методов fine-tuning дает самую стабильную персонализацию без катастрофического заб 8 мин чтения 1635 Новое ценообразование GitHub Copilot: AI Credits и как подготовиться к изменениям с 1 июня С 1 июня 2026 года GitHub Copilot переходит на оплату по фактическому использованию AI Credits. Разбираемся, как это ударит по бюджету и что делать разработчика 4 мин чтения 1636 Первая в мире классификация объектов из космоса в реальном времени: как Planet Labs запустила onboard AI Planet Labs объявила о включении бортового ИИ на спутниках Pelican-4. Нейросеть на орбите классифицирует объекты за 30 мс - революция в спутниковом мониторинге. 4 мин чтения 1637 Приватные датасеты Open ASR Leaderboard: как Hugging Face отучит модели запоминать ответы Hugging Face внедряет приватные датасеты от Appen и DataoceanAI для честной оценки ASR-моделей. Как это работает и почему это конец эры накрутки WER? 4 мин чтения 1638 Stopilot: как создать альтернативу Cursor, которая не пишет код за программиста, и заработать 1,29 млн рублей в месяц История создания редактора, который фокусируется на понимании задачи вместо автогенерации. Коммерческий успех и уроки для разработчиков AI-инструментов. 4 мин чтения 1639 Qwen 3.6 против GPT-4o и Claude 4: кто рисует Canvas анимации лучше? Полевой тест Сравнение Qwen 3.6, GPT-4o и Claude 4 на генерации анимаций HTML Canvas. Визуальные результаты, FPS, выводы. Какая модель справляется лучше? 4 мин чтения 1640 MTP в llama.cpp: как ускорить генерацию до 111% на Strix Halo (бенчмарки 27B, 35B, 122B) Multi-Token Prediction добрался до AMD Strix Halo: реальные замеры для Qwen 3.6 27B, Qwen 3.5 35B и DeepSeek V3.5 122B. Команды сборки, настройки и результаты + 9 мин чтения 1641 Gemma 4: почему Google наконец-то сделала open-source модель, которую стоит запускать локально Google выпустила Gemma 4 под Apache 2.0: мультимодальная модель для аудио, изображений и текста. Интеграция с llama.cpp, MLX, WebGPU. Что умеет и кому подойдет? 6 мин чтения 1642 OpenReader: твой личный сервер для чтения документов вслух (и это open-source) Установи OpenReader на свой сервер: читай EPUB, PDF, DOCX с синхронной подсветкой и TTS. Скачай аудиокнигу локально. Бесплатно, без облаков. 5 мин чтения 1643 Build your own Clawdmeter: Как я собрал десктопный дашборд для токенов Claude Code и перестал просыпаться в холодном поту Пошаговое руководство по сборке физического дашборда для мониторинга расхода токенов Claude Code в реальном времени. Сравнение с софтверными решениями, примеры 6 мин чтения 1644 StRuCom: датасет, который научит LLM писать докстринги по-русски (и это не шутка) Датасет StRuCom решает проблему русскоязычной документации кода. Сравнение с CodeSearchNet, примеры дообучения модели и инструкция по применению. 4 мин чтения