Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2125 Hugging Face Community Evals: как сообщество выносит мусор из избы бенчмарков Бенчмарки AI превратились в инструмент пропаганды. Hugging Face запускает Community Evals — децентрализованную систему оценок, где каждый может проверить модель 5 мин чтения 2126 Создание первой LLM с нуля: опыт автора Shard (40M параметров) для IoT История создания Shard — компактной LLM с 40M параметров для IoT. Опыт автора, уроки, архитектура и почему 40 миллионов может быть лучше миллиарда. 3 мин чтения 2127 Исправлены GGUF-файлы Mistral Medium 3.5 128B: что было сломано и как обновить Unsloth исправил критическую ошибку в GGUF-файлах Mistral Medium 3.5 128B. Разбираем, что было не так с длинным контекстом и как обновить модель локально. 4 мин чтения 2128 Как эффективно коллаборировать с ИИ в Kotlin-разработке: практики и архитектурные шаблоны Глубокое руководство по интеграции AI-агентов в Kotlin-проекты: от ошибок до SOLID-паттернов. LangChain4j, Ktor, ACDD — как не утонуть в техдолге. 5 мин чтения 2129 Бесплатный курс AI Agents Vibe Coding от Google и Kaggle: программа, даты и как записаться Google и Kaggle запустили бесплатный курс по AI-агентам в стиле Vibe Coding. Узнайте программу, даты старта и как записаться на самый ожидаемый курс 2026 года. 5 мин чтения 2130 Силиконовая лотерея: как выбрать производительный GPU в облаке — анализ 3500 GPU от 11 провайдеров Разбор силиконовой лотереи: реальные бенчмарки 3500 GPU, разброс до 45% у одного провайдера. Как сэкономить, используя SiliconMark и правильную стратегию аренды 7 мин чтения 2131 Ghost: База данных для AI-агентов, которая не боится fork'ов и disposable-окружений Ghost – новая agent-first база данных на Postgres для fork, disposable-сред и AI-агентов. Как это упрощает прототипирование и меняет подход к данным. 4 мин чтения 2132 Google Gemini 3 Deep Think: гений, который не умеет молчать Gemini 3 Deep Think блестяще решает ARC-AGI-2, но скрывает документацию по безопасности. Разбираем прорыв и тревожный звоночек от Google. 3 мин чтения 2133 Как сократить расходы на токены в Agentic AI: 4 принципа с интерактивными калькуляторами Снизьте затраты на токены в Agentic AI. Принципы: prompt caching, lazy loading tools, semantic caching, agent routing. Калькуляторы экономии. 10 мин чтения 2134 Software 3.0 по Карпатому: программист как дирижёр агентов Андрей Карпатый о Software 3.0: как агентное программирование превращает разработчика в архитектора ИИ-систем и почему Vibe Coding остался в прошлом. 4 мин чтения 2135 Luma Agents: как автоматизировать создание мультимодального контента за $20 000 и 40 часов — реальный кейс локализации рекламы Реальный кейс: как автоматизировать создание мультимодальной рекламы для 5 языков с помощью Luma Agents за $20 000 и 40 часов. Пошаговый план, архитектура Uni-1 5 мин чтения 2136 Лучшие локальные LLM апреля 2026: Qwen3.5, Gemma4, GLM-5.1 и Minimax-M2.7 — кто вывозит? Сравнение четырёх сильнейших открытых моделей апреля 2026: Qwen3.5, Gemma4, GLM-5.1 и Minimax-M2.7. Какая лучше для локалки? Тесты, требования, реальный опыт. 7 мин чтения