Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7393 Google Cloud Next 2025: AI-агенты захватывают облако, а Ironwood перемалывает конкуренцию Новости Google Cloud Next 2025: использование Vertex AI выросло в 20 раз, анонс чипа Ironwood, 2 млрд AI-ассистов в месяц. 5 мин чтения 7394 Как создать и обучить свою первую языковую модель с нуля: разбор toyGPT Пошаговый разбор создания и обучения первой языковой модели с нуля на PyTorch. Архитектура mHC-трансформера, подготовка данных, обучение на GPU. 6 мин чтения 7395 Google I/O 2025: Gemini 2.5 и AI Mode. Что скрыли от пользователей и показали разработчикам Разбор анонсов Google I/O 2025: Gemini 2.5, массовый запуск AI Mode в поиске и новые инструменты для разработчиков. 6 мин чтения 7396 GLM-4.6v 108B в 4-битном квантовании IQuant: тест на реальном железе, скорость и качество генерации Практический тест GLM-4.6v 108B модели в 4-битном IQuant квантовании на Threadripper 1920x и RTX 5060Ti. Скорость 4-11 токенов/сек, сравнение с Nous Hermes, реа 5 мин чтения 7397 Когда одного сервера мало: мульти-нод кластер для локальных LLM на примере Kimi K2 Практическое руководство по настройке кластера из 3 узлов Strix Halo для запуска Kimi K2 Thinking. Сравнение vLLM и llama.cpp, производительность 9 t/s, квантов 11 мин чтения 7398 M2 Ultra vs 2x RTX 3090: какую бомбу купить для локального запуска 70B моделей Детальный анализ железа для локального запуска 70B моделей. Сравниваем стоимость, скорость генерации, удобство и скрытые расходы. Реальные цифры и практические 8 мин чтения 7399 LFM2.5 1.2B Instruct: когда маленький размер - большое преимущество Обзор и практическое тестирование LFM2.5 1.2B Instruct. Почему эта модель обходит конкурентов в задачах извлечения данных и агентских сценариях на слабом железе 7 мин чтения 7400 Acqui-hire OpenAI: как стартапы превращаются в команды для облачных сервисов ИИ Почему OpenAI и другие гиганты покупают стартапы без технологий. Как acqui-hire меняет рынок AI-талантов и что это значит для индустрии. 6 мин чтения 7401 ChatGPT Health: когда твой цифровой врач ошибается, ты можешь умереть Расследование о ChatGPT Health: реальные случаи смертельных ошибок, утечки медицинских данных и почему ИИ не должен заменять врача. Безопасность под вопросом. 5 мин чтения 7402 RLHF vs DPO: полное руководство по выравниванию ИИ и управлению отказами Глубокое сравнение RLHF и DPO для выравнивания языковых моделей. Почему ИИ отказывается отвечать, математическая интуиция методов, практические шаги по исправле 6 мин чтения 7403 AnythingLLM vs CLINE на llama.cpp: кто реально быстрее и почему Технический разбор архитектурных различий AnythingLLM и CLINE, тесты производительности на llama.cpp, оптимизации для локальных LLM. Практические результаты. 9 мин чтения 7404 Как дообучить 7B-модель для reasoning на бесплатном Colab с GRPO и TRL: пошаговый гайд Подробный гайд по тонкой настройке 7B-модели для рассуждений на бесплатном Google Colab (T4) с использованием GRPO и TRL. Оптимизация памяти в 7 раз. 6 мин чтения