Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7393
Google Cloud Next 2025: AI-агенты захватывают облако, а Ironwood перемалывает конкуренцию
Новости Google Cloud Next 2025: использование Vertex AI выросло в 20 раз, анонс чипа Ironwood, 2 млрд AI-ассистов в месяц.
7394
Как создать и обучить свою первую языковую модель с нуля: разбор toyGPT
Пошаговый разбор создания и обучения первой языковой модели с нуля на PyTorch. Архитектура mHC-трансформера, подготовка данных, обучение на GPU.
7395
Google I/O 2025: Gemini 2.5 и AI Mode. Что скрыли от пользователей и показали разработчикам
Разбор анонсов Google I/O 2025: Gemini 2.5, массовый запуск AI Mode в поиске и новые инструменты для разработчиков.
7396
GLM-4.6v 108B в 4-битном квантовании IQuant: тест на реальном железе, скорость и качество генерации
Практический тест GLM-4.6v 108B модели в 4-битном IQuant квантовании на Threadripper 1920x и RTX 5060Ti. Скорость 4-11 токенов/сек, сравнение с Nous Hermes, реа
7397
Когда одного сервера мало: мульти-нод кластер для локальных LLM на примере Kimi K2
Практическое руководство по настройке кластера из 3 узлов Strix Halo для запуска Kimi K2 Thinking. Сравнение vLLM и llama.cpp, производительность 9 t/s, квантов
7398
M2 Ultra vs 2x RTX 3090: какую бомбу купить для локального запуска 70B моделей
Детальный анализ железа для локального запуска 70B моделей. Сравниваем стоимость, скорость генерации, удобство и скрытые расходы. Реальные цифры и практические
7399
LFM2.5 1.2B Instruct: когда маленький размер - большое преимущество
Обзор и практическое тестирование LFM2.5 1.2B Instruct. Почему эта модель обходит конкурентов в задачах извлечения данных и агентских сценариях на слабом железе
7400
Acqui-hire OpenAI: как стартапы превращаются в команды для облачных сервисов ИИ
Почему OpenAI и другие гиганты покупают стартапы без технологий. Как acqui-hire меняет рынок AI-талантов и что это значит для индустрии.
7401
ChatGPT Health: когда твой цифровой врач ошибается, ты можешь умереть
Расследование о ChatGPT Health: реальные случаи смертельных ошибок, утечки медицинских данных и почему ИИ не должен заменять врача. Безопасность под вопросом.
7402
RLHF vs DPO: полное руководство по выравниванию ИИ и управлению отказами
Глубокое сравнение RLHF и DPO для выравнивания языковых моделей. Почему ИИ отказывается отвечать, математическая интуиция методов, практические шаги по исправле
7403
AnythingLLM vs CLINE на llama.cpp: кто реально быстрее и почему
Технический разбор архитектурных различий AnythingLLM и CLINE, тесты производительности на llama.cpp, оптимизации для локальных LLM. Практические результаты.
7404
Как дообучить 7B-модель для reasoning на бесплатном Colab с GRPO и TRL: пошаговый гайд
Подробный гайд по тонкой настройке 7B-модели для рассуждений на бесплатном Google Colab (T4) с использованием GRPO и TRL. Оптимизация памяти в 7 раз.