Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4309 Тест Car wash для LLM: как Qwen3.5 27B обошёл GPT-5.2 и что это значит В нишевом тесте Car wash модель Qwen3.5 с 27B параметров показала лучшие результаты рассуждений, чем флагман GPT-5.2. Что это меняет? 4 мин чтения 4310 Как подключить LFM2.5-VL-1.6B к камере безопасности для анализа сцен: настройка SharpAI Aegis и тесты на Apple Silicon Пошаговая инструкция по настройке локального анализа видео с LFM2.5-VL-1.6B и SharpAI Aegis на Mac. Тесты производительности на Apple M3/M4/M5. 8 мин чтения 4311 Оптимизация генерации токенов в PyTorch: техника CUDA stream interleaving для ускорения инференса Пошаговый гайд по CUDA stream interleaving для ускорения инференса LLM. Код на PyTorch 2.4 и HuggingFace Transformers 5.2. Измеряемый прирост производительности 9 мин чтения 4312 Термодинамический мозг: альтернатива backpropagation для обучения нейросетей на Arduino Полный гайд по самоорганизующемуся графу для Arduino. Обучение за O(1), фаза сна AI и митоз нейронов вместо backpropagation. Код и реализация на 2026 год. 9 мин чтения 4313 Qwen3.5-122B-A10B бьёт GPT-5-mini: китайский гигант переписывает правила игры Разбор сенсационных результатов бенчмарков MMLU-Pro и GPQA Diamond, где Qwen3.5-122B-A10B обходит GPT-5-mini. Последствия для рынка AI. 5 мин чтения 4314 RunPod — dumpster fire? Сравнение альтернатив для дешёвого и стабильного vLLM inference в облаке TensorDock, Vast.ai, Lambda Labs и другие платформы для дешёвого vLLM inference. Сравнение цен, настройка, подводные камни на основе реального опыта сообщества. 11 мин чтения 4315 Пошаговый туториал: как обучить CodeFu-7B для решения задач по программированию с помощью veRL и Ray на Amazon SageMaker Полное руководство по обучению модели CodeFu-7B для решения задач по программированию с использованием векторизованного RL и Ray на Amazon SageMaker. Пошаговый 10 мин чтения 4316 Практическое руководство по генерации структурированного JSON из LLM с помощью Dottxt Outlines в AWS SageMaker Пошаговая инструкция по интеграции Dottxt Outlines в AWS SageMaker для гарантированно валидного JSON вывода из больших языковых моделей в продакшене. 9 мин чтения 4317 SWE-bench Multilingual Leaderboard: какой ИИ лучше всего пишет код на 9 языках и сколько это стоит Сравнение GPT-5.2, GLM-4.7, DeepSeek v3.2 и MiniMax 2.5 на SWE-bench Multilingual Leaderboard. Какая модель лучше пишет код на 9 языках и сколько стоит inferenc 5 мин чтения 4318 Liquid AI LFM2-24B-A2B: руководство по запуску MoE-модели на локальном железе с 32 ГБ ОЗУ Пошаговое руководство по запуску модели Liquid AI LFM2-24B-A2B на локальном компьютере с 32 ГБ ОЗУ. Используем llama.cpp, vLLM, SGLang для эффективной работы sp 5 мин чтения 4319 Anthropic запускает предприятийных агентов: как плагины для финансов и дизайна заменят SaaS Anthropic объявляет о запуске корпоративных AI-агентов с плагинами для финансов и дизайна, которые заменят традиционные SaaS-решения. Анализ рынка на 2026 год. 5 мин чтения 4320 Как настроить 4B-агент для навигации по коду: GGUF, Qwen и 100% валидность tool-calling Пошаговая настройка 4B-агента для навигации по коду. GGUF модель, 100% валидность tool-calling, экономия токенов. Сравнение с Claude и GPT. 7 мин чтения