Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4309
Тест Car wash для LLM: как Qwen3.5 27B обошёл GPT-5.2 и что это значит
В нишевом тесте Car wash модель Qwen3.5 с 27B параметров показала лучшие результаты рассуждений, чем флагман GPT-5.2. Что это меняет?
4310
Как подключить LFM2.5-VL-1.6B к камере безопасности для анализа сцен: настройка SharpAI Aegis и тесты на Apple Silicon
Пошаговая инструкция по настройке локального анализа видео с LFM2.5-VL-1.6B и SharpAI Aegis на Mac. Тесты производительности на Apple M3/M4/M5.
4311
Оптимизация генерации токенов в PyTorch: техника CUDA stream interleaving для ускорения инференса
Пошаговый гайд по CUDA stream interleaving для ускорения инференса LLM. Код на PyTorch 2.4 и HuggingFace Transformers 5.2. Измеряемый прирост производительности
4312
Термодинамический мозг: альтернатива backpropagation для обучения нейросетей на Arduino
Полный гайд по самоорганизующемуся графу для Arduino. Обучение за O(1), фаза сна AI и митоз нейронов вместо backpropagation. Код и реализация на 2026 год.
4313
Qwen3.5-122B-A10B бьёт GPT-5-mini: китайский гигант переписывает правила игры
Разбор сенсационных результатов бенчмарков MMLU-Pro и GPQA Diamond, где Qwen3.5-122B-A10B обходит GPT-5-mini. Последствия для рынка AI.
4314
RunPod — dumpster fire? Сравнение альтернатив для дешёвого и стабильного vLLM inference в облаке
TensorDock, Vast.ai, Lambda Labs и другие платформы для дешёвого vLLM inference. Сравнение цен, настройка, подводные камни на основе реального опыта сообщества.
4315
Пошаговый туториал: как обучить CodeFu-7B для решения задач по программированию с помощью veRL и Ray на Amazon SageMaker
Полное руководство по обучению модели CodeFu-7B для решения задач по программированию с использованием векторизованного RL и Ray на Amazon SageMaker. Пошаговый
4316
Практическое руководство по генерации структурированного JSON из LLM с помощью Dottxt Outlines в AWS SageMaker
Пошаговая инструкция по интеграции Dottxt Outlines в AWS SageMaker для гарантированно валидного JSON вывода из больших языковых моделей в продакшене.
4317
SWE-bench Multilingual Leaderboard: какой ИИ лучше всего пишет код на 9 языках и сколько это стоит
Сравнение GPT-5.2, GLM-4.7, DeepSeek v3.2 и MiniMax 2.5 на SWE-bench Multilingual Leaderboard. Какая модель лучше пишет код на 9 языках и сколько стоит inferenc
4318
Liquid AI LFM2-24B-A2B: руководство по запуску MoE-модели на локальном железе с 32 ГБ ОЗУ
Пошаговое руководство по запуску модели Liquid AI LFM2-24B-A2B на локальном компьютере с 32 ГБ ОЗУ. Используем llama.cpp, vLLM, SGLang для эффективной работы sp
4319
Anthropic запускает предприятийных агентов: как плагины для финансов и дизайна заменят SaaS
Anthropic объявляет о запуске корпоративных AI-агентов с плагинами для финансов и дизайна, которые заменят традиционные SaaS-решения. Анализ рынка на 2026 год.
4320
Как настроить 4B-агент для навигации по коду: GGUF, Qwen и 100% валидность tool-calling
Пошаговая настройка 4B-агента для навигации по коду. GGUF модель, 100% валидность tool-calling, экономия токенов. Сравнение с Claude и GPT.