Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3241 Gimlet Labs: как multi-silicon inference cloud решает проблему bottlenecks в AI-инференсе Стартап Gimlet Labs привлек $80M для multi-silicon inference cloud, который распределяет AI-нагрузку по разному железу, решая проблему bottlenecks. Подробности 4 мин чтения 3242 Китайские LLM в тисках цензуры: как Qwen, DeepSeek, GLM и Yi фильтруют каждое слово Свежее исследование 2026 года показывает, как Qwen 4, DeepSeek V3, GLM-4 и Yi-Large цензурируют ответы. Разбор абляции внимания и способов обхода. 5 мин чтения 3243 LoCoMo врет: как сломанный бенчмарк памяти искажает все рейтинги LLM Разбор скандала с LoCoMo. 6.4% неверных ответов и принятие 63% лжи искажают результаты тестов GPT-4o, Claude 3.5 и других моделей на 2026 год. 4 мин чтения 3244 Fine-tuning Qwen3.5-27B для AI-компаньона: технические детали и ключевые инсайты из 2000 диалогов Полный гайд по тонкой настройке Qwen3.5-27B на 2000 диалогах. SFT, DPO, ранкинг ответов, борьба с jailbreak и скучными ответами. Технические детали и инсайты. 6 мин чтения 3245 7MB бинарная Mamba LLM: когда AI помещается в микроконтроллер и не просит floating-point Обзор 7MB бинарной Mamba LLM: запуск AI на устройствах без FPU. Сравнение с альтернативами, примеры использования, кому подойдет. Актуально на 23.03.2026. 4 мин чтения 3246 Почему RAG ломается на нормативных документах и как построить иерархический граф знаний Почему стандартный RAG не работает с нормативкой и как построить иерархический граф знаний для точного поиска. Пошаговый гайд на 2026 год. 9 мин чтения 3247 Открытый NPU: как самодельный чип обгоняет гигантов в локальном AI Полный разбор открытой архитектуры NPU для ускорения 70B+ моделей на устройстве. Дизайн, энергоэффективность и перспективы против коммерческих решений. 5 мин чтения 3248 Нейро-символьный детектор дрейфа: как ловить концепт-дрейф в продакшене без labeled данных Полный гайд по гибридному методу мониторинга ML-моделей. Детектируем концепт-дрейф в продакшене без размеченных данных с помощью нейро-символьного ИИ и FIDI Z-S 7 мин чтения 3249 SWE-bench февраль 2026: Claude Opus вырывается вперёд, но платить придётся Анализ лидерборда SWE-bench за февраль 2026: кто лучше всего решает реальные PR на GitHub и сколько это стоит в 2026 году. 5 мин чтения 3250 Локальный GraphRAG с Ollama: обзор Retriqs и сравнение моделей для экстракции Практический обзор Retriqs для создания локального GraphRAG с Ollama. Сравнение моделей для экстракции отношений, примеры использования и альтернативы. 6 мин чтения 3251 Кради как художник: как собрать датасет для дистилляции из OpenRouter Пошаговый гайд по сбору промптов и ответов из SOTA-моделей для тонкой настройки локальных LLM через OpenRouter. Актуально на март 2026. 8 мин чтения 3252 Детерминированный контроль агентов: как остановить двойные платежи в автономных AI-системах Практическое руководство по внедрению детерминированной авторизации для автономных AI-агентов. Как избежать двойных списаний и дублирования действий. 7 мин чтения