Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3241
Gimlet Labs: как multi-silicon inference cloud решает проблему bottlenecks в AI-инференсе
Стартап Gimlet Labs привлек $80M для multi-silicon inference cloud, который распределяет AI-нагрузку по разному железу, решая проблему bottlenecks. Подробности
3242
Китайские LLM в тисках цензуры: как Qwen, DeepSeek, GLM и Yi фильтруют каждое слово
Свежее исследование 2026 года показывает, как Qwen 4, DeepSeek V3, GLM-4 и Yi-Large цензурируют ответы. Разбор абляции внимания и способов обхода.
3243
LoCoMo врет: как сломанный бенчмарк памяти искажает все рейтинги LLM
Разбор скандала с LoCoMo. 6.4% неверных ответов и принятие 63% лжи искажают результаты тестов GPT-4o, Claude 3.5 и других моделей на 2026 год.
3244
Fine-tuning Qwen3.5-27B для AI-компаньона: технические детали и ключевые инсайты из 2000 диалогов
Полный гайд по тонкой настройке Qwen3.5-27B на 2000 диалогах. SFT, DPO, ранкинг ответов, борьба с jailbreak и скучными ответами. Технические детали и инсайты.
3245
7MB бинарная Mamba LLM: когда AI помещается в микроконтроллер и не просит floating-point
Обзор 7MB бинарной Mamba LLM: запуск AI на устройствах без FPU. Сравнение с альтернативами, примеры использования, кому подойдет. Актуально на 23.03.2026.
3246
Почему RAG ломается на нормативных документах и как построить иерархический граф знаний
Почему стандартный RAG не работает с нормативкой и как построить иерархический граф знаний для точного поиска. Пошаговый гайд на 2026 год.
3247
Открытый NPU: как самодельный чип обгоняет гигантов в локальном AI
Полный разбор открытой архитектуры NPU для ускорения 70B+ моделей на устройстве. Дизайн, энергоэффективность и перспективы против коммерческих решений.
3248
Нейро-символьный детектор дрейфа: как ловить концепт-дрейф в продакшене без labeled данных
Полный гайд по гибридному методу мониторинга ML-моделей. Детектируем концепт-дрейф в продакшене без размеченных данных с помощью нейро-символьного ИИ и FIDI Z-S
3249
SWE-bench февраль 2026: Claude Opus вырывается вперёд, но платить придётся
Анализ лидерборда SWE-bench за февраль 2026: кто лучше всего решает реальные PR на GitHub и сколько это стоит в 2026 году.
3250
Локальный GraphRAG с Ollama: обзор Retriqs и сравнение моделей для экстракции
Практический обзор Retriqs для создания локального GraphRAG с Ollama. Сравнение моделей для экстракции отношений, примеры использования и альтернативы.
3251
Кради как художник: как собрать датасет для дистилляции из OpenRouter
Пошаговый гайд по сбору промптов и ответов из SOTA-моделей для тонкой настройки локальных LLM через OpenRouter. Актуально на март 2026.
3252
Детерминированный контроль агентов: как остановить двойные платежи в автономных AI-системах
Практическое руководство по внедрению детерминированной авторизации для автономных AI-агентов. Как избежать двойных списаний и дублирования действий.