Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2269 ИИ на страже городской эстетики: как система NtechLab выявляет нелегальные граффити (кейс видеоаналитики) Как видеоаналитика NtechLab распознает нелегальные граффити на улицах городов. Кейс использования компьютерного зрения в ЖКХ. Актуально на 2026 год. 4 мин чтения 2270 Google TPU 8i и 8t: чипы, которые заставят AI-агентов работать, а не мечтать Google представила TPU 8i для инференса агентных систем и TPU 8t для обучения. 121 экзафлопс, двойная пропускная способность. Как это изменит рынок AI-железа? 1 мин чтения 2271 97% агентов проваливают цепочки: что вскрыл бенчмарк VAKRA в 2026 году VAKRA 2.1 показал: модели теряют контекст на 3 шагах. Разбор ошибок GPT-5, Claude 4.5, Gemini Ultra 2.0 и причины провалов. 4 мин чтения 2272 Как избавить AI от сикофантии: техники и причины Почему ChatGPT льстит и как это исправить. Причины сикофантии LLM, промпт-инжиниринг, мультиагентные дебаты, калибровка уверенности и другие рабочие методы. 8 мин чтения 2273 Проблема PR от AI-агентов в open source: как не превратить вклад в хаос AI-агенты заполонили open source бесполезными пул-реквестами. Разбираемся, как отличить ценный вклад от хаоса и не сломать проекты. Советы для контрибьюторов и 3 мин чтения 2274 5 лет AlphaFold: как DeepMind меняет медицину и сельское хозяйство – от расшифровки белка 'плохого холестерина' до устойчивых культур AlphaFold исполняется 5 лет: как ИИ DeepMind расшифровал белок apoB100, ускорил создание лекарств от атеросклероза и помог вывести жароустойчивые культуры. Личн 4 мин чтения 2275 Mythos Preview, GPT-5.4 и Opus 4.6: кто выиграл в кибербезопасности? Кровь, пот и CTF-флаги Независимое тестирование AISI: результаты CTF-задач. Mythos Preview находит баги за минуты, GPT-5.4 пишет эксплойты, Opus 4.6 выигрывает в анализе. Кто лидер? 1 мин чтения 2276 QIMMA: Лидерборд, который валидирует бенчмарки арабских LLM — почему старые рейтинги больше не работают Разбираем QIMMA — лидерборд с проверкой бенчмарков для арабских языковых моделей. Почему старые тесты врут и как новая методология меняет оценку LLM. 4 мин чтения 2277 Tokenmaxxing: почему измерение AI-продуктивности по токенам — это новый 'план по гвоздям' Утечка Meta, советские гвозди и Claudeonomics: почему токенмаксинг убивает качество AI и превращает каждую модель в болтливого бюрократа. 4 мин чтения 2278 Grok как факт-чекер: почему платить $8 опасно (история с Эрдоганом и скандалы) Илон Маск сделал Grok платным. Но стоит ли $8 факт-чекер, который галлюцинирует и провоцирует международные скандалы? Разбор истории с Эрдоганом и рисков подпис 3 мин чтения 2279 Mistral Small 4: французский эксперт на диете — 119B параметров, но активны только 20B Разбираем Mistral Small 4: архитектура MoE с 128 экспертами, reasoning mode, мультимодальность. Сравнение с DeepSeek-V3, HyperNova-60B, Llama 4. Примеры кода и 7 мин чтения 2280 HippoRAG 2: нейровдохновленный RAG-фреймворк для логических выводов — разбор и запуск Разбираем HippoRAG 2 — open-source RAG-фреймворк от Ohio State University на основе гиппокампального индексирования. Архитектура, сравнение с альтернативами и п 5 мин чтения