Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2269
ИИ на страже городской эстетики: как система NtechLab выявляет нелегальные граффити (кейс видеоаналитики)
Как видеоаналитика NtechLab распознает нелегальные граффити на улицах городов. Кейс использования компьютерного зрения в ЖКХ. Актуально на 2026 год.
2270
Google TPU 8i и 8t: чипы, которые заставят AI-агентов работать, а не мечтать
Google представила TPU 8i для инференса агентных систем и TPU 8t для обучения. 121 экзафлопс, двойная пропускная способность. Как это изменит рынок AI-железа?
2271
97% агентов проваливают цепочки: что вскрыл бенчмарк VAKRA в 2026 году
VAKRA 2.1 показал: модели теряют контекст на 3 шагах. Разбор ошибок GPT-5, Claude 4.5, Gemini Ultra 2.0 и причины провалов.
2272
Как избавить AI от сикофантии: техники и причины
Почему ChatGPT льстит и как это исправить. Причины сикофантии LLM, промпт-инжиниринг, мультиагентные дебаты, калибровка уверенности и другие рабочие методы.
2273
Проблема PR от AI-агентов в open source: как не превратить вклад в хаос
AI-агенты заполонили open source бесполезными пул-реквестами. Разбираемся, как отличить ценный вклад от хаоса и не сломать проекты. Советы для контрибьюторов и
2274
5 лет AlphaFold: как DeepMind меняет медицину и сельское хозяйство – от расшифровки белка 'плохого холестерина' до устойчивых культур
AlphaFold исполняется 5 лет: как ИИ DeepMind расшифровал белок apoB100, ускорил создание лекарств от атеросклероза и помог вывести жароустойчивые культуры. Личн
2275
Mythos Preview, GPT-5.4 и Opus 4.6: кто выиграл в кибербезопасности? Кровь, пот и CTF-флаги
Независимое тестирование AISI: результаты CTF-задач. Mythos Preview находит баги за минуты, GPT-5.4 пишет эксплойты, Opus 4.6 выигрывает в анализе. Кто лидер?
2276
QIMMA: Лидерборд, который валидирует бенчмарки арабских LLM — почему старые рейтинги больше не работают
Разбираем QIMMA — лидерборд с проверкой бенчмарков для арабских языковых моделей. Почему старые тесты врут и как новая методология меняет оценку LLM.
2277
Tokenmaxxing: почему измерение AI-продуктивности по токенам — это новый 'план по гвоздям'
Утечка Meta, советские гвозди и Claudeonomics: почему токенмаксинг убивает качество AI и превращает каждую модель в болтливого бюрократа.
2278
Grok как факт-чекер: почему платить $8 опасно (история с Эрдоганом и скандалы)
Илон Маск сделал Grok платным. Но стоит ли $8 факт-чекер, который галлюцинирует и провоцирует международные скандалы? Разбор истории с Эрдоганом и рисков подпис
2279
Mistral Small 4: французский эксперт на диете — 119B параметров, но активны только 20B
Разбираем Mistral Small 4: архитектура MoE с 128 экспертами, reasoning mode, мультимодальность. Сравнение с DeepSeek-V3, HyperNova-60B, Llama 4. Примеры кода и
2280
HippoRAG 2: нейровдохновленный RAG-фреймворк для логических выводов — разбор и запуск
Разбираем HippoRAG 2 — open-source RAG-фреймворк от Ohio State University на основе гиппокампального индексирования. Архитектура, сравнение с альтернативами и п