Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6253
StrongREJECT: разоблачение мифов о джейлбрейках и как правильно оценивать уязвимости LLM
Разбор скандального исследования джейлбрейков LLM через перевод на гэльский. Почему 99% уязвимостей - фейк и как правильно тестировать безопасность моделей в 20
6254
Робот вместо аспиранта: как британский AI-ученый за 4 месяца перелопатил 245 научных заявок
ARIA UK запустила 12 автономных научных проектов. ИИ сам ставит эксперименты, анализирует данные и пишет статьи. Как это работает и что будет с учеными?
6255
Как Amazon ускорил генерацию тест-кейсов в 40 раз: кейс с Strands Agents и Claude Sonnet
Разбор кейса Amazon: как мультиагентная система SAARAM на Strands Agents SDK сократила генерацию тест-кейсов с недели до часов. Архитектура, инструменты, метрик
6256
DeepSeek-V3.2 и V3.2-Speciale: китайские reasoning-модели, которые реально работают локально
Полное руководство по установке DeepSeek-V3.2 и V3.2-Speciale — open-source модели рассуждений, конкурирующие с GPT-5. Скачивание с Hugging Face, настройка и ср
6257
Кейс Remote: как мигрировать тысячи SQL-дампов через Code Execution Agent на LangChain
Кейс Remote: как автоматизировать миграцию тысяч SQL-дампов и таблиц через Code Execution Agent на LangChain. Решение проблем ограничения контекста и галлюцинац
6258
HF-skills: универсальный фреймворк для автоматизации ML-задач любым coding-агентом (Claude, Codex, Gemini)
Обзор HF-skills - фреймворка для автоматизации задач машинного обучения с помощью coding-агентов. Сравнение с альтернативами, примеры использования, рекомендаци
6259
10 уроков выгорания при работе с AI-кодинговыми агентами: практический опыт за 50 проектов
Личный опыт работы с Claude Code, Opus 4.5 и Codex на 50 проектах. Реальные цифры продуктивности, скрытые затраты и психологические ловушки AI-кодинга.
6260
Почему модели машинного обучения не работают на реальных данных: практический гайд по избеганию ошибок
Почему ML-модели показывают 99% в тестах и 0% в продакшене? Разбираем реальные кейсы провалов, чек-лист REFORMS и практические решения для 2026 года.
6261
LangSmith Agent Builder: кнопка "Создать агента" наконец-то работает
Публичная бета LangSmith Agent Builder — как создать продакшен-агента без кода. Сравнение с альтернативами, примеры и кому подойдет инструмент.
6262
Loki-v2-70B: как настроить и использовать кастомную модель для нарратива и Dungeon Mastering (600M+ токенов датасета)
Полное руководство по Loki-v2-70B: установка, настройка, проблемы с квантованием из-за rank 256, работа с 600M токенами датасета. Акттуально на январь 2026.
6263
Композируемый и суверенный ИИ: как вытащить бизнес из пилотного ада
Почему 95% пилотов ИИ проваливаются и как композируемая архитектура на 2026 год решает эту проблему. Практический гайд для предприятий.
6264
GLM-4.7-Flash на Dual RTX 3090: когда локальный AI начинает сходить с ума
Технический разбор деградации логики GLM-4.7-Flash в диалоге, настройка llama-server на Dual RTX 3090 и точный расчёт стоимости электричества на 2026 год