Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6253 StrongREJECT: разоблачение мифов о джейлбрейках и как правильно оценивать уязвимости LLM Разбор скандального исследования джейлбрейков LLM через перевод на гэльский. Почему 99% уязвимостей - фейк и как правильно тестировать безопасность моделей в 20 7 мин чтения 6254 Робот вместо аспиранта: как британский AI-ученый за 4 месяца перелопатил 245 научных заявок ARIA UK запустила 12 автономных научных проектов. ИИ сам ставит эксперименты, анализирует данные и пишет статьи. Как это работает и что будет с учеными? 4 мин чтения 6255 Как Amazon ускорил генерацию тест-кейсов в 40 раз: кейс с Strands Agents и Claude Sonnet Разбор кейса Amazon: как мультиагентная система SAARAM на Strands Agents SDK сократила генерацию тест-кейсов с недели до часов. Архитектура, инструменты, метрик 8 мин чтения 6256 DeepSeek-V3.2 и V3.2-Speciale: китайские reasoning-модели, которые реально работают локально Полное руководство по установке DeepSeek-V3.2 и V3.2-Speciale — open-source модели рассуждений, конкурирующие с GPT-5. Скачивание с Hugging Face, настройка и ср 6 мин чтения 6257 Кейс Remote: как мигрировать тысячи SQL-дампов через Code Execution Agent на LangChain Кейс Remote: как автоматизировать миграцию тысяч SQL-дампов и таблиц через Code Execution Agent на LangChain. Решение проблем ограничения контекста и галлюцинац 8 мин чтения 6258 HF-skills: универсальный фреймворк для автоматизации ML-задач любым coding-агентом (Claude, Codex, Gemini) Обзор HF-skills - фреймворка для автоматизации задач машинного обучения с помощью coding-агентов. Сравнение с альтернативами, примеры использования, рекомендаци 5 мин чтения 6259 10 уроков выгорания при работе с AI-кодинговыми агентами: практический опыт за 50 проектов Личный опыт работы с Claude Code, Opus 4.5 и Codex на 50 проектах. Реальные цифры продуктивности, скрытые затраты и психологические ловушки AI-кодинга. 9 мин чтения 6260 Почему модели машинного обучения не работают на реальных данных: практический гайд по избеганию ошибок Почему ML-модели показывают 99% в тестах и 0% в продакшене? Разбираем реальные кейсы провалов, чек-лист REFORMS и практические решения для 2026 года. 8 мин чтения 6261 LangSmith Agent Builder: кнопка "Создать агента" наконец-то работает Публичная бета LangSmith Agent Builder — как создать продакшен-агента без кода. Сравнение с альтернативами, примеры и кому подойдет инструмент. 4 мин чтения 6262 Loki-v2-70B: как настроить и использовать кастомную модель для нарратива и Dungeon Mastering (600M+ токенов датасета) Полное руководство по Loki-v2-70B: установка, настройка, проблемы с квантованием из-за rank 256, работа с 600M токенами датасета. Акттуально на январь 2026. 8 мин чтения 6263 Композируемый и суверенный ИИ: как вытащить бизнес из пилотного ада Почему 95% пилотов ИИ проваливаются и как композируемая архитектура на 2026 год решает эту проблему. Практический гайд для предприятий. 9 мин чтения 6264 GLM-4.7-Flash на Dual RTX 3090: когда локальный AI начинает сходить с ума Технический разбор деградации логики GLM-4.7-Flash в диалоге, настройка llama-server на Dual RTX 3090 и точный расчёт стоимости электричества на 2026 год 7 мин чтения