Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6997
Как оценивать LLM для кодинга без слепой веры в бенчмарки: практическое оружие
Почему HumanEval и Aider Polyglot врут. Создаем собственную методологию оценки языковых моделей для локального запуска. Пошаговый гайд с Aider и кодом.
6998
Как ChatGPT решил открытую математическую проблему: разбор кейса и промптов
Сенсационный кейс: как ChatGPT формализовал доказательство открытой математической задачи. Подробный разбор промптов, Chain of Thought и Legendre's formula.
6999
Безопасность AI-агентов: как защитить данные от утечек и инъекций через промпты
Полное руководство по безопасности AI-агентов. Защита от промпт-инъекций, управление теневым AI, построение слоя доверия. Практические шаги и архитектурные реше
7000
Orchestrator-8B от NVIDIA: как маленькая модель-диспетчер управляет инструментами и ведёт к AGI
Обзор Orchestrator-8B от NVIDIA — компактной модели для оркестрации AI-агентов и инструментов. Как 8-миллиардная модель управляет сложными системами и приближае
7001
AI Model Tracker: Когда моделей слишком много и все они забываются
Обзор и установка AI Model Tracker - инструмента для отслеживания локальных LLM моделей. Управляйте версиями, сравнивайте производительность и не теряйте файлы.
7002
Soprano 1.1-80M: как новая TTS модель победила галлюцинации и улучшила качество звука — обзор и сравнение
Soprano 1.1-80M сократила галлюцинации на 95% и получила +63% предпочтений. Обзор возможностей, сравнение с другими TTS и тест на Hugging Face.
7003
Bandcamp запрещает AI-музыку: как это повлияет на индустрию и где теперь публиковать генеративные треки
Bandcamp официально запретил AI-музыку. Разбираем последствия для индустрии, этические вопросы и альтернативные платформы для генеративных треков.
7004
Баг-репорт от ChatGPT и why change request от GPT-4: как ИИ убивает смысл в технической коммуникации
Реальный кейс из практики: как автоматизированная генерация баг-репортов и change request-ов ИИ создает хаос в команде. Разбор проблемы и план действий.
7005
NeuTTS Nano: голос для робота, который помещается в карман
Обзор NeuTTS Nano — сверхкомпактной TTS модели на Llama3. Тесты на Raspberry Pi 5 и Jetson Nano, сравнение с Pocket TTS и Sonya TTS, клонирование голоса.
7006
Почему промпт-инжиниринг провалился: разбор кейса автоматизации маркировки 10,000 товаров
Реальный кейс: почему один сложный промпт не сработал и как мы разбили задачу на 27 шагов. Автоматизация маркировки товаров через ИИ-агентов.
7007
Клонируем Claude Cowork: open-source альтернатива на MiniMax M2.1 для локального запуска
Полный гайд по созданию бесплатной локальной версии Claude Cowork на базе MiniMax M2.1 с оптимизацией для Apple Silicon
7008
Кэмп AI vs ChatGPT vs Claude: битва за вашу клавиатуру
Прямое сравнение трех ИИ-помощников в решении реальных задач по коду. Кто пишет быстрее, кто мыслит глубже, а кто просто красиво болтает?