Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

3133 Почему веса text-davinci-003 - священный грааль для локального AI и как их запустить Почему веса text-davinci-003 так ценны для локального AI и пошаговое руководство по их запуску на своем компьютере с помощью GGUF квантования и Ollama. 6 мин чтения 3134 Квантование LLM с нуля: инструкция по запуску 80B модели на ноутбуке без потери качества Пошаговое руководство по квантованию больших языковых моделей для запуска на consumer-железе. Объяснение принципов, инструменты и практические советы на 2026 го 10 мин чтения 3135 Production-ready ИИ-агент: архитектура, инструменты и best practices для запуска в продакшен Подробное руководство по созданию production-ready ИИ-агентов: архитектура ReAct, инструменты, безопасность, наблюдаемость и оценка для запуска в продакшен. 8 мин чтения 3136 GGUF vs MLX на Mac: итоговое сравнение производительности с исправлениями и выбор runtime Полное сравнение GGUF и MLX на Apple Silicon. Исправление ошибок bf16→fp16, тесты 5 runtime, выбор оптимального для локальных LLM. Актуально на март 2026 года. 6 мин чтения 3137 Dreamina Seedance 2.0 в CapCut: как пользователи взламывают систему и порождают этический хаос Актуально на 26.03.2026: как работает и почему ограничен Dreamina Seedance 2.0 в CapCut. Методы обхода запретов, авторский скандал с Голливудом и этические гран 5 мин чтения 3138 TAPE против трансформеров: как активное восприятие переписывает правила компьютерного зрения в 2026 году Эксперименты 2026 года: архитектура TAPE показывает рекорд на датасете COCO и бросает вызов трансформерам. Вся техническая подоплека, цифры и прогнозы. 4 мин чтения 3139 Cohere Transcribe: 2-миллиардный монстр для транскрипции, который не стесняется работать локально Открытая модель транскрипции от Cohere с 2 млрд параметров. Сравнение с Whisper, Parakeet, запуск на своем GPU. Точность, скорость, приватность. 5 мин чтения 3140 Кейс: как команда без ML-опыта за 6 месяцев запустила голосового ассистента на Qwen 8B и BERT Практический кейс по созданию голосового ассистента на Qwen 8B и BERT командой без ML-опыта. Архитектура RAG, задержки 1.5-2 сек, пошаговый план развертывания. 6 мин чтения 3141 Как заставить LLM считать точно: практический гайд по генерации кода для вычислений Узнайте, как заставить LLM считать точно через генерацию кода. Практические методы обхода ограничений трансформеров для вычислений в 2026 году. 8 мин чтения 3142 Почему Minimax M2.7 - это конец эры "брутфорса" промптами: архитектура нативной мультиагентности Minimax M2.7 представляет архитектуру нативной мультиагентности, которая меняет подход к созданию AI-агентов. Узнайте, как это работает и почему промпт-инжинири 6 мин чтения 3143 От XML к инсайтам: полный data science workflow с ИИ на примере анализа Apple Health данных Практический гайд по автоматизации анализа данных Apple Health с AI. Парсинг XML, EDA, генерация кода с Claude и Cursor. Полный pipeline за несколько часов. 12 мин чтения 3144 OpenAgentPrompts: библиотека промптов для AI-агентов, которая экономит часы настроек Обзор open-source библиотеки системных промптов для AI-агентов. Готовые конфигурации для Cursor, Claude и локальных моделей. Экономия времени, сообщество на Dis 5 мин чтения