Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3133
Почему веса text-davinci-003 - священный грааль для локального AI и как их запустить
Почему веса text-davinci-003 так ценны для локального AI и пошаговое руководство по их запуску на своем компьютере с помощью GGUF квантования и Ollama.
3134
Квантование LLM с нуля: инструкция по запуску 80B модели на ноутбуке без потери качества
Пошаговое руководство по квантованию больших языковых моделей для запуска на consumer-железе. Объяснение принципов, инструменты и практические советы на 2026 го
3135
Production-ready ИИ-агент: архитектура, инструменты и best practices для запуска в продакшен
Подробное руководство по созданию production-ready ИИ-агентов: архитектура ReAct, инструменты, безопасность, наблюдаемость и оценка для запуска в продакшен.
3136
GGUF vs MLX на Mac: итоговое сравнение производительности с исправлениями и выбор runtime
Полное сравнение GGUF и MLX на Apple Silicon. Исправление ошибок bf16→fp16, тесты 5 runtime, выбор оптимального для локальных LLM. Актуально на март 2026 года.
3137
Dreamina Seedance 2.0 в CapCut: как пользователи взламывают систему и порождают этический хаос
Актуально на 26.03.2026: как работает и почему ограничен Dreamina Seedance 2.0 в CapCut. Методы обхода запретов, авторский скандал с Голливудом и этические гран
3138
TAPE против трансформеров: как активное восприятие переписывает правила компьютерного зрения в 2026 году
Эксперименты 2026 года: архитектура TAPE показывает рекорд на датасете COCO и бросает вызов трансформерам. Вся техническая подоплека, цифры и прогнозы.
3139
Cohere Transcribe: 2-миллиардный монстр для транскрипции, который не стесняется работать локально
Открытая модель транскрипции от Cohere с 2 млрд параметров. Сравнение с Whisper, Parakeet, запуск на своем GPU. Точность, скорость, приватность.
3140
Кейс: как команда без ML-опыта за 6 месяцев запустила голосового ассистента на Qwen 8B и BERT
Практический кейс по созданию голосового ассистента на Qwen 8B и BERT командой без ML-опыта. Архитектура RAG, задержки 1.5-2 сек, пошаговый план развертывания.
3141
Как заставить LLM считать точно: практический гайд по генерации кода для вычислений
Узнайте, как заставить LLM считать точно через генерацию кода. Практические методы обхода ограничений трансформеров для вычислений в 2026 году.
3142
Почему Minimax M2.7 - это конец эры "брутфорса" промптами: архитектура нативной мультиагентности
Minimax M2.7 представляет архитектуру нативной мультиагентности, которая меняет подход к созданию AI-агентов. Узнайте, как это работает и почему промпт-инжинири
3143
От XML к инсайтам: полный data science workflow с ИИ на примере анализа Apple Health данных
Практический гайд по автоматизации анализа данных Apple Health с AI. Парсинг XML, EDA, генерация кода с Claude и Cursor. Полный pipeline за несколько часов.
3144
OpenAgentPrompts: библиотека промптов для AI-агентов, которая экономит часы настроек
Обзор open-source библиотеки системных промптов для AI-агентов. Готовые конфигурации для Cursor, Claude и локальных моделей. Экономия времени, сообщество на Dis