Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

445 Создание сайта через Codex и GPT-5.6: пошаговый гайд для новичков без программирования Пошаговый сценарий создания сайта через Codex и GPT-5.6: как выбрать референс, составить промпт, получить HTML/CSS/JavaScript, адаптировать вёрстку под мобильны 10 мин чтения 446 Hint: AI-ассистент для управления домом от Марты Стюарт — революция в быту или нишевый инструмент? Разбираем Hint — AI-платформу для управления домом от Марты Стюарт. Как работает распознавание чеков и фото техники, зачем нужен персонализированный график обсл 8 мин чтения 447 Моделирование мироздания: как принципы кибернетики и ТАУ позволяют взглянуть на концепцию «высшего разума» Мысленный эксперимент: рассматриваем идею высшего разума через призму теории автоматического управления и кибернетики. Структурные аналогии, модель замкнутой си 9 мин чтения 448 Максимальная производительность vLLM на 4x RTX 5060 Ti: настройка NVFP4, устранение OOM и оптимизация скорости инференса Запускаем unsloth/Qwen3.6-27B-NVFP4 на 4x RTX 5060 Ti с vLLM: готовая конфигурация для 70-80 t/s генерации, решение OOM через MAX_JOBS и gpu_memory_utilization, 9 мин чтения 449 PromptCTL: Как статический анализатор для промптов предотвращает падение продакшна из-за переименования переменной Переименовали переменную в шаблоне промпта и обрушили продакшн? PromptCTL ловит ошибки KeyError на этапе CI/CD. Три этапа проверки — PromptDiff, Contract Valida 8 мин чтения 450 llama.cpp: автоматическая загрузка тензоров MTP увеличивает потребление VRAM — что изменилось и как с этим работать В новых сборках llama.cpp тензоры MTP/NextN загружаются автоматически, даже без спекулятивного декодирования. Расход VRAM растет на объем слоя MoE. Разбираем за 6 мин чтения 451 Карусель открытых весов не останавливается: какие новые модели появились в 2026 году Mistral 3.1, Qwen3 и DeepSeek-V4 Pro: разбор свежих open-weights релизов 2026 года. Бенчмарки, скорость инференса на H100 и RTX 4090, готовые сниппеты для загру 7 мин чтения 452 Дата-агенты в бизнес-аналитике: как Dora автоматизирует цепочку от алерта до действия Дата-агент Dora от FanRuan замыкает цикл от алерта до действия за 90 секунд: автоматический анализ первопричин, drill-down по измерениям и доставка отчёта ответ 9 мин чтения 453 Квантизация Kimi K3 в GGUF Q3_K_S: 1.1 ТБ на диске и инференс на CPU — стоит ли игра свеч? Kimi K3 (2.8T параметров) квантизирована в GGUF Q3_K_S: 1114 ГиБ на диске, инференс на AMD EPYC 9554P с 1.5 ТБ ОЗУ выдаёт 4.21 t/s. Разбор архитектуры, тесты на 9 мин чтения 454 Lyria 3.5 в Google Flow Music: что нового в музыкальной генерации Lyria 3.5 в Google Flow Music делает акцент на вокале, управлении BPM и структурой трека. Разбираем заявленные возможности, ограничения, доступ и коммерческое и 9 мин чтения 455 Выбор нейросетевой модели: практическое руководство по критериям и методологии Шесть критериев выбора нейросетевой модели с цифрами и примерами: производительность на своих данных, расчёт TCO инференса, доменная специализация, безопасность 9 мин чтения 456 Алиса в поиске: как на самом деле работают голосовые ответы Яндекса и почему позиция в выдаче важнее разметки Корректная speakable-разметка не гарантирует попадания в голосовые ответы Алисы, если страница не входит в топ-20 Яндекса. Разбираем реальный кейс, цепочку отбо 8 мин чтения