Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4141 Claude Sonnet 4.6: Та самая модель, которая заставила разработчиков забыть про GPT-5 Полный разбор Claude Sonnet 4.6 на март 2026: тесты на SWE-Bench, 1 миллион токенов контекста бесплатно, сравнение с Opus и GPT-5 Turbo, практические примеры ис 7 мин чтения 4142 Запуск LLM на bare-metal: UEFI-приложение без ОС для максимально легковесного inference Экспериментальный проект: UEFI-приложение для запуска LLM на голом железе. Прямой доступ к памяти, никакой операционной системы. Обзор для энтузиастов. 4 мин чтения 4143 Матрица памяти в e-commerce: как Ozon поборол cold start и повысил GMV на 0,9% Глубокий разбор ML-архитектуры Ozon: как матрица памяти преодолела проблему холодного старта товаров и принесла измеримый рост в 0.9% GMV. Технический кейс для 5 мин чтения 4144 Защита от ботов 2026: Как патент Solar Security убивает скрипт-кидди машинным обучением и нечетким хешированием Пошаговый гайд по защите от ботов с помощью машинного обучения и нечеткого хеширования. Реализация запатентованного метода Solar Security. Актуально на 2026 год 9 мин чтения 4145 Нормализация текста для TTS: как заставить голосового ассистента правильно произносить числа, сокращения и формулы Практический гайд по нормализации текста для синтеза речи. Узнайте, как заставить TTS правильно произносить числа, сокращения, формулы и омонимы на 2026 год. 9 мин чтения 4146 Развертывание Vision-Language модели NVIDIA Cosmos на Jetson: полный туториал с vLLM Пошаговый туториал по развертыванию VLM NVIDIA Cosmos на Jetson AGX Thor/Orin с vLLM. JetPack 6.0+, оптимизация памяти, работа с камерой и примеры кода. 8 мин чтения 4147 Оптимизация фронтенда AI-чатов: как исправить лаги в ChatGPT своими руками (перехват API) Пошаговое руководство по оптимизации фронтенда ChatGPT. Узнайте, как перехватывать fetch-запросы, чистить mapping и внедрять виртуализацию списка для борьбы с л 6 мин чтения 4148 AVP (Agent Vector Protocol): передавай KV-cache, а не слова — экономия до 78% токенов Agent Vector Protocol меняет правила игры. Передавай KV-cache между LLM-агентами вместо текста. Обзор, сравнение, примеры для GPT-4o, Claude 3.7, Devstral-X. 5 мин чтения 4149 Claude Skills и Subagents: как избежать рутины промпт-инжиниринга Как Claude Skills и Subagents от Anthropic меняют работу с LLM. Сравнение с альтернативами, примеры использования и кому подойдет в 2026 году. 5 мин чтения 4150 LongCat-Flash-Lite 68.5B на 24 ГБ VRAM: как заставить котика поместиться в маленькую коробку Пошаговая инструкция по локальному запуску модели LongCat-Flash-Lite 68.5B на GPU с 24 ГБ видеопамяти через оптимизированный llama.cpp с N-gram схемой. 5 мин чтения 4151 AI-сервер на 4 видеокартах, RAG и умный дом: история, которую никто не оценил Разработчик потратил год на создание локального AI-ассистента с RAG, TTS и интеграцией Home Assistant. Его семья отказалась им пользоваться. Реальная история о 4 мин чтения 4152 Bare-Metal LLM: как запустить языковую модель без операционной системы Полный обзор bare-metal LLM: запускаем языковые модели прямо на железе без операционной системы. Актуально на 2026 год. Сравнение, примеры использования, рекоме 6 мин чтения