Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4141
Claude Sonnet 4.6: Та самая модель, которая заставила разработчиков забыть про GPT-5
Полный разбор Claude Sonnet 4.6 на март 2026: тесты на SWE-Bench, 1 миллион токенов контекста бесплатно, сравнение с Opus и GPT-5 Turbo, практические примеры ис
4142
Запуск LLM на bare-metal: UEFI-приложение без ОС для максимально легковесного inference
Экспериментальный проект: UEFI-приложение для запуска LLM на голом железе. Прямой доступ к памяти, никакой операционной системы. Обзор для энтузиастов.
4143
Матрица памяти в e-commerce: как Ozon поборол cold start и повысил GMV на 0,9%
Глубокий разбор ML-архитектуры Ozon: как матрица памяти преодолела проблему холодного старта товаров и принесла измеримый рост в 0.9% GMV. Технический кейс для
4144
Защита от ботов 2026: Как патент Solar Security убивает скрипт-кидди машинным обучением и нечетким хешированием
Пошаговый гайд по защите от ботов с помощью машинного обучения и нечеткого хеширования. Реализация запатентованного метода Solar Security. Актуально на 2026 год
4145
Нормализация текста для TTS: как заставить голосового ассистента правильно произносить числа, сокращения и формулы
Практический гайд по нормализации текста для синтеза речи. Узнайте, как заставить TTS правильно произносить числа, сокращения, формулы и омонимы на 2026 год.
4146
Развертывание Vision-Language модели NVIDIA Cosmos на Jetson: полный туториал с vLLM
Пошаговый туториал по развертыванию VLM NVIDIA Cosmos на Jetson AGX Thor/Orin с vLLM. JetPack 6.0+, оптимизация памяти, работа с камерой и примеры кода.
4147
Оптимизация фронтенда AI-чатов: как исправить лаги в ChatGPT своими руками (перехват API)
Пошаговое руководство по оптимизации фронтенда ChatGPT. Узнайте, как перехватывать fetch-запросы, чистить mapping и внедрять виртуализацию списка для борьбы с л
4148
AVP (Agent Vector Protocol): передавай KV-cache, а не слова — экономия до 78% токенов
Agent Vector Protocol меняет правила игры. Передавай KV-cache между LLM-агентами вместо текста. Обзор, сравнение, примеры для GPT-4o, Claude 3.7, Devstral-X.
4149
Claude Skills и Subagents: как избежать рутины промпт-инжиниринга
Как Claude Skills и Subagents от Anthropic меняют работу с LLM. Сравнение с альтернативами, примеры использования и кому подойдет в 2026 году.
4150
LongCat-Flash-Lite 68.5B на 24 ГБ VRAM: как заставить котика поместиться в маленькую коробку
Пошаговая инструкция по локальному запуску модели LongCat-Flash-Lite 68.5B на GPU с 24 ГБ видеопамяти через оптимизированный llama.cpp с N-gram схемой.
4151
AI-сервер на 4 видеокартах, RAG и умный дом: история, которую никто не оценил
Разработчик потратил год на создание локального AI-ассистента с RAG, TTS и интеграцией Home Assistant. Его семья отказалась им пользоваться. Реальная история о
4152
Bare-Metal LLM: как запустить языковую модель без операционной системы
Полный обзор bare-metal LLM: запускаем языковые модели прямо на железе без операционной системы. Актуально на 2026 год. Сравнение, примеры использования, рекоме