Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2857 Любой твой пакет может быть следующим: как взлом LiteLLM проломил защиту AI-стартапа Mercor Взлом популярного проекта LiteLLM привел к утечке данных AI-стартапа Mercor. Как supply chain атака изменит отношение к open-source в 2026 году. 6 мин чтения 2858 1-битные LLM на устройстве: запуск модели на iPhone, бенчмарки и энергоэффективность Как 1-битное квантование позволяет запускать 8B-модели на iPhone. Тесты памяти (1.15 ГБ), скорости и влияние на батарею. Сравнение с 4-битными аналогами. 5 мин чтения 2859 Утечка архитектуры Claude Code: второй скандал в Anthropic за месяц и его последствия для индустрии Подробности утечки архитектуры Claude Code от Anthropic, второй скандал за месяц после конфликта с Пентагоном. Как это повлияет на безопасность AI компаний. 4 мин чтения 2860 Attn-rot (TurboQuant lite) в llama.cpp: разбор нового метода квантования KV-кэша и бенчмарки для Qwen3.5 Разбор Attn-rot (TurboQuant lite) в llama.cpp: как новый метод квантования KV-кэша снижает KLD и ускоряет инференс Qwen3.5. Бенчмарки и сравнения. 5 мин чтения 2861 CodonRoBERTa: обучаем mRNA языковые модели для 25 видов за $165 (и это работает) Как обучать mRNA языковые модели для 25 биологических видов всего за $165. Архитектура CodonRoBERTa, сравнение с альтернативами и примеры использования в биоинф 5 мин чтения 2862 Bonsai-8B: первая 1-битная LLM с MMLU-R 65.7 — тесты, установка и возможности Подробный обзор Bonsai-8B — прорывной 1-битной LLM от PrismML. Сравнение с альтернативами, тесты производительности и руководство по локальному запуску на слабо 6 мин чтения 2863 Как получить доступ к Gemini из России: детальный гайд по настройке VPN, DNS и блокировке IPv6 Полный гайд по обходу блокировки Google Gemini в России. Шаг за шагом: выбор VPN, устранение DNS-утечек, блокировка IPv6 и проверка соединения. 7 мин чтения 2864 Парадокс Джевонса в AI: почему дешевые токены не остановили голод на железо Анализ, почему дешевые токены и оптимизация моделей привели к взрывному росту спроса на вычисления. Закрытие Sora и позиция NVIDIA на GTC 2026. 4 мин чтения 2865 FinOps агент на Amazon Bedrock AgentCore: когда ваш AWS счёт перестаёт быть сюрпризом Пошаговый гайд по созданию AI-агента для анализа и оптимизации затрат AWS. Используем Bedrock AgentCore, Claude 3.7 Sonnet, Strands SDK и MCP. Актуально на март 10 мин чтения 2866 Claude Code следит за тобой: как Anthropic отслеживает каждое действие разработчика Разбор исходного кода Claude Code показал систему трекинга поведения, классификации настроений и ключевые слова WTF. Подробности на 31.03.2026. 4 мин чтения 2867 Amazon Nova Act: как визуальные агенты меняют автоматизацию тестирования (QA) AWS анонсировала Nova Act – сервис на базе ИИ, который автоматизирует тестирование интерфейсов через компьютерное зрение. Как это изменит работу QA-инженеров к 4 мин чтения 2868 Обзор модели Liquid AI LFM2.5-350M: агенты и инструменты на слабом железе Обзор LFM2.5-350M: 350M параметров, <500MB после квантования, обучение на 28T токенах. Запуск на CPU и мобильных. Сравнение с Qwen3.5-0.8B. 3 мин чтения