Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5149 OpenResearcher: ваш личный офлайн-исследователь, который бьёт GPT-4.1. И это не шутка Как запустить OpenResearcher - 30B-параметровый офлайн-агент, который обходит GPT-4.1 на BrowseComp-Plus. Руководство, сравнение, установка. 8 мин чтения 5150 Запуск 70B+ моделей на домашнем ПК: слоевый стриминг против ограничений VRAM Полное руководство по запуску 70B+ моделей на домашнем ПК. Слоевый стриминг, CPU offloading, оптимизация VRAM и практические примеры для RTX 5060 Ti, NVIDIA Tho 9 мин чтения 5151 Бенчмарк 40 AI-моделей (Февраль 2026): Liquid LFM 2.5 (359 TPS) против Ministral 3B — тактика выбора Сравнение 40 AI-моделей по TPS и стоимости. Liquid LFM 2.5 (359 токенов/сек) против Ministral 3B. Тактика выбора модели под задачу в 2026 году. 5 мин чтения 5152 Unsloth научился ускорять MoE-модели в 12 раз: как Triton kernels ломают физику VRAM Обзор Triton оптимизаций Unsloth для MoE-моделей: 12x ускорение обучения, экономия 30% памяти, поддержка Qwen3 и DeepSeek на 10.02.2026 5 мин чтения 5153 Gemini CLI Proxy: ваш личный шлюз к Google AI без головной боли Пошаговый гайд по настройке Gemini CLI Proxy с OpenAI-совместимым API, дашбордом и управлением ключами. Запускаем прокси-сервер для Gemini 3 за 10 минут. 9 мин чтения 5154 Средние LLM 20-80B: как выбрать модель, которая не сломает вашу видеокарту Полный гайд по выбору и запуску средних LLM моделей 20-80B параметров. Сравнение квантований Q4/Q5/MXFP4, тесты производительности и практические рекомендации д 7 мин чтения 5155 Защита базы данных от AI: как regex lock предотвращает DROP TABLE в Text-to-SQL агенте Практическое руководство по защите баз данных от опасных SQL-запросов AI-агентов. Реализация regex lock и SqlJudge на Python. Актуально на 2026 год. 7 мин чтения 5156 Language Dove: как я создал интерактивные субтитры для изучения языков с помощью AI Пошаговый гайд по созданию Language Dove - системы интерактивных субтитров с подсветкой слов, контекстуальным переводом и романзацией. Используем Whisper 2026, 8 мин чтения 5157 Индия ставит штамп на deepfakes: 36 часов на удаление, или платформы уходят с рынка Индия вводит жесткие правила для синтетического контента: обязательная маркировка, 36 часов на удаление жалоб. Как это изменит YouTube, Meta и TikTok. 6 мин чтения 5158 Когда RAM не хватает: заставляем llama.cpp работать с контекстом 1M+ через SSD Offload Пошаговый гайд по offload KV-кэша на SSD для llama.cpp. Как запустить контекст 500K+ на обычном железе. Настройка, оптимизация, ловушки. 7 мин чтения 5159 AI-пузырь 2026: почему падают акции NVIDIA и Oracle, и что это значит для индустрии Анализ обвала рынка AI-акций в феврале 2026: почему NVIDIA и Oracle потеряли $500 млрд, и что ждет индустрию искусственного интеллекта дальше. 6 мин чтения 5160 Когда 128К токенов не хватает: как заставить LLM анализировать документы длиннее её памяти Практическое руководство по обработке длинных документов в LLM. Методы chunking, advanced RAG, иерархическая агрегация и сохранение контекста с примерами кода н 8 мин чтения