Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
5149
OpenResearcher: ваш личный офлайн-исследователь, который бьёт GPT-4.1. И это не шутка
Как запустить OpenResearcher - 30B-параметровый офлайн-агент, который обходит GPT-4.1 на BrowseComp-Plus. Руководство, сравнение, установка.
5150
Запуск 70B+ моделей на домашнем ПК: слоевый стриминг против ограничений VRAM
Полное руководство по запуску 70B+ моделей на домашнем ПК. Слоевый стриминг, CPU offloading, оптимизация VRAM и практические примеры для RTX 5060 Ti, NVIDIA Tho
5151
Бенчмарк 40 AI-моделей (Февраль 2026): Liquid LFM 2.5 (359 TPS) против Ministral 3B — тактика выбора
Сравнение 40 AI-моделей по TPS и стоимости. Liquid LFM 2.5 (359 токенов/сек) против Ministral 3B. Тактика выбора модели под задачу в 2026 году.
5152
Unsloth научился ускорять MoE-модели в 12 раз: как Triton kernels ломают физику VRAM
Обзор Triton оптимизаций Unsloth для MoE-моделей: 12x ускорение обучения, экономия 30% памяти, поддержка Qwen3 и DeepSeek на 10.02.2026
5153
Gemini CLI Proxy: ваш личный шлюз к Google AI без головной боли
Пошаговый гайд по настройке Gemini CLI Proxy с OpenAI-совместимым API, дашбордом и управлением ключами. Запускаем прокси-сервер для Gemini 3 за 10 минут.
5154
Средние LLM 20-80B: как выбрать модель, которая не сломает вашу видеокарту
Полный гайд по выбору и запуску средних LLM моделей 20-80B параметров. Сравнение квантований Q4/Q5/MXFP4, тесты производительности и практические рекомендации д
5155
Защита базы данных от AI: как regex lock предотвращает DROP TABLE в Text-to-SQL агенте
Практическое руководство по защите баз данных от опасных SQL-запросов AI-агентов. Реализация regex lock и SqlJudge на Python. Актуально на 2026 год.
5156
Language Dove: как я создал интерактивные субтитры для изучения языков с помощью AI
Пошаговый гайд по созданию Language Dove - системы интерактивных субтитров с подсветкой слов, контекстуальным переводом и романзацией. Используем Whisper 2026,
5157
Индия ставит штамп на deepfakes: 36 часов на удаление, или платформы уходят с рынка
Индия вводит жесткие правила для синтетического контента: обязательная маркировка, 36 часов на удаление жалоб. Как это изменит YouTube, Meta и TikTok.
5158
Когда RAM не хватает: заставляем llama.cpp работать с контекстом 1M+ через SSD Offload
Пошаговый гайд по offload KV-кэша на SSD для llama.cpp. Как запустить контекст 500K+ на обычном железе. Настройка, оптимизация, ловушки.
5159
AI-пузырь 2026: почему падают акции NVIDIA и Oracle, и что это значит для индустрии
Анализ обвала рынка AI-акций в феврале 2026: почему NVIDIA и Oracle потеряли $500 млрд, и что ждет индустрию искусственного интеллекта дальше.
5160
Когда 128К токенов не хватает: как заставить LLM анализировать документы длиннее её памяти
Практическое руководство по обработке длинных документов в LLM. Методы chunking, advanced RAG, иерархическая агрегация и сохранение контекста с примерами кода н