Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4388
материалов
01
Эксплуатация уязвимости в MCP-инструментах AI: полный разбор HackTheBox Kobold
Глубокий технический гайд по эксплуатации уязвимости в MCP-инструментах AI на примере HackTheBox машины Kobold. Шаги от разведки до RCE.
02
Bankai: как заставить 1-битные LLM работать без потерь (и почему это меняет все)
Первый метод Bankai для адаптации true 1-битных LLM после квантования. Как работает, пошаговое применение, нюансы и сравнение с аналогами. Актуально на апрель 2
03
Метапромптинг и анализ ЦА: как за 2 часа получить глубокие инсайты с помощью нейросетей
Пошаговый гайд по метапромптингу: собираем данные из Telegram, прогоняем через 3 нейросети, синтезируем инсайты в NotebookLM за 2 часа. Кейс и промпты.
04
PageIndex: тестируем альтернативу векторному поиску в RAG-системах
Как запустить PageIndex локально, сравнение с векторным поиском, пошаговая настройка и тестирование для RAG-систем. Актуально на 2026 год.
05
Увеличение контекста ruGPT3XL до 8k: методика, PPL и Sparse Attention
Подробный гайд по увеличению контекста русскоязычной LLM ruGPT3XL до 8000 токенов. Sparse Attention, оценка перплексии, код на Triton и оптимизация для Hugging
06
Как настроить синтезатор речи на Repka Pi 4: Piper TTS и FastAPI сервер
Подробное руководство по настройке нейросетевого синтеза речи Piper на Repka Pi 4 с созданием своего FastAPI сервера и автозагрузкой через systemd.
07
Подключаем eGPU NVIDIA к Mac: обманываем Apple Silicon и запускаем Llama 3.2 на 24 ГБ VRAM
Пошаговый гайд: как заставить внешнюю видеокарту NVIDIA работать с Mac на Apple Silicon для ускорения локальных LLM (Llama, Nemotron) через TinyGPU. Аппаратная
08
Ловушка 64 ГБ ОЗУ на Mac: почему модели 35B-70B — мёртвая зона для локальных LLM и как из неё выйти
Почему модели 35B-70B тормозят на Mac с 64 ГБ ОЗУ. Анализ памяти, квантования, выбор между MLX и llama.cpp. Практический гайд по выходу из ловушки.
09
Гид по методам экономии памяти и ускорения LLM: TurboQuant, KVTC, RotorQuant и другие
Полное руководство по методам сжатия и ускорения LLM в 2026: TurboQuant, KV Cache Transform Coding, RotorQuant, MXFP4, AutoRound. Сравнение, выбор, ошибки.
10
Как автоматизировать сбор цен конкурентов с помощью Amazon Nova Act: пошаговый туториал
Пошаговое руководство по мониторингу цен с Amazon Nova Act. Автоматический парсинг e-commerce с браузерной автоматизацией и интеллектуальными агентами.
11
Сравнение лучших нецензурированных LLM для локального запуска: Qwen3.5 Uncensored, Llama, Mistral и другие
Полный гайд по выбору и запуску нецензурированных LLM на своем ПК. Сравнение Qwen3.5 HauhauCS, Llama 3.3 Uncensored, Mistral 2.0 и других. Тесты, требования к ж
12
DGX Spark vs облачные B200: реальный кейс и экономия при обучении модели на 6B токенов
Практический разбор обучения модели на 6B токенов: DGX Spark против облачных B200. Цифры производительности, стоимость, проблемы Triton и Mamba-2.