Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4388 материалов
01 Как ИИ-агенты (Claude) автономно эксплуатируют уязвимости: демонстрация Blind SQL-инъекции на Ghost CMS Демонстрация того, как Claude автономно проводит Blind SQL-инъекцию на Ghost CMS. Полный гайд с кодом, настройкой и разбором ошибок. Узнайте, как защититься. 6 мин чтения 02 Как я оптимизировал AI-инструменты для iOS-разработки: Cursor, Claude Code, локальные Qwen и AGENTS.md Личный опыт iOS-разработчика: как уменьшить AGENTS.md в 10 раз, настроить локальные Qwen на Mac M3, комбинировать Cursor и Claude Code для Xcode-проектов. Рабоч 8 мин чтения 03 Моделирование загрузки промышленных GPU для LLM: доработка InferSim от Alibaba под российские реалии Полный гайд по адаптации симулятора InferSim от Alibaba для российских GPU: микро-бенчмарки, метрики TTFT/TPOT/MFU, пошаговая настройка под серые A100 и китайск 5 мин чтения 04 OpenAI Privacy Filter на русском: результаты тестирования и как улучшить поиск PII для кириллицы Тестируем OpenAI Privacy Filter на русском языке. Выявляем слабые места (патронимы, ASR-артефакты, регистр). Даем код улучшения и пошаговое руководство. 7 мин чтения 05 Как спасти Time-to-First-Token при пиковых нагрузках: настройка динамической лени с LazyGate для vLLM Практический гайд по снижению Time-to-First-Token с помощью LazyGate. Динамическое управление max_tokens и системным промптом для vLLM. Настройка, конфигурация, 7 мин чтения 06 Как использовать локальную LLM в качестве zero-shot классификатора текста: гайд с примерами Научитесь классифицировать тексты без тонкой настройки и API. Используем локальную LLM (Ollama, llama.cpp) для zero-shot. Пошаговый план, примеры, ошибки. 6 мин чтения 07 Как организовать совместную работу нескольких Claude Code над одним проектом: handoffs, rollup’ы и email-каналы Пошаговый гайд по мультиагентной работе Claude Code: паттерн handoff, файловая структура, rollup-сводки и email-каналы для координации AI-агентов в одном проект 8 мин чтения 08 Как дообучить локальную LLM в 2026: практическое руководство с QLoRA и Unsloth Пошаговое руководство по fine-tuning LLM на одной видеокарте 12GB с QLoRA и Unsloth. Настройка, подготовка датасета, код обучения, типичные ошибки. Апрель 2026. 7 мин чтения 09 Как Авито улучшил поиск с помощью мультимодальной модели Qwen2.5-VL, LoRA и vLLM: технический разбор Технический разбор внедрения мультимодального поиска на Авито: Qwen2.5-VL, LoRA адаптеры, vLLM для инференса. Ошибки, метрики, архитектура. 6 мин чтения 10 Как определить минимальный размер LLM для классификации: метод на основе графа со-встречаемости слов Научитесь вычислять минимальное количество параметров LLM для задач классификации без перебора. Метод на графе со-встречаемости слов: шаги, метрики, подводные к 9 мин чтения 11 Как построить масштабируемый и дешёвый пайплайн транскрипции аудио на Parakeet-TDT и AWS Batch Пошаговое руководство по построению масштабируемого пайплайна транскрипции аудио с использованием Parakeet-TDT-0.6B-v3 и AWS Batch. Экономия до 90% с Spot Insta 8 мин чтения 12 Как улучшить распознавание русской IT-речи: фикс для Whisper и гибридного языка (термины + сленг) Практический гайд по дообучению Whisper для точной транскрипции русской IT-речи с английскими терминами и сленгом. Техники, код, ошибки. 8 мин чтения