Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4407 материалов
01 Запуск LLM на Android через Termux и Ollama: полное руководство для энтузиастов Пошаговый гайд по установке Termux, сборке Ollama и запуску локальных LLM моделей на Android без интернета. Работаем с lfm2.5-thinking и qwen3.5:2b. 7 мин чтения 02 Создаём AI Dungeon Master на Python: разбор open-source движка для игр с управлением состоянием через JSON Пошаговый разбор open-source движка на Python для создания игр с AI Dungeon Master. Управление состоянием через JSON, интеграция с Ollama и OpenAI API, многопот 10 мин чтения 03 Как создавать качественные синтетические данные для обучения LLM: практический гид по результатам 90 экспериментов Полное руководство по созданию синтетических данных для обучения языковых моделей. Методики, критерии качества, масштабирование и ошибки на основе 90 эксперимен 7 мин чтения 04 Тихий OpenAI Fallback в LlamaIndex: как проверить и отключить утечку данных из локального RAG Ваши локальные запросы тайно уходят в OpenAI? Пошаговая проверка и отключение скрытого fallback в LlamaIndex. Защита приватных данных в 2026. 5 мин чтения 05 Whisper vs Parakeet/Voxtral: выбор ядерного реактора для транскрипции встреч Глубокий разбор Whisper, Parakeet и Voxtral для транскрипции встреч: hallucinations, streaming, производительность, требования к железу. Практические рекомендац 8 мин чтения 06 Исследование ETH Zurich: почему больше контекста вредит агентам и как его правильно фильтровать (на примере email-тредов) Исследование ETH Zurich доказывает: избыток контекста снижает успешность агентов. Практический гайд по фильтрации email-переписок для GPT-5, Claude 4 и других м 9 мин чтения 07 Как использовать скрытый 'агентский сигнал' (Â) в LLM для принуждения tool-call и улучшения агентов на 26-58% Практическое руководство по извлечению и использованию скрытого состояния LLM для принудительной активации tool-call. Увеличьте точность агентов на 26-58% с лин 7 мин чтения 08 Как подключить MCP-серверы к llama-server Web UI: пошаговый гайд для начинающих Пошаговая инструкция по подключению MCP-серверов к веб-интерфейсу llama-server. Установка uv, настройка mcp-proxy, конфигурация для локального AI. 7 мин чтения 09 Ошибка 'Available context size' в Qwen 3.5 35B на llama.cpp: диагностика и решение на примере RTX 3090 Ti Столкнулись с ошибкой 'Available context size' в Qwen 3.5 35B на llama.cpp? Подробный гайд по диагностике и решению проблемы на RTX 3090 Ti с контекстом 256k и 7 мин чтения 10 Как агенты ИИ взламывают сами себя: разбор кейса Alibaba ROME и инструкция по созданию honeypot Глубокий разбор, как AI-агент Alibaba ROME сам создал reverse shell и майнер. Инструкция по развертыванию honeypot для ловли вышедших из-под контроля агентов на 7 мин чтения 11 Японский школьник и прорыв в архитектуре: как сжать LLM в 42 раза (с 17.6B до 417M параметров) Японский школьник заявил о сжатии LLM с 17.6 млрд до 417 млн параметров без потери качества. Разбираем, как это возможно, какие методы использованы и как провер 5 мин чтения 12 Как улучшить LLM без тонкой настройки: адаптеры логитов для Mac и слабого железа Практический гайд по использованию адаптеров логитов для улучшения базовых LLM-моделей без затратного переобучения. Работает на Mac Studio и слабом железе. 7 мин чтения