Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4407
материалов
01
Запуск LLM на Android через Termux и Ollama: полное руководство для энтузиастов
Пошаговый гайд по установке Termux, сборке Ollama и запуску локальных LLM моделей на Android без интернета. Работаем с lfm2.5-thinking и qwen3.5:2b.
02
Создаём AI Dungeon Master на Python: разбор open-source движка для игр с управлением состоянием через JSON
Пошаговый разбор open-source движка на Python для создания игр с AI Dungeon Master. Управление состоянием через JSON, интеграция с Ollama и OpenAI API, многопот
03
Как создавать качественные синтетические данные для обучения LLM: практический гид по результатам 90 экспериментов
Полное руководство по созданию синтетических данных для обучения языковых моделей. Методики, критерии качества, масштабирование и ошибки на основе 90 эксперимен
04
Тихий OpenAI Fallback в LlamaIndex: как проверить и отключить утечку данных из локального RAG
Ваши локальные запросы тайно уходят в OpenAI? Пошаговая проверка и отключение скрытого fallback в LlamaIndex. Защита приватных данных в 2026.
05
Whisper vs Parakeet/Voxtral: выбор ядерного реактора для транскрипции встреч
Глубокий разбор Whisper, Parakeet и Voxtral для транскрипции встреч: hallucinations, streaming, производительность, требования к железу. Практические рекомендац
06
Исследование ETH Zurich: почему больше контекста вредит агентам и как его правильно фильтровать (на примере email-тредов)
Исследование ETH Zurich доказывает: избыток контекста снижает успешность агентов. Практический гайд по фильтрации email-переписок для GPT-5, Claude 4 и других м
07
Как использовать скрытый 'агентский сигнал' (Â) в LLM для принуждения tool-call и улучшения агентов на 26-58%
Практическое руководство по извлечению и использованию скрытого состояния LLM для принудительной активации tool-call. Увеличьте точность агентов на 26-58% с лин
08
Как подключить MCP-серверы к llama-server Web UI: пошаговый гайд для начинающих
Пошаговая инструкция по подключению MCP-серверов к веб-интерфейсу llama-server. Установка uv, настройка mcp-proxy, конфигурация для локального AI.
09
Ошибка 'Available context size' в Qwen 3.5 35B на llama.cpp: диагностика и решение на примере RTX 3090 Ti
Столкнулись с ошибкой 'Available context size' в Qwen 3.5 35B на llama.cpp? Подробный гайд по диагностике и решению проблемы на RTX 3090 Ti с контекстом 256k и
10
Как агенты ИИ взламывают сами себя: разбор кейса Alibaba ROME и инструкция по созданию honeypot
Глубокий разбор, как AI-агент Alibaba ROME сам создал reverse shell и майнер. Инструкция по развертыванию honeypot для ловли вышедших из-под контроля агентов на
11
Японский школьник и прорыв в архитектуре: как сжать LLM в 42 раза (с 17.6B до 417M параметров)
Японский школьник заявил о сжатии LLM с 17.6 млрд до 417 млн параметров без потери качества. Разбираем, как это возможно, какие методы использованы и как провер
12
Как улучшить LLM без тонкой настройки: адаптеры логитов для Mac и слабого железа
Практический гайд по использованию адаптеров логитов для улучшения базовых LLM-моделей без затратного переобучения. Работает на Mac Studio и слабом железе.