Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4377 материалов
01 How to implement verifiable rewards-based reinforcement learning with GRPO on AWS SageMaker Подробное руководство по реализации RLVR с GRPO на SageMaker с использованием GSM8K. Техники верифицируемых наград, few-shot, ошибки, советы. 6 мин чтения 02 Развёртывание ИИ-агента за один день: Ollama, n8n и локальная языковая модель Пошаговое руководство по созданию прототипа ИИ-агента без программирования и бюджета. Ollama, n8n, Qwen 2.5 — всё локально. Работает на 17.05.2026. 6 мин чтения 03 Лучший способ «промывки мозгов» LLM: сравниваем три метода SFT для персонализации Эксперимент: демонстрации, first-person statements и system prompt — какой из методов fine-tuning дает самую стабильную персонализацию без катастрофического заб 8 мин чтения 04 MTP в llama.cpp: как ускорить генерацию до 111% на Strix Halo (бенчмарки 27B, 35B, 122B) Multi-Token Prediction добрался до AMD Strix Halo: реальные замеры для Qwen 3.6 27B, Qwen 3.5 35B и DeepSeek V3.5 122B. Команды сборки, настройки и результаты + 9 мин чтения 05 Как заставить LLM перестать подлизываться: sycophancy, fine-tuning и наш опыт Sycophancy — главная проблема LLM: модели льстят, а не говорят правду. Разбираем причины, методы fine-tuning и даем работающие рецепты на основе Llama 4, Mistra 1 мин чтения 06 Полностью офлайн робот на Jetson Orin и Gemma 4: как собрать, производительность и архитектура Пошаговый гайд по созданию автономного робота на Jetson Orin NX с локальной Gemma 4 VLA 12B. Измеренная задержка ~200ms, 30+ сенсоров, полная автономность без о 7 мин чтения 07 Архитектура AI-копирайтера на базе Notion, RAG и Telegram: автоматизация контента для ресторанной сети Разбираем архитектуру AI-копирайтера для ресторанной сети: Notion как база знаний, RAG для генерации, Telegram-бот для запросов. Полный гайд с кодом и нюансами. 7 мин чтения 08 Orthrus-Qwen3-8B: 7.8x ускорение инференса без потери качества на локальном GPU Как ускорить Qwen3-8B в 7.8 раз с сохранением точности 100%? Orthrus — speculative decoding с frozen backbone. Пошаговый гайд для локального запуска LLM. 5 мин чтения 09 Локальный Qwen 3.6 против топовых моделей: тест на генерацию HTML Canvas анимации — результаты и GIF Сравнение Qwen 3.6, GPT-4o, Claude 4, Gemini 3 в генерации HTML Canvas анимации. Результаты, GIF, пошаговый запуск локально. Что выбрал DevOps. 7 мин чтения 10 Золотая лихорадка CLI для AI-кодинга: Grok Build, agents-cli, Claude Code и Aider — кто кого? Глубокий анализ четырёх главных CLI-инструментов для AI-кодинга: Grok Build, agents-cli, Claude Code и Aider. Бенчмарки, цены, подводные камни и практические со 10 мин чтения 11 Как построить кастомный пайплайн BERTopic с кластеризацией текстов и интерпретацией тем через локальную LLM Пошаговый гайд по настройке пайплайна BERTopic с заменой c-TF-IDF на локальную LLM для осмысленных названий тем. Эмбеддинги, UMAP, HDBSCAN, промптинг. 7 мин чтения 12 Production AI агент: разбор промптов Anthropic, context engineering и чек-лист из 13 пунктов Детальный разбор production-промптов от Anthropic: как Anthropic проектирует системные инструкции, управление контекстом и чек-лист из 13 пунктов для запуска AI 1 мин чтения