Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4388 материалов
01 Разбор утечки Claude Code: архитектурные паттерны «ОС для ИИ» — самовосстановление, вычисления во сне и отсечение функций Анализ 512 тыс. строк утекшего кода Claude Code. Раскрываем паттерны: самовосстановление ИИ, вычисления во сне, отсечение функций. Как Anthropic строит операцио 6 мин чтения 02 APEX vs K-кванты: в чём разница и почему APEX критически важен для больших MoE-моделей (на примере QWEN Coder 80B) Глубокий разбор APEX квантования для MoE-архитектур. Почему старые методы не работают на QWEN Coder 80B и как оптимизировать память и скорость в 2026 году. 7 мин чтения 03 Сравнение локальных LLM для генерации кода: OpenCode с Qwen, Gemma, Nemotron и GLM Практическое сравнение локальных LLM для генерации кода: тестируем Qwen 3.5, Gemma 4, Nemotron 3 и GLM-4.7 Flash в OpenCode. Результаты, требования к железу и в 7 мин чтения 04 Continuous batching для агентных роев: как ускорить исследования и кодирование в разы Полное руководство по continuous batching для агентных роев. Ускоряем работу LLM-агентов в 3-5 раз с помощью vLLM и параллельной обработки. Примеры кода, настро 9 мин чтения 05 Развертывание NVIDIA Nemotron 3 Super 120B на одной видеокарте: полное руководство и тесты на реальных задачах Пошаговое руководство по запуску MoE-модели Nemotron 3 Super 120B на одной RTX PRO 6000. Тесты производительности, интеграция с Luxms BI и расчет стоимости влад 9 мин чтения 06 Лайфхак: как увеличить контекстное окно Gemma 4 до 60K+ токенов с помощью Q8 mmproj Практическое руководство по замене F16 mmproj на Q8_0 для экономии памяти и увеличения контекстного окна Gemma 4 до 60K+ токенов. Актуально на апрель 2026 года. 6 мин чтения 07 Архитектурный паттерн против галлюцинаций LLM: разделение анализа и генерации вместо усиления промптов Глубокое руководство по архитектурному паттерну, который снижает галлюцинации LLM на 70-80% без дорогих моделей. Пошаговый план внедрения на 2026 год. 8 мин чтения 08 Архитектура системы из 11 AI-агентов для автоматизации тестирования: подробный кейс Подробный кейс: как построить мультиагентную систему из 11 AI-агентов для автоматизации тестирования с интеграцией Jira, Figma, GitLab. Метрики и шаги. 10 мин чтения 09 Как удалить цензуру из MoE-моделей: техника abliteration для Qwen3.5-397B на Mac Studio Пошаговое руководство по удалению цензуры из MoE-модели Qwen3.5-397B с помощью техники abliteration на Mac Studio. Работа с весами, кастомизация и нюансы. 7 мин чтения 10 Gemma4-31B против Gemini 3.1 Pro: как добиться рекордной производительности через Harness Пошаговое руководство по настройке Gemma4-31B с помощью фреймворка Harness для достижения уровня производительности Gemini 3.1 Pro. Методы квантования, оптимиза 8 мин чтения 11 Fine-tuning Gemma 2B для структурированного извлечения JSON: полный разбор кода и 432 примера Полное руководство по тонкой настройке Gemma 2B для извлечения структурированных данных из регуляторных документов. Код, датасет и рост точности с 75% до 94%. 8 мин чтения 12 Голосовой умный дом на локальном AI: бесшовная интеграция Ollama и Whisper Пошаговая инструкция по развертыванию локальной системы голосового управления умным домом с использованием Ollama и Whisper. Решаем проблемы с VRAM, ошибкой Unk 7 мин чтения