Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2689 Развертывание NVIDIA Nemotron 3 Super 120B на одной видеокарте: полное руководство и тесты на реальных задачах Пошаговое руководство по запуску MoE-модели Nemotron 3 Super 120B на одной RTX PRO 6000. Тесты производительности, интеграция с Luxms BI и расчет стоимости влад 9 мин чтения 2690 История Марио Цехнера: забытый создатель движка для OpenClaw и скрытые герои опенсорс-ИИ Как Марио Цехнер создал движок для OpenClaw и остался в тени. История скрытых героев open-source проектов в мире ИИ. 4 мин чтения 2691 Лайфхак: как увеличить контекстное окно Gemma 4 до 60K+ токенов с помощью Q8 mmproj Практическое руководство по замене F16 mmproj на Q8_0 для экономии памяти и увеличения контекстного окна Gemma 4 до 60K+ токенов. Актуально на апрель 2026 года. 6 мин чтения 2692 Архитектурный паттерн против галлюцинаций LLM: разделение анализа и генерации вместо усиления промптов Глубокое руководство по архитектурному паттерну, который снижает галлюцинации LLM на 70-80% без дорогих моделей. Пошаговый план внедрения на 2026 год. 8 мин чтения 2693 PocketCoder-A1: как создать автономный агент для Claude, чтобы экономить на подписке Создайте автономного агента на Python для Claude и экономьте $120 в месяц. Обзор PocketCoder-A1, сравнение с Claude Code 4.0 и альтернативами на 2026 год. 7 мин чтения 2694 Архитектура системы из 11 AI-агентов для автоматизации тестирования: подробный кейс Подробный кейс: как построить мультиагентную систему из 11 AI-агентов для автоматизации тестирования с интеграцией Jira, Figma, GitLab. Метрики и шаги. 10 мин чтения 2695 Как удалить цензуру из MoE-моделей: техника abliteration для Qwen3.5-397B на Mac Studio Пошаговое руководство по удалению цензуры из MoE-модели Qwen3.5-397B с помощью техники abliteration на Mac Studio. Работа с весами, кастомизация и нюансы. 7 мин чтения 2696 Поддержка Gemma 4 на AMD: Day 0 обзор и настройка ROCm Day 0 поддержка Gemma 4 на AMD ROCm вышла. Как настроить и запустить последнюю 27B-модель от Google на видеокартах Radeon. Полный обзор и тесты на 06.04.2026. 5 мин чтения 2697 Gemma4-31B против Gemini 3.1 Pro: как добиться рекордной производительности через Harness Пошаговое руководство по настройке Gemma4-31B с помощью фреймворка Harness для достижения уровня производительности Gemini 3.1 Pro. Методы квантования, оптимиза 8 мин чтения 2698 Dante-2B: как создают и обучают с нуля 2.1B двуязычную модель для итальянского языка на H200 Технический разбор создания Dante-2B. Как обучали двуязычную LLM с нуля для итальянского. Сравнение, примеры и зачем это нужно в 2026 году. 5 мин чтения 2699 Нейроморфные чипы для LLM: как конвертация в SNN снизит энергопотребление и задержки Как конвертация больших языковых моделей в спайковые нейросети на нейроморфных чипах сократит энергопотребление на 90%. Фреймворк LAS v3.1, последние исследован 5 мин чтения 2700 Gemma 4: разбор прорывной 31B модели, которая обошла конкурентов за $0.20 Обзор Gemma 4 31B от Google. Сравнение с GPT-5.2, анализ стоимости инференса $0.20, примеры использования и рекомендации на 2026 год. 6 мин чтения