Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2689
Развертывание NVIDIA Nemotron 3 Super 120B на одной видеокарте: полное руководство и тесты на реальных задачах
Пошаговое руководство по запуску MoE-модели Nemotron 3 Super 120B на одной RTX PRO 6000. Тесты производительности, интеграция с Luxms BI и расчет стоимости влад
2690
История Марио Цехнера: забытый создатель движка для OpenClaw и скрытые герои опенсорс-ИИ
Как Марио Цехнер создал движок для OpenClaw и остался в тени. История скрытых героев open-source проектов в мире ИИ.
2691
Лайфхак: как увеличить контекстное окно Gemma 4 до 60K+ токенов с помощью Q8 mmproj
Практическое руководство по замене F16 mmproj на Q8_0 для экономии памяти и увеличения контекстного окна Gemma 4 до 60K+ токенов. Актуально на апрель 2026 года.
2692
Архитектурный паттерн против галлюцинаций LLM: разделение анализа и генерации вместо усиления промптов
Глубокое руководство по архитектурному паттерну, который снижает галлюцинации LLM на 70-80% без дорогих моделей. Пошаговый план внедрения на 2026 год.
2693
PocketCoder-A1: как создать автономный агент для Claude, чтобы экономить на подписке
Создайте автономного агента на Python для Claude и экономьте $120 в месяц. Обзор PocketCoder-A1, сравнение с Claude Code 4.0 и альтернативами на 2026 год.
2694
Архитектура системы из 11 AI-агентов для автоматизации тестирования: подробный кейс
Подробный кейс: как построить мультиагентную систему из 11 AI-агентов для автоматизации тестирования с интеграцией Jira, Figma, GitLab. Метрики и шаги.
2695
Как удалить цензуру из MoE-моделей: техника abliteration для Qwen3.5-397B на Mac Studio
Пошаговое руководство по удалению цензуры из MoE-модели Qwen3.5-397B с помощью техники abliteration на Mac Studio. Работа с весами, кастомизация и нюансы.
2696
Поддержка Gemma 4 на AMD: Day 0 обзор и настройка ROCm
Day 0 поддержка Gemma 4 на AMD ROCm вышла. Как настроить и запустить последнюю 27B-модель от Google на видеокартах Radeon. Полный обзор и тесты на 06.04.2026.
2697
Gemma4-31B против Gemini 3.1 Pro: как добиться рекордной производительности через Harness
Пошаговое руководство по настройке Gemma4-31B с помощью фреймворка Harness для достижения уровня производительности Gemini 3.1 Pro. Методы квантования, оптимиза
2698
Dante-2B: как создают и обучают с нуля 2.1B двуязычную модель для итальянского языка на H200
Технический разбор создания Dante-2B. Как обучали двуязычную LLM с нуля для итальянского. Сравнение, примеры и зачем это нужно в 2026 году.
2699
Нейроморфные чипы для LLM: как конвертация в SNN снизит энергопотребление и задержки
Как конвертация больших языковых моделей в спайковые нейросети на нейроморфных чипах сократит энергопотребление на 90%. Фреймворк LAS v3.1, последние исследован
2700
Gemma 4: разбор прорывной 31B модели, которая обошла конкурентов за $0.20
Обзор Gemma 4 31B от Google. Сравнение с GPT-5.2, анализ стоимости инференса $0.20, примеры использования и рекомендации на 2026 год.