Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
3505
mlx-tune на MacBook: Бесплатный прототипинг Llama и Qwen вместо облачных GPU
Полный гайд по mlx-tune. Настройка Llama 3.3, Qwen2.5 и Vision-моделей на MacBook с помощью SFT, DPO, LoRA. Экспорт в GGUF, интеграция с Unsloth API. Экономия н
3506
Нейро-символьный ИИ на PyTorch: как нейросеть сама научилась выявлять мошенничество и генерировать правила
Практический гайд по созданию нейро-символьной модели на PyTorch 2.5. Нейросеть сама генерирует IF-THEN правила для обнаружения мошенничества с ROC-AUC 0.933. П
3507
Исследование: как 97% менеджеров продуктов используют ИИ в 2025 году
Результаты исследования 1220 продукт-менеджеров: какие ИИ-инструменты вошли в рутину, как изменились навыки и зарплаты в 2025 году.
3508
Клиппи возвращается: как превратить Ollama в персонального AI-ассистента на рабочем столе
Готовый инструмент для создания персонального AI-ассистента на основе Ollama с визуальным интерфейсом в стиле Клиппи. Автоматизация файлов, почты и браузера.
3509
Сжатие MLP-слоёв в LLM: почему модели деградируют по-разному и как найти оптимальную точку
Исследуем, почему Gemma 2B и Llama 3.1 8B по-разному теряют качество при сжатии MLP-слоев. Практический гайд по поиску оптимальной точки сжатия для экономии рес
3510
Архитектура AAF: как GraphRAG и EventBus решают проблемы памяти и безопасности в автономных ИИ-агентах
Подробный разбор архитектуры AAF для автономных ИИ-агентов. Решаем проблемы памяти, зацикливания и безопасности с GraphRAG и EventBus. Актуально на 2026 год.
3511
Holotron-12B: NVIDIA и H Company удваивают скорость ваших AI-агентов
Разбираем Holotron-12B от H Company и NVIDIA — open-source модель для компьютерных агентов с удвоенной пропускной способностью. Релиз март 2026.
3512
Багрепорт: Mistral 4 в GGUF формате врет о контексте в 1 млн токенов
Обнаружен баг в GGUF-файлах Mistral 4: модель сообщает о контексте в 1 млн токенов, хотя реально 256k. Риски для памяти и работы.
3513
Qwen 3 32B против Qwen 3.5: результаты 11 слепых тестов и почему плотная модель победила MoE
Неожиданные результаты 11 независимых слепых тестов: Qwen 3 32B (dense) обходит Qwen 3.5 (MoE). Разбираемся, почему архитектура не всегда определяет качество на
3514
Layer Surgery: практическое руководство по дублированию трансформерных слоев для улучшения локальных LLM и опасная зона на 50% глубины
Практическое руководство по улучшению локальных LLM через дублирование трансформерных слоев. Обнаружена опасная зона на 50% глубины модели. Работа с Qwen2.5-Cod
3515
Автоматизация браузера на локальных LLM: как stepwise planning и компактный DOM экономят 80% токенов (на примере Qwen 8B+4B)
Пошаговый гайд по браузерной автоматизации на Qwen 8B+4B. Используем stepwise planning и компактный DOM для работы на локальных моделях и экономии токенов.
3516
Дефицит чипов памяти до 2030: как кризис повлияет на стоимость и развитие локальных LLM
SK Hynix прогнозирует дефицит чипов памяти до 2030 года. Как это повлияет на стоимость железа для локальных языковых моделей и что делать энтузиастам.