Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4381 Mac M4 Pro 64GB против кодинговых монстров: как не ошибиться с выбором модели в 2026 Тесты памяти и производительности для агентного кодирования на Mac M4 Pro 64GB. Сравнение Qwen3-Coder-Next и 30B моделей, рекомендации по GGUF квантованию. 8 мин чтения 4382 Скандал с бенчмарками: как ошибки в GPQA и HLE искажают рейтинги моделей (разбор исследования Qwen) Новое исследование Qwen вскрыло 58% ошибок в датасетах GPQA и Humanity's Last Exam. Почему рейтинги моделей на 22.02.2026 нельзя доверять и как это исправить. 5 мин чтения 4383 Как запустить LLM на слабом Android: практический гайд по оптимизации, выбору моделей и борьбе с крашами Практический гайд по запуску языковых моделей на Android с 4 ГБ ОЗУ. Выбор моделей, оптимизация памяти, решение проблем с крашами приложений. 7 мин чтения 4384 Qwen3-coder-next на Mac: превращаем LM Studio в локальный Anthropic за 15 минут Пошаговая настройка Qwen3-coder-next в LM Studio на Mac. Конфигурация settings.json, MLX квантование, работа с Anthropic API. Полный гайд на 2026 год. 8 мин чтения 4385 Kon: кодирующий агент, который помещается в 1K токенов и работает на любом железе Обзор Kon - open-source кодирующего агента с системным промптом менее 1K токенов. Работает на локальных моделях, сравнение с конкурентами, примеры использования 7 мин чтения 4386 IQ2 квантование: 100 токенов в секунду на Qwen3-30B-A3B или как я обманул физику Тестирование IQ2 квантования на Qwen3-30B-A3B: 100 TPS vs 20 TPS, 81/100 vs 92/100 на RX 9060 XT. Практический гайд по балансу размера и качества. 6 мин чтения 4387 RAG-пайплайн, который не сломается: модульный конструктор вместо магического чёрного ящика Пошаговое руководство по созданию модульного RAG-пайплайна с заменяемыми компонентами, векторными базами и точными бенчмарками. Практика, а не теория. 11 мин чтения 4388 AI-ассистенты в коде: реальная польза против хайпа — опыт 15-летнего разработчика 15 лет разработки против AI-хейпа. Где Claude Sonnet 4 и GPT-5 реально помогают, а где галлюцинируют. Java, C++, Python — проверено на практике. 7 мин чтения 4389 smolcluster: когда один Mac mini не тянет Llama 3.2, а учить распределённое обучение с PyTorch — больно Обзор smolcluster — библиотеки для распределённого обучения LLM на чистом Python и socket. FSDP, Model Parallelism, гетерогенное железо. 7 мин чтения 4390 Qwen 4B учится писать TypeScript: как настроить LoRA на 800 примерах и не сойти с ума Пошаговое руководство по настройке Qwen 4B для генерации TypeScript кода на малом датасете. Конфигурация LoRA в Unsloth, target_modules, параметры против переоб 9 мин чтения 4391 Когда код говорит громче слов: как AI-инструменты открывают open-source для нейроразнообразных разработчиков История о том, как AI-инструменты помогли разработчику с аутизмом внести первый вклад в open-source, квантовав модель Ouro от ByteDance. 6 мин чтения 4392 OpenClaw и Browser Sandbox: как избавиться от узкого места браузерной автоматизации Firecrawl Browser Sandbox для OpenClaw: удаленный браузинг, изоляция безопасности и масштабирование агентов. Установка и примеры на 2026 год. 5 мин чтения