Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4381
Mac M4 Pro 64GB против кодинговых монстров: как не ошибиться с выбором модели в 2026
Тесты памяти и производительности для агентного кодирования на Mac M4 Pro 64GB. Сравнение Qwen3-Coder-Next и 30B моделей, рекомендации по GGUF квантованию.
4382
Скандал с бенчмарками: как ошибки в GPQA и HLE искажают рейтинги моделей (разбор исследования Qwen)
Новое исследование Qwen вскрыло 58% ошибок в датасетах GPQA и Humanity's Last Exam. Почему рейтинги моделей на 22.02.2026 нельзя доверять и как это исправить.
4383
Как запустить LLM на слабом Android: практический гайд по оптимизации, выбору моделей и борьбе с крашами
Практический гайд по запуску языковых моделей на Android с 4 ГБ ОЗУ. Выбор моделей, оптимизация памяти, решение проблем с крашами приложений.
4384
Qwen3-coder-next на Mac: превращаем LM Studio в локальный Anthropic за 15 минут
Пошаговая настройка Qwen3-coder-next в LM Studio на Mac. Конфигурация settings.json, MLX квантование, работа с Anthropic API. Полный гайд на 2026 год.
4385
Kon: кодирующий агент, который помещается в 1K токенов и работает на любом железе
Обзор Kon - open-source кодирующего агента с системным промптом менее 1K токенов. Работает на локальных моделях, сравнение с конкурентами, примеры использования
4386
IQ2 квантование: 100 токенов в секунду на Qwen3-30B-A3B или как я обманул физику
Тестирование IQ2 квантования на Qwen3-30B-A3B: 100 TPS vs 20 TPS, 81/100 vs 92/100 на RX 9060 XT. Практический гайд по балансу размера и качества.
4387
RAG-пайплайн, который не сломается: модульный конструктор вместо магического чёрного ящика
Пошаговое руководство по созданию модульного RAG-пайплайна с заменяемыми компонентами, векторными базами и точными бенчмарками. Практика, а не теория.
4388
AI-ассистенты в коде: реальная польза против хайпа — опыт 15-летнего разработчика
15 лет разработки против AI-хейпа. Где Claude Sonnet 4 и GPT-5 реально помогают, а где галлюцинируют. Java, C++, Python — проверено на практике.
4389
smolcluster: когда один Mac mini не тянет Llama 3.2, а учить распределённое обучение с PyTorch — больно
Обзор smolcluster — библиотеки для распределённого обучения LLM на чистом Python и socket. FSDP, Model Parallelism, гетерогенное железо.
4390
Qwen 4B учится писать TypeScript: как настроить LoRA на 800 примерах и не сойти с ума
Пошаговое руководство по настройке Qwen 4B для генерации TypeScript кода на малом датасете. Конфигурация LoRA в Unsloth, target_modules, параметры против переоб
4391
Когда код говорит громче слов: как AI-инструменты открывают open-source для нейроразнообразных разработчиков
История о том, как AI-инструменты помогли разработчику с аутизмом внести первый вклад в open-source, квантовав модель Ouro от ByteDance.
4392
OpenClaw и Browser Sandbox: как избавиться от узкого места браузерной автоматизации
Firecrawl Browser Sandbox для OpenClaw: удаленный браузинг, изоляция безопасности и масштабирование агентов. Установка и примеры на 2026 год.