Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4681 GLM-5-Q2 против GLM-4.7-Q4: битва квантований на математике и логике Практическое тестирование IQ2_XXS и Q4_K_XL на математике и логике. Какая квантовка выжимает больше IQ из модели? Размеры, скорость, точность. 7 мин чтения 4682 Entropy-v1: когда AI-слэп так бесит, что пишешь под него целую LoRA Технический разбор Entropy-v1 — LoRA для Gemma-3-27b, которая превращает бездушный AI-слэп в живой человеческий текст. Параметры, датасеты, сравнение с Unsloppe 6 мин чтения 4683 Гардрейлы 2025: как примитивные фильтры уступили место цепочкам классификаторов Анализ перехода от простых фильтров к цепочкам классификаторов в защите LLM. Антропик, промпт-атаки, безопасность ИИ на 18.02.2026. 5 мин чтения 4684 Почему INT8-модели врут на разных Snapdragon: подводные камни квантования на мобильных NPU Технический разбор: почему квантованные модели теряют точность на разных Snapdragon. Сравнение чипсетов, анализ проблем NPU и практические решения. 7 мин чтения 4685 GLM-5: Китайский SOTA взломал главную проблему AI - цену обучения. Как DSA и асинхронный RL убили монополию Google и OpenAI Технический разбор GLM-5 - как Distributed Sequence Attention и асинхронное обучение с подкреплением делают модель дешевле и лучше в кодинге 5 мин чтения 4686 Opus 4.6 против GPT-5.3-Codex: битва быстрых режимов для кода Прямое сравнение быстрых режимов Opus 4.6 и GPT-5.3-Codex для разработки: токены в секунду, качество кода, батчинг и реальная производительность. 7 мин чтения 4687 Как правильно определить цель и метрики успеха для AI-проекта до начала разработки Как избежать провала AI-проекта: пошаговый план определения целей и метрик от Senior DevOps. Актуально на 2026 год. 8 мин чтения 4688 Как настроить OpenClaw: AI-ассистент, который работает с GitHub и почтой вместо тебя Полный гайд по установке и настройке OpenClaw - локального AI-ассистента для автоматизации работы с GitHub Issues, PR и электронной почтой. Актуально на 2026 го 10 мин чтения 4689 Strix Halo: полное руководство по настройке голосового AI-ассистента с локальными моделями (Whisper, Qwen, ComfyUI) Пошаговое руководство по развертыванию Strix Halo - локального голосового ассистента с Whisper NPU, Qwen3-Coder и ComfyUI. Приватность и полный контроль. 9 мин чтения 4690 Game Agent Coding League: как GLM-5 и DeepSeek пишут игровых ботов — обзор бенчмарка и исходного кода Разбор Game Agent Coding League — открытого бенчмарка, где GLM-5, DeepSeek и другие модели пишут ботов для Battleship. Результаты, код, ошибки. 7 мин чтения 4691 Спекулятивный декодинг на AMD Strix Halo: ускорение MoE-моделей на APU с 128 ГБ памяти — теория и практика Практическое руководство по спекулятивному декодингу MoE-моделей на AMD Strix Halo с 128 ГБ памяти. Настройка llama.cpp, бенчмарки, оптимизация GGUF. 7 мин чтения 4692 Три победы подряд на NVIDIA хакатхонах: как стартап из нейронауки взял DGX Spark GB10 и не остановился История стартапа, который трижды выиграл хакатхон NVIDIA с проектом Brain World Models и как это помогло в прикладной нейронауке. Стратегия, железо, результат. 7 мин чтения