Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4681
GLM-5-Q2 против GLM-4.7-Q4: битва квантований на математике и логике
Практическое тестирование IQ2_XXS и Q4_K_XL на математике и логике. Какая квантовка выжимает больше IQ из модели? Размеры, скорость, точность.
4682
Entropy-v1: когда AI-слэп так бесит, что пишешь под него целую LoRA
Технический разбор Entropy-v1 — LoRA для Gemma-3-27b, которая превращает бездушный AI-слэп в живой человеческий текст. Параметры, датасеты, сравнение с Unsloppe
4683
Гардрейлы 2025: как примитивные фильтры уступили место цепочкам классификаторов
Анализ перехода от простых фильтров к цепочкам классификаторов в защите LLM. Антропик, промпт-атаки, безопасность ИИ на 18.02.2026.
4684
Почему INT8-модели врут на разных Snapdragon: подводные камни квантования на мобильных NPU
Технический разбор: почему квантованные модели теряют точность на разных Snapdragon. Сравнение чипсетов, анализ проблем NPU и практические решения.
4685
GLM-5: Китайский SOTA взломал главную проблему AI - цену обучения. Как DSA и асинхронный RL убили монополию Google и OpenAI
Технический разбор GLM-5 - как Distributed Sequence Attention и асинхронное обучение с подкреплением делают модель дешевле и лучше в кодинге
4686
Opus 4.6 против GPT-5.3-Codex: битва быстрых режимов для кода
Прямое сравнение быстрых режимов Opus 4.6 и GPT-5.3-Codex для разработки: токены в секунду, качество кода, батчинг и реальная производительность.
4687
Как правильно определить цель и метрики успеха для AI-проекта до начала разработки
Как избежать провала AI-проекта: пошаговый план определения целей и метрик от Senior DevOps. Актуально на 2026 год.
4688
Как настроить OpenClaw: AI-ассистент, который работает с GitHub и почтой вместо тебя
Полный гайд по установке и настройке OpenClaw - локального AI-ассистента для автоматизации работы с GitHub Issues, PR и электронной почтой. Актуально на 2026 го
4689
Strix Halo: полное руководство по настройке голосового AI-ассистента с локальными моделями (Whisper, Qwen, ComfyUI)
Пошаговое руководство по развертыванию Strix Halo - локального голосового ассистента с Whisper NPU, Qwen3-Coder и ComfyUI. Приватность и полный контроль.
4690
Game Agent Coding League: как GLM-5 и DeepSeek пишут игровых ботов — обзор бенчмарка и исходного кода
Разбор Game Agent Coding League — открытого бенчмарка, где GLM-5, DeepSeek и другие модели пишут ботов для Battleship. Результаты, код, ошибки.
4691
Спекулятивный декодинг на AMD Strix Halo: ускорение MoE-моделей на APU с 128 ГБ памяти — теория и практика
Практическое руководство по спекулятивному декодингу MoE-моделей на AMD Strix Halo с 128 ГБ памяти. Настройка llama.cpp, бенчмарки, оптимизация GGUF.
4692
Три победы подряд на NVIDIA хакатхонах: как стартап из нейронауки взял DGX Spark GB10 и не остановился
История стартапа, который трижды выиграл хакатхон NVIDIA с проектом Brain World Models и как это помогло в прикладной нейронауке. Стратегия, железо, результат.