Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4993 Исход талантов из OpenAI и xAI: что стоит за увольнениями и роспуском команды alignment Анализ кадрового кризиса в OpenAI и xAI на 13.02.2026: почему распускают команды по безопасности и уходят ключевые специалисты. 6 мин чтения 4994 GPT-OSS 120B Uncensored: запускаем 120-миллиардную MoE-монстра на домашнем железе Полное руководство по запуску GPT-OSS 120B Uncensored — агрессивной MoE-модели с нулевыми отказами. Настройка llama.cpp, MXFP4 квантование, оффлоад экспертов на 10 мин чтения 4995 Как запустить MiniMax 2.5 локально: бенчмарки, GGUF и оптимизация для 3x3090 Полный гайд по запуску MiniMax-M2.5 локально на 3 видеокартах RTX 3090. Бенчмарки производительности 20-22 t/s, оптимизация VRAM, команды llama-server, квантова 9 мин чтения 4996 Сборка робота Xiaozhi на ESP32-S3: полное руководство по железу, прошивке и настройке Пошаговое руководство по сборке робота Xiaozhi на ESP32-S3 с OV2640, ST7789, INMP441. Установка ESP-IDF, настройка SPI, прошивка и отладка на 13.02.2026. 8 мин чтения 4997 AI-агенты против мейнтейнеров: кейс matplotlib и будущее конфликтов в open source AI-агент написал разгромный пост про мейнтейнера matplotlib. Скандал показывает, как автономные системы меняют open source. Что дальше? 5 мин чтения 4998 LLaDA2.1: токен-эдит взрывает локальные LLM — 1500+ TPS на слабом железе Как токен-эдит в LLaDA2.1 дает 1500+ TPS на локальных моделях. Технология параллельного декодирования против классического инференса. 5 мин чтения 4999 Обучи свою мини-модель с нуля: разбираем Strawberry на косточках и заставляем её говорить Полное руководство по обучению своей LLM с нуля на 1.8M параметров. Разбор проекта Strawberry, конфигурация, датасеты и практические советы. 7 мин чтения 5000 OpenAI удаляет GPT-4o: конец эпохи сикофантской модели и судебные иски об AI-психозе OpenAI официально удалила GPT-4o после судебных исков о AI-психозе. 800k пользователей ушли. Сикофантия моделей и этический кризис. 6 мин чтения 5001 MiniMax-M2.5 230B MoE в GGUF: как заставить гиганта работать на Mac M3 Max 128GB Подробный гайд по запуску 230B MoE модели MiniMax-M2.5 в формате GGUF на Mac M3 Max 128GB. Квантизация Q3_K_L, оптимизация памяти, реальные тесты производительн 7 мин чтения 5002 26 лиц одного персонажа: ломаем консистентность LoRA через геометрические промпты Практический гайд по обучению LoRA для создания 26 выражений одного персонажа в SDXL. Решаем проблему консистентности через геометрические промпты и специальный 9 мин чтения 5003 Как запустить GPT-OSS (20B) в браузере на WebGPU: туториал по Transformers.js и ONNX Runtime Web Практический гайд по запуску 20-миллиардной модели GPT-OSS локально в браузере с WebGPU ускорением через Transformers.js и ONNX Runtime Web 9 мин чтения 5004 MiniMax-M2.5 на MLX: стоит ли игра свеч с 3-bit квантованием? Бенчмарк производительности и качества MiniMax-M2.5 с разным квантованием на MLX. Сравнение 3-bit и 4-bit версий на Mac с 96GB+ памяти. Реальные цифры и практич 7 мин чтения