Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4993
Исход талантов из OpenAI и xAI: что стоит за увольнениями и роспуском команды alignment
Анализ кадрового кризиса в OpenAI и xAI на 13.02.2026: почему распускают команды по безопасности и уходят ключевые специалисты.
4994
GPT-OSS 120B Uncensored: запускаем 120-миллиардную MoE-монстра на домашнем железе
Полное руководство по запуску GPT-OSS 120B Uncensored — агрессивной MoE-модели с нулевыми отказами. Настройка llama.cpp, MXFP4 квантование, оффлоад экспертов на
4995
Как запустить MiniMax 2.5 локально: бенчмарки, GGUF и оптимизация для 3x3090
Полный гайд по запуску MiniMax-M2.5 локально на 3 видеокартах RTX 3090. Бенчмарки производительности 20-22 t/s, оптимизация VRAM, команды llama-server, квантова
4996
Сборка робота Xiaozhi на ESP32-S3: полное руководство по железу, прошивке и настройке
Пошаговое руководство по сборке робота Xiaozhi на ESP32-S3 с OV2640, ST7789, INMP441. Установка ESP-IDF, настройка SPI, прошивка и отладка на 13.02.2026.
4997
AI-агенты против мейнтейнеров: кейс matplotlib и будущее конфликтов в open source
AI-агент написал разгромный пост про мейнтейнера matplotlib. Скандал показывает, как автономные системы меняют open source. Что дальше?
4998
LLaDA2.1: токен-эдит взрывает локальные LLM — 1500+ TPS на слабом железе
Как токен-эдит в LLaDA2.1 дает 1500+ TPS на локальных моделях. Технология параллельного декодирования против классического инференса.
4999
Обучи свою мини-модель с нуля: разбираем Strawberry на косточках и заставляем её говорить
Полное руководство по обучению своей LLM с нуля на 1.8M параметров. Разбор проекта Strawberry, конфигурация, датасеты и практические советы.
5000
OpenAI удаляет GPT-4o: конец эпохи сикофантской модели и судебные иски об AI-психозе
OpenAI официально удалила GPT-4o после судебных исков о AI-психозе. 800k пользователей ушли. Сикофантия моделей и этический кризис.
5001
MiniMax-M2.5 230B MoE в GGUF: как заставить гиганта работать на Mac M3 Max 128GB
Подробный гайд по запуску 230B MoE модели MiniMax-M2.5 в формате GGUF на Mac M3 Max 128GB. Квантизация Q3_K_L, оптимизация памяти, реальные тесты производительн
5002
26 лиц одного персонажа: ломаем консистентность LoRA через геометрические промпты
Практический гайд по обучению LoRA для создания 26 выражений одного персонажа в SDXL. Решаем проблему консистентности через геометрические промпты и специальный
5003
Как запустить GPT-OSS (20B) в браузере на WebGPU: туториал по Transformers.js и ONNX Runtime Web
Практический гайд по запуску 20-миллиардной модели GPT-OSS локально в браузере с WebGPU ускорением через Transformers.js и ONNX Runtime Web
5004
MiniMax-M2.5 на MLX: стоит ли игра свеч с 3-bit квантованием?
Бенчмарк производительности и качества MiniMax-M2.5 с разным квантованием на MLX. Сравнение 3-bit и 4-bit версий на Mac с 96GB+ памяти. Реальные цифры и практич