Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

5581 Mistral Voxtral Mini 4B Realtime: самая быстрая речь, которую можно засунуть в ноутбук Тестируем сверхкомпактную модель для стриминга речи от Mistral. Задержка <500 мс, 4B параметров, локальный запуск на слабом железе. 5 мин чтения 5582 Политический ИИ-апокалипсис Дарио Амодеи: почему CEO Anthropic готов к войне за безопасность Разбор ястребиной позиции CEO Anthropic о политических рисках ИИ, регулировании и будущих конфликтах. Эксклюзивный анализ эссе 2026 года. 4 мин чтения 5583 Российские AI-платформы для аналитиков: полный гайд по выбору (on-premise, облако РФ, open source) Полный гайд по выбору российских AI-платформ для аналитиков в условиях 152-ФЗ и КИИ. GigaChat on-premise, Qwen, Roo Code, локальное развертывание, облачные реше 8 мин чтения 5584 Куда a16z вкладывает $1.7 млрд в AI-инфраструктуру: тренды 2026 года от инвестора Jennifer Li Куда a16z инвестирует $1.7 млрд в AI-инфраструктуру в 2026 году. Тренды от Jennifer Li, портфельные компании и будущее разработки ПО. 6 мин чтения 5585 Король вернулся: Qwen3-Coder-Next-FP8 с 8-битной точностью — тест нового чемпиона Обзор Qwen3-Coder-Next-FP8 — модели для программирования с квантованием FP8. Сравнение с альтернативами, тесты производительности, установка и рекомендации на 2 5 мин чтения 5586 NTTuner: GUI для тонкой настройки LLM, который не заставит вас ненавидеть fine-tuning Полный обзор NTTuner — графического интерфейса для тонкой настройки LLM с Unsloth, скрейпером данных и экспортом в Ollama. Настройка моделей без командной строк 8 мин чтения 5587 llama.cpp Responses/Messages API: как заменить OpenAI и не сойти с ума Полное сравнение новых API llama.cpp с OpenAI, настройка агентов на Pydantic и Smolagents, работа с моделями 120B. Актуально на 04.02.2026. 10 мин чтения 5588 Llama.cpp без обёрток: как встроить движок LLM прямо в свой проект Полный гайд по интеграции llama.cpp в сторонние проекты. Сравнение подходов: прямое использование C++ API, HTTP-сервер, Python-биндинги, обёртки. Примеры кода и 8 мин чтения 5589 FS-Researcher: практический гайд по созданию ИИ-исследователя с файловой системой вместо контекстного окна Пошаговое руководство по созданию автономного ИИ-исследователя с файловой системой вместо ограниченного контекстного окна. Архитектура, код, настройка агентов. 11 мин чтения 5590 Cursor — это дорого. Вот что работает вместо него с локальными LLM в 2026 году Сравнительный обзор IDE и редакторов для локальных LLM разработки без облачных затрат. Замена Cursor с оффлайн-моделями. 7 мин чтения 5591 ИИ в фундаментальной науке: что обсуждают на закрытых встречах в Принстоне и как это изменит исследования Инсайдерский взгляд на использование ИИ в фундаментальных исследованиях. Что обсуждают учёные на закрытых встречах и как это перевернёт науку. 6 мин чтения 5592 Почему PCIe серверы убивают ROI при обучении LLM: разбор ошибок и как построить бюджетный H100 кластер Разбор фатальных ошибок при выборе железа для обучения LLM 70B+. Почему PCIe убивает ROI и как собрать бюджетный H100 кластер с NVLink в 2026 году. 8 мин чтения