Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4513 GEPA optimize_anything: API, который заменит вам инженера по промптам Обзор GEPA optimize_anything — универсального API для автоматической оптимизации промптов, гиперпараметров и настроек вывода LLM. Сравнение с аналогами, примеры 6 мин чтения 4514 BaldurBench: как Илон Маск заставил инженеров xAI проходить Baldur's Gate 3 вместо работы Инсайд: Илон Маск лично тестировал Grok 4.1 на прохождении Baldur's Gate 3, отвлекая инженеров от реальных задач. История о странном бенчмарке и корпоративном х 4 мин чтения 4515 Иерархический RAG провалился: почему RAPTOR набрал всего 0.094 nDCG и что делать вместо него Анализ провала RAPTOR: 0.094 nDCG против 0.749 у baseline, кумулятивные ошибки маршрутизации, практические альтернативы на 2026 год. 7 мин чтения 4516 PDFiles: ищем по картинкам в PDF как по тексту. Локальная LLM, которая видит Обзор open-source PDFiles для семантического поиска по изображениям в PDF файлах. Локальная LLM, обратный поиск, приватность. Установка, сравнение, примеры. 6 мин чтения 4517 DSP: когда ваш AI-агент наконец запомнит, где лежат файлы проекта Data Structure Protocol создает версионируемый граф проекта для AI-агентов. Экономит токены, ускоряет поиск, решает проблему контекстного окна. 6 мин чтения 4518 Как написать Transformer с нуля на CUDA: руководство по низкоуровневому программированию GPU Полное руководство по написанию Transformer на чистом CUDA C++. Работа с памятью GPU, оптимизация ядер, реализация внимания без фреймворков. 13 мин чтения 4519 Как за 26 дней и $4.62 создать продакшен-сервис с помощью LLM: кейс на .NET с DeepSeek Reasoner Реальный кейс создания бизнес-приложения с AI за 26 дней и $4.62. DeepSeek Reasoner, .NET, точные метрики токенов и экономии. 10 мин чтения 4520 Китайские модели лидируют на OpenRouter: 3 триллиона токенов и смена лидеров Анализ OpenRouter 20.02.2026: китайские модели генерируют 3 триллиона токенов в месяц. Почему DeepSeek и Qwen побеждают GPT-5 и что это значит для рынка. 5 мин чтения 4521 Как снять короткометражный фильм на AI: обзор инструментов Google Flow Sessions и кейс независимого режиссёра Полный гайд по созданию короткометражки на AI. Обзор Google Flow Sessions, Nano Banana Pro, реальный кейс независимого режиссёра. Инструменты 2026 года. 10 мин чтения 4522 Нативная валюта ИИ против Биткоина: как Anthropic и другие создают финансовую инфраструктуру для машинной экономики Как Anthropic, OpenAI и другие создают нативную валюту для ИИ-экономики. Почему биткоин устарел для машинных транзакций. Анализ 2026 года. 6 мин чтения 4523 Как заменить облачный LLM в голосовом ассистенте на Qwen3-0.6B: инструкция по тонкой настройке и 200-кратное ускорение Полное руководство по замене облачных LLM на Qwen3-0.6B. Снижаем задержку с 750ms до 40ms при сохранении 90.9% точности. Архитектура, обучение, деплой. 7 мин чтения 4524 Краткосрочные поведенческие профили: как заставить LLM на один раз стать другим Методология краткосрочных поведенческих профилей для LLM: как менять характер модели на один запрос. Примеры, промпты и исследования на 2026 год. 7 мин чтения