Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7081
Как работает Confer: первый по-настоящему приватный AI-ассистент с шифрованием в TEE
Как Moxie Marlinspike создал приватный AI-ассистент с шифрованием в Trusted Execution Environment. Сравнение с локальными альтернативами.
7082
FrogBoss и FrogMini: как Microsoft создала AI-агентов для автоматического исправления багов в коде
Как Microsoft создала FrogBoss и FrogMini - AI-агентов для автоматического исправления багов в коде. Технические детали, сравнение с альтернативами и примеры ис
7083
Qwen3 VL галлюцинирует tool-calls в Ollama: как заставить модель видеть реальность
Паттерны ошибок, промпты и решения для мультимодальных галлюцинаций в Qwen3 VL. Практический гайд по отладке tool-calling в Ollama.
7084
Семантическая декомпозиция медицинских текстов на атомарные факты: архитектура фактор-центричной модели данных
Как перейти от документо-центрической к фактор-центрической модели в медицинском AI. Извлечение биомаркеров, находок МРТ, витальных параметров. Архитектура и пр
7085
Converge Bio: зачем Bessemer и Meta вкладывают миллионы в AI-лекарства
Инвестиции в Converge Bio показывают, как generative AI ускоряет поиск новых лекарств. Разбираем тренд AI в фармацевтике.
7086
EAFT в бою: тест на uncensor-задаче против обычного fine-tuning
Практический эксперимент: сравниваем Entropy Adaptive Fine Tuning с обычным fine-tuning на задаче uncensor. Результаты, код, модели.
7087
Как обрабатывать длинные PDF-документы (130+ страниц) в Docling: стратегии чанкинга и оптимизации
Практическое руководство по обработке PDF 130+ страниц в Docling. Автоматический чанкинг, настройка сегментации, оптимизация производительности RAG-пайплайнов.
7088
Tencent WeDLM-8B в chatllm.cpp: декодирование на грани и почему GPU иногда проигрывает
Подробный обзор запуска модели WeDLM-8B в chatllm.cpp: настройка параметров block_size, accept_algo, сравнение производительности CPU и GPU.
7089
Gemma 3 1B Q4_0 GGUF: как правильно квантовать QAT-модель без imatrix
Пошаговая инструкция по правильному квантованию Gemma 3 1B в формат GGUF без использования imatrix. Исправление метаданных и токенизатора.
7090
Epyc 9175F для CPU-инференса: реальные тесты против теории и M3 Max
Практический тест Epyc 9175F для CPU-инференса Llama 3.1 70B. Сравнение с Apple M3 Max, анализ 600 Gbs памяти и оффлоадинга слоев. Реальные цифры против маркети
7091
Как выбрать LLM под 128 ГБ VRAM: сравнение моделей для обработки длинных техдокументов
Сравнение Qwen3-32B, GPT-OSS:120B и других моделей для работы с длинным контекстом на 8×RTX 5070 Ti. Практический гайд по выбору LLM для технической документаци
7092
Будущее разработки ПО в 2026: как выжить junior-разработчику в эпоху AI-агентов
Сценарии 2026 года для junior-разработчиков. Как изменится карьера в IT с приходом автономных AI-агентов. Стратегии выживания и роста.