Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7081 Как работает Confer: первый по-настоящему приватный AI-ассистент с шифрованием в TEE Как Moxie Marlinspike создал приватный AI-ассистент с шифрованием в Trusted Execution Environment. Сравнение с локальными альтернативами. 5 мин чтения 7082 FrogBoss и FrogMini: как Microsoft создала AI-агентов для автоматического исправления багов в коде Как Microsoft создала FrogBoss и FrogMini - AI-агентов для автоматического исправления багов в коде. Технические детали, сравнение с альтернативами и примеры ис 3 мин чтения 7083 Qwen3 VL галлюцинирует tool-calls в Ollama: как заставить модель видеть реальность Паттерны ошибок, промпты и решения для мультимодальных галлюцинаций в Qwen3 VL. Практический гайд по отладке tool-calling в Ollama. 6 мин чтения 7084 Семантическая декомпозиция медицинских текстов на атомарные факты: архитектура фактор-центричной модели данных Как перейти от документо-центрической к фактор-центрической модели в медицинском AI. Извлечение биомаркеров, находок МРТ, витальных параметров. Архитектура и пр 6 мин чтения 7085 Converge Bio: зачем Bessemer и Meta вкладывают миллионы в AI-лекарства Инвестиции в Converge Bio показывают, как generative AI ускоряет поиск новых лекарств. Разбираем тренд AI в фармацевтике. 4 мин чтения 7086 EAFT в бою: тест на uncensor-задаче против обычного fine-tuning Практический эксперимент: сравниваем Entropy Adaptive Fine Tuning с обычным fine-tuning на задаче uncensor. Результаты, код, модели. 5 мин чтения 7087 Как обрабатывать длинные PDF-документы (130+ страниц) в Docling: стратегии чанкинга и оптимизации Практическое руководство по обработке PDF 130+ страниц в Docling. Автоматический чанкинг, настройка сегментации, оптимизация производительности RAG-пайплайнов. 6 мин чтения 7088 Tencent WeDLM-8B в chatllm.cpp: декодирование на грани и почему GPU иногда проигрывает Подробный обзор запуска модели WeDLM-8B в chatllm.cpp: настройка параметров block_size, accept_algo, сравнение производительности CPU и GPU. 5 мин чтения 7089 Gemma 3 1B Q4_0 GGUF: как правильно квантовать QAT-модель без imatrix Пошаговая инструкция по правильному квантованию Gemma 3 1B в формат GGUF без использования imatrix. Исправление метаданных и токенизатора. 4 мин чтения 7090 Epyc 9175F для CPU-инференса: реальные тесты против теории и M3 Max Практический тест Epyc 9175F для CPU-инференса Llama 3.1 70B. Сравнение с Apple M3 Max, анализ 600 Gbs памяти и оффлоадинга слоев. Реальные цифры против маркети 8 мин чтения 7091 Как выбрать LLM под 128 ГБ VRAM: сравнение моделей для обработки длинных техдокументов Сравнение Qwen3-32B, GPT-OSS:120B и других моделей для работы с длинным контекстом на 8×RTX 5070 Ti. Практический гайд по выбору LLM для технической документаци 8 мин чтения 7092 Будущее разработки ПО в 2026: как выжить junior-разработчику в эпоху AI-агентов Сценарии 2026 года для junior-разработчиков. Как изменится карьера в IT с приходом автономных AI-агентов. Стратегии выживания и роста. 5 мин чтения