Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2785 Generative Engine Optimization (GEO): как попасть в рекомендации ChatGPT и Perplexity для B2B SaaS Полное руководство по оптимизации B2B SaaS под генеративный поиск. Стратегии, шаги и ошибки, чтобы ваш продукт рекомендовали ChatGPT-5 и Perplexity. 7 мин чтения 2786 Gemma 4 против Qwen 3.5: кто быстрее и умнее на Mac Studio? Прямое сравнение производительности Gemma 4 и Qwen 3.5 на Mac Studio M3 Ultra. Цифры скорости, анализ качества ответов и практические выводы для локального запу 4 мин чтения 2787 Latent Reasoning Engine: Mamba-модель 2.8B для скрытого мышления без KV-cache на RTX 3060 Обзор Latent Reasoning Engine - Mamba-модели 2.8B для скрытого мышления на RTX 3060. Экономия памяти O(1), сравнение с альтернативами и примеры использования. 5 мин чтения 2788 AMD R9700 с 96 ГБ VRAM: локальный инференс больших моделей больше не проблема? Как новая видеокарта AMD R9700 с 96 ГБ VRAM меняет правила игры для локального запуска больших языковых моделей. Технический анализ и перспективы. 5 мин чтения 2789 Orthogonalized Representation Intervention для Gemma 4 31B: как использовать модифицированные квантования в GGUF Пошаговый гайд по применению Orthogonalized Representation Intervention к квантованным версиям Gemma 4 31B в формате GGUF. Модифицируйте Q4_K_M, Q8_0 модели для 5 мин чтения 2790 Jarvis Pattern: архитектура персонального AI-агента без фреймворков, оркестраторов и векторных баз Практический гайд по созданию персонального AI-агента без сложных фреймворков. Узнайте, как работает Jarvis Pattern, пошаговая реализация и распространенные оши 9 мин чтения 2791 Как запустить 1-битные модели Bonsai на CPU и AMD GPU: фиксы в llama.cpp и инструкции по ROCm Подробное руководство по запуску 1-битных моделей Bonsai через исправленный форк llama.cpp. Инструкции для CPU с AVX512 и AMD GPU через ROCm на 02.04.2026. 6 мин чтения 2792 Incognito-режим Perplexity оказался пустышкой: чаты и PID плывут к Google и Meta Громкий иск раскрывает утечку данных из чатов Perplexity к Google и Meta. Инкогнито-режим - фикция. Анализ скандала и что делать пользователям. 4 мин чтения 2793 Сверхмалые эмбеддинги: семейство моделей от 700KB, которые не стыдно использовать Полный обзор семейства статических эмбеддинг-моделей от 700KB до 125MB. Сравнение производительности на MTEB, интеграция с sentence-transformers и сценарии испо 6 мин чтения 2794 Как настроить ИИ-парсер для чтения старых ГОСТов: полный кейс с PDF, промптами и экономией 95% времени Пошаговый гайд по настройке ИИ-парсера для чтения старых ГОСТов из PDF. Работа с сканами, промпты, извлечение таблиц. Экономия с 2 часов до 5 минут. 7 мин чтения 2795 Реализация памяти для LLM-чата на Python: от простого history до ограничения контекста Пошаговый гайд по реализации памяти для диалога с LLM на Python. Код для истории сообщений, подсчета токенов и ограничения длины контекста. 9 мин чтения 2796 Партизанский MLOps: как запустить Gemma 4 31B на бесплатном Kaggle с лимитом диска Пошаговый гайд с хаками: как запустить 31B модель Gemma 4 на бесплатном Kaggle GPU с лимитом диска. Квантование на лету, bitsandbytes NF4, удаление кэша. 7 мин чтения