Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2785
Generative Engine Optimization (GEO): как попасть в рекомендации ChatGPT и Perplexity для B2B SaaS
Полное руководство по оптимизации B2B SaaS под генеративный поиск. Стратегии, шаги и ошибки, чтобы ваш продукт рекомендовали ChatGPT-5 и Perplexity.
2786
Gemma 4 против Qwen 3.5: кто быстрее и умнее на Mac Studio?
Прямое сравнение производительности Gemma 4 и Qwen 3.5 на Mac Studio M3 Ultra. Цифры скорости, анализ качества ответов и практические выводы для локального запу
2787
Latent Reasoning Engine: Mamba-модель 2.8B для скрытого мышления без KV-cache на RTX 3060
Обзор Latent Reasoning Engine - Mamba-модели 2.8B для скрытого мышления на RTX 3060. Экономия памяти O(1), сравнение с альтернативами и примеры использования.
2788
AMD R9700 с 96 ГБ VRAM: локальный инференс больших моделей больше не проблема?
Как новая видеокарта AMD R9700 с 96 ГБ VRAM меняет правила игры для локального запуска больших языковых моделей. Технический анализ и перспективы.
2789
Orthogonalized Representation Intervention для Gemma 4 31B: как использовать модифицированные квантования в GGUF
Пошаговый гайд по применению Orthogonalized Representation Intervention к квантованным версиям Gemma 4 31B в формате GGUF. Модифицируйте Q4_K_M, Q8_0 модели для
2790
Jarvis Pattern: архитектура персонального AI-агента без фреймворков, оркестраторов и векторных баз
Практический гайд по созданию персонального AI-агента без сложных фреймворков. Узнайте, как работает Jarvis Pattern, пошаговая реализация и распространенные оши
2791
Как запустить 1-битные модели Bonsai на CPU и AMD GPU: фиксы в llama.cpp и инструкции по ROCm
Подробное руководство по запуску 1-битных моделей Bonsai через исправленный форк llama.cpp. Инструкции для CPU с AVX512 и AMD GPU через ROCm на 02.04.2026.
2792
Incognito-режим Perplexity оказался пустышкой: чаты и PID плывут к Google и Meta
Громкий иск раскрывает утечку данных из чатов Perplexity к Google и Meta. Инкогнито-режим - фикция. Анализ скандала и что делать пользователям.
2793
Сверхмалые эмбеддинги: семейство моделей от 700KB, которые не стыдно использовать
Полный обзор семейства статических эмбеддинг-моделей от 700KB до 125MB. Сравнение производительности на MTEB, интеграция с sentence-transformers и сценарии испо
2794
Как настроить ИИ-парсер для чтения старых ГОСТов: полный кейс с PDF, промптами и экономией 95% времени
Пошаговый гайд по настройке ИИ-парсера для чтения старых ГОСТов из PDF. Работа с сканами, промпты, извлечение таблиц. Экономия с 2 часов до 5 минут.
2795
Реализация памяти для LLM-чата на Python: от простого history до ограничения контекста
Пошаговый гайд по реализации памяти для диалога с LLM на Python. Код для истории сообщений, подсчета токенов и ограничения длины контекста.
2796
Партизанский MLOps: как запустить Gemma 4 31B на бесплатном Kaggle с лимитом диска
Пошаговый гайд с хаками: как запустить 31B модель Gemma 4 на бесплатном Kaggle GPU с лимитом диска. Квантование на лету, bitsandbytes NF4, удаление кэша.