Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

7801 Paligemma2 молчит на локальной машине: почему модель видит объекты, но не показывает bounding boxes Разбор ошибок при локальном запуске Paligemma2: пустые координаты, проблемы с библиотеками, рабочий скрипт для object detection на Python. 8 мин чтения 7802 Как готовить динамические GGUF-квантования в браузере: обзор GGUF Tool Suite Web UI Обзор GGUF Tool Suite Web UI — инструмента для создания динамических GGUF-квантований прямо в браузере. Настройка под ваше железо без CLI. 4 мин чтения 7803 Заурядный RAG уже не работает: собираем поисковик, который обновляется сам Пошаговое руководство по созданию локального семантического поиска с автоматическим отслеживанием изменений файлов. Python, Qdrant, MCP сервер. 10 мин чтения 7804 Когда LLM врёт о документах: строим логический детектор вместо очередного промпта Архитектура логического движка на Python для детектирования противоречий между документами. Системный промпт, таймстампы, Ollama, RAG. Убираем галлюцинации. 7 мин чтения 7805 Ян Лекун разоблачил Meta: как накручивали бенчмарки Llama 4 и что будет дальше Ян Лекун раскрыл манипуляции с тестами Llama 4. Как это повлияло на Meta AI, уход сотрудников и будущее open-source моделей. 4 мин чтения 7806 Тихий монстр: собираем AI-станцию на RTX 5090 и Ryzen 9 7950X3D для локального инференса Полный гайд по сборке тихой AI-рабочей станции на RTX 5090 и Ryzen 9 7950X3D: компоненты, настройка, ПО для локального инференса LLM. Практические советы от Sen 10 мин чтения 7807 AMD Strix Halo и агентные AI: как выжать 128GB оперативки до последнего токена Полное руководство по настройке агентных AI-воркфлоу на AMD Ryzen Strix Halo с 128GB RAM: выбор моделей, квантование, оптимизация llama.cpp для максимальной ско 9 мин чтения 7808 Как mHC от DeepSeek ломает 10-летнюю догму residual connections: разбор прорывной архитектуры Технический разбор mHC от DeepSeek - архитектуры, которая бросает вызов 10-летней догме residual connections через Double Stochastic матрицы и гипер-связи. 9 мин чтения 7809 Кризис железа для локального AI: почему Supermicro прекращает продажи материнских плат и как это ударит по хомякам Supermicro прекращает продажи материнских плат Epyc Milan. Как это ударит по сборкам для локальных LLM и где искать альтернативы. 7 мин чтения 7810 Обзор и тестирование Basis Router: как студенческий проект упрощает подключение баз данных к облачным и локальным LLM Тестируем Basis Router - open-source инструмент для подключения баз данных к LLM. Установка, настройка, сравнение с аналогами. 5 мин чтения 7811 Гайд: Как собрать бюджетный сервер для LLM на 96GB VRAM из китайских GPU (Шэньчжэнь) Пошаговый гайд по сборке сервера для LLM на 96GB VRAM с китайскими модифицированными GPU RTX 3080 20GB. Спецификации, переговоры с поставщиками, настройка желез 9 мин чтения 7812 Офлайн-помощники на Gemma 3n: как победители Kaggle обошли облачные сервисы Технический разбор проектов-победителей Kaggle Challenge: как разработчики используют Gemma 3n, MediaPipe и flutter_gemma для создания офлайн-ассистентов. 8 мин чтения