Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
7801
Paligemma2 молчит на локальной машине: почему модель видит объекты, но не показывает bounding boxes
Разбор ошибок при локальном запуске Paligemma2: пустые координаты, проблемы с библиотеками, рабочий скрипт для object detection на Python.
7802
Как готовить динамические GGUF-квантования в браузере: обзор GGUF Tool Suite Web UI
Обзор GGUF Tool Suite Web UI — инструмента для создания динамических GGUF-квантований прямо в браузере. Настройка под ваше железо без CLI.
7803
Заурядный RAG уже не работает: собираем поисковик, который обновляется сам
Пошаговое руководство по созданию локального семантического поиска с автоматическим отслеживанием изменений файлов. Python, Qdrant, MCP сервер.
7804
Когда LLM врёт о документах: строим логический детектор вместо очередного промпта
Архитектура логического движка на Python для детектирования противоречий между документами. Системный промпт, таймстампы, Ollama, RAG. Убираем галлюцинации.
7805
Ян Лекун разоблачил Meta: как накручивали бенчмарки Llama 4 и что будет дальше
Ян Лекун раскрыл манипуляции с тестами Llama 4. Как это повлияло на Meta AI, уход сотрудников и будущее open-source моделей.
7806
Тихий монстр: собираем AI-станцию на RTX 5090 и Ryzen 9 7950X3D для локального инференса
Полный гайд по сборке тихой AI-рабочей станции на RTX 5090 и Ryzen 9 7950X3D: компоненты, настройка, ПО для локального инференса LLM. Практические советы от Sen
7807
AMD Strix Halo и агентные AI: как выжать 128GB оперативки до последнего токена
Полное руководство по настройке агентных AI-воркфлоу на AMD Ryzen Strix Halo с 128GB RAM: выбор моделей, квантование, оптимизация llama.cpp для максимальной ско
7808
Как mHC от DeepSeek ломает 10-летнюю догму residual connections: разбор прорывной архитектуры
Технический разбор mHC от DeepSeek - архитектуры, которая бросает вызов 10-летней догме residual connections через Double Stochastic матрицы и гипер-связи.
7809
Кризис железа для локального AI: почему Supermicro прекращает продажи материнских плат и как это ударит по хомякам
Supermicro прекращает продажи материнских плат Epyc Milan. Как это ударит по сборкам для локальных LLM и где искать альтернативы.
7810
Обзор и тестирование Basis Router: как студенческий проект упрощает подключение баз данных к облачным и локальным LLM
Тестируем Basis Router - open-source инструмент для подключения баз данных к LLM. Установка, настройка, сравнение с аналогами.
7811
Гайд: Как собрать бюджетный сервер для LLM на 96GB VRAM из китайских GPU (Шэньчжэнь)
Пошаговый гайд по сборке сервера для LLM на 96GB VRAM с китайскими модифицированными GPU RTX 3080 20GB. Спецификации, переговоры с поставщиками, настройка желез
7812
Офлайн-помощники на Gemma 3n: как победители Kaggle обошли облачные сервисы
Технический разбор проектов-победителей Kaggle Challenge: как разработчики используют Gemma 3n, MediaPipe и flutter_gemma для создания офлайн-ассистентов.