Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6685 Agent Zero на 84 ГБ VRAM: как заставить агента не врать и не тормозить Детальный гайд по настройке Agent Zero на мощном железе. Распределение моделей между Ollama и llama.cpp, выбор квантований, борьба с галлюцинациями LLM. 7 мин чтения 6686 Таксономия дрейфа LLM: как отличить контекстную вариацию от реального изменения поведения модели Практическое руководство по диагностике дрейфа LLM. Учимся отличать контекстные вариации от системных изменений модели с помощью новой таксономии. 8 мин чтения 6687 Пузырь AI-инфраструктуры: три сценария для бизнеса и no-regret moves на случай коллапса Анализ перегрева рынка AI-инфраструктуры. Три сценария развития событий и конкретные no-regret moves для компаний на случай коллапса. 7 мин чтения 6688 RAG-чатбот для корпоративных знаний: как оживить архивы и инструкции с помощью ИИ Пошаговое руководство по созданию RAG-чатбота для корпоративных знаний. Извлечение данных из архивов, выбор моделей, развертывание. 9 мин чтения 6689 WallPlan: как нейросети генерируют планировки через графы стен, а не пиксели Технический разбор WallPlan - нейросети, которая генерирует архитектурные планировки через графы стен, а не пиксели. Три CNN: WinNet, GraphNet, LabelNet. 5 мин чтения 6690 RLM: как заставить LLM управлять своим контекстом, пока он не сгнил Полное руководство по RLM, context folding и scaffolding. Как обучать LLM управлять длинным контекстом и бороться с деградацией качества. 7 мин чтения 6691 Как методисту создать обучающий курс за месяц с помощью ИИ: пошаговый гайд от практика Узнайте, как использовать ИИ для создания обучающих курсов за 30 дней. Конкретные шаги, инструменты, промпты и личный опыт. 7 мин чтения 6692 Сборка мощной рабочей станции для локальных LLM: личный опыт с 3x3090 и 3060 в mid-tower корпусе Подробный гайд по сборке рабочей станции для локальных LLM с 4 видеокартами (3x RTX 3090 + RTX 3060) в mid-tower корпусе. Решения по охлаждению, питанию 1500W и 8 мин чтения 6693 Мифы и реальность ИИ-революции: почему увольнения из-за ИИ — это хайп, а не практика Почему заявления об увольнениях из-за ИИ — это пиар, а не реальность. Разбор мифа на примере провала гуманоидных роботов и критики CEO Salesforce. 4 мин чтения 6694 VibeVoice-Realtime-0.5B на Orange Pi: дикий гуайд по квантованию, которого нет в интернете Полное руководство по поиску и квантованию VibeVoice-Realtime-0.5B Stream для Orange Pi и одноплатников. GGUF, ONNX, оптимизация памяти. 8 мин чтения 6695 Iris Agent: фреймворк, где вы видите каждую шестерёнку Обзор минималистичного Iris Agent - open-source фреймворка для создания и обучения AI-агентов с полной прозрачностью архитектуры. 5 мин чтения 6696 FLUX.2 Klein на стероидах: заставляем 9B-модель летать быстрее мысли на A100 Готовые скрипты Gradio и FastAPI для FLUX.2 Klein с оптимизациями torch.compile и fused QKV. Запуск за 0.9 секунды на A100. 5 мин чтения