Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6961 YaGUFF: когда конвертация GGUF перестала быть головной болью Обзор YaGUFF - графического конвертера GGUF для llama.cpp. Сравнение с аналогами, простая установка и примеры использования для локальных LLM. 4 мин чтения 6962 Parloa: как стартап в сфере AI-агентов для поддержки клиентов за 8 месяцев утроил оценку до $3 млрд Стартап Parloa утроил оценку до $3 млрд за 8 месяцев. $350 млн раунд от General Catalyst. AI-агенты против Sierra и Decagon. Рынок автоматизации customer servic 6 мин чтения 6963 Январь 2026: ИИ-индустрия начинает год с медицинского ИИ, кооперации и дефицита памяти Обзор главных событий в ИИ за январь 2026: запуск ChatGPT Health, новый инструмент Cowork от Anthropic, кризис цен на память и свежие AI-инструменты. 4 мин чтения 6964 Кейс Webest: как внедрить ИИ в IT-компанию без увольнений и создать своего AI-агента для управления проектами Практический кейс: как внедрить ИИ в IT-компанию без увольнений. Создание AI-агента для управления проектами на примере Webest. Инструменты, этапы, ошибки. 6 мин чтения 6965 Spec-Driven Development: как писать промпты для AI-кодогенерации, чтобы избежать огромных MR Методология Spec-Driven Development для контроля AI-агентов. Как писать промпты для Claude Code, Ollama, чтобы избежать огромных merge requests и технического д 8 мин чтения 6966 GPT Researcher vs Deer Flow vs DeepResearch: какой локальный пайплайн выбрать для глубоких изысканий Подробное сравнение трех инструментов для локального deep research: настройка, производительность, кастомизация. Какой выбрать для автономных исследований без о 8 мин чтения 6967 PCIe 4 vs PCIe 5 для LLM: реальный тест скорости в multi-GPU сборках и влияние на pp/tg Практическое сравнение PCIe 4 и PCIe 5 в multi-GPU сборках для LLM. Реальные тесты скорости prefill и token generation на 6x Arc Pro B60. 9 мин чтения 6968 Как заставить локальную LLM писать длинные ответы: настройка max_tokens, параметры генерации и обход early stopping Подробный гайд по настройке параметров генерации (max_tokens, temperature) для получения длинных ответов от локальных LLM в LM Studio и других интерфейсах. 9 мин чтения 6969 V6rge: обзор и установка единого десктопного приложения для Flux, MusicGen и локального агента Обзор V6rge — десктопного приложения, которое объединяет Flux для генерации изображений, MusicGen для создания музыки и локального агента для управления ПК. 4 мин чтения 6970 Технический долг в AI-разработке: как избежать проблем при переходе от прототипа к продакшену Как избежать технического долга в AI-разработке. Пошаговый план от прототипа к продакшену с мониторингом дрейфа и безопасностью. 8 мин чтения 6971 Как создать приложение за 12 часов с помощью локальных LLM: кейс MindMapp и сравнение моделей Практическое руководство по агентному кодированию с локальными LLM. Сравнение моделей Devstrall Small 2, Seed OSS, GLM-4.5-Air. Создайте приложение без облачных 8 мин чтения 6972 FrogMini от Microsoft: как использовать SOTA-модель для исправления багов на основе Qwen3-14B Обзор FrogMini-14B от Microsoft: как использовать модель на базе Qwen3 для автоматической отладки. Сравнение, примеры использования и инструкция по запуску. 6 мин чтения