Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6829 Инженерный расчёт на автопилоте: как Grok 4.1 Thinking и Aristotle заменяют коллегу с красной ручкой Пошаговый гайд по использованию Grok 4.1 Thinking и Aristotle для экспертной проверки инженерных расчётов, научных гипотез и рецензирования статей. Реальные про 10 мин чтения 6830 LLM Structured Outputs: Когда JSON — это не опция, а требование Полное руководство по получению структурированных данных из LLM: JSON Schema, Pydantic, Outlines, ограниченная генерация и парсинг. Методы для production. 9 мин чтения 6831 CPU-инференс Mistral-7B: как калибровка на этапе вывода ускоряет работу на 40% Практический гайд: как калибровка на этапе вывода в llama.cpp ускоряет CPU-инференс Mistral-7B на 40% и снижает потребление RAM на 6%. Тесты на Ryzen 5 5600G. 7 мин чтения 6832 «Модель на конец света»: обзор самых умных LLM, которые влезут в 24 ГБ VRAM Какие самые умные модели ИИ запустить на 24 ГБ видеопамяти? Обзор Qwen, Llama, DeepSeek и квантование для офлайн-работы. 7 мин чтения 6833 Оптимизация GPT-OSS 120B на Strix Halo 128 ГБ: сборник советов по драйверам, маппингу памяти и настройке Ubuntu Полный гайд по запуску GPT-OSS 120B на AMD Strix Halo с 128 ГБ ОЗУ. Настройка драйверов ROCm, маппинг памяти, оптимизация Ubuntu 24.04. 7 мин чтения 6834 Как запустить контекст >128k на 2x RTX 3090: сравнение методов (vLLM, EGPU, RPC, ik_llama) Полный гайд по запуску длинного контекста на двух RTX 3090. Сравнение методов vLLM, EGPU, RPC и ik_llama с инструкциями и бенчмарками. 9 мин чтения 6835 DOM-пранинг: как заставить браузерного агента видеть структуру, а не пиксели Замена скриншотов на структурированные DOM-снимки для локальных агентов. Практический гайд с кодом для Qwen 2.5 3B. 8 мин чтения 6836 Фреймворки для оркестрации AI-агентов: какой выбрать и почему все они раздражают Полный обзор и сравнение фреймворков для оркестрации AI-агентов. LangGraph vs CrewAI vs AutoGen: что выбрать для production в 2025 году. 7 мин чтения 6837 Pathway + Ollama + Llama 2.5: локальный детектор логических дыр в текстах на 100 тысяч слов Гайд по сборке полностью локальной системы для анализа консистентности в длинных документах с помощью Pathway, Ollama и Llama 2.5 7B. 6 мин чтения 6838 Discord-бот с мозгами на Raspberry Pi: как запустить LLM на 4 ГБ RAM и не сойти с ума Подробный гайд по выбору моделей и квантований для Discord-бота с локальной LLM. Ollama, TinyLlama, Phi-2 на слабом железе. Готовый код на Node.js. 9 мин чтения 6839 Jailbreak SAFi агента: анализ уязвимостей и техник prompt injection на реальном кейсе Разбор реального jailbreak-челленджа SAFi агента. Анализ уязвимостей, техник prompt injection и answer-in-refusal leak. Как защитить ИИ-агентов. 5 мин чтения 6840 OpenAgent: контрольная панель для локальных AI-агентов, которая наконец-то изолирует их друг от друга Обзор OpenAgent — open-source control plane для оркестрации локальных AI-агентов с изоляцией через systemd-nspawn и Git для конфигов. 4 мин чтения