Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6829
Инженерный расчёт на автопилоте: как Grok 4.1 Thinking и Aristotle заменяют коллегу с красной ручкой
Пошаговый гайд по использованию Grok 4.1 Thinking и Aristotle для экспертной проверки инженерных расчётов, научных гипотез и рецензирования статей. Реальные про
6830
LLM Structured Outputs: Когда JSON — это не опция, а требование
Полное руководство по получению структурированных данных из LLM: JSON Schema, Pydantic, Outlines, ограниченная генерация и парсинг. Методы для production.
6831
CPU-инференс Mistral-7B: как калибровка на этапе вывода ускоряет работу на 40%
Практический гайд: как калибровка на этапе вывода в llama.cpp ускоряет CPU-инференс Mistral-7B на 40% и снижает потребление RAM на 6%. Тесты на Ryzen 5 5600G.
6832
«Модель на конец света»: обзор самых умных LLM, которые влезут в 24 ГБ VRAM
Какие самые умные модели ИИ запустить на 24 ГБ видеопамяти? Обзор Qwen, Llama, DeepSeek и квантование для офлайн-работы.
6833
Оптимизация GPT-OSS 120B на Strix Halo 128 ГБ: сборник советов по драйверам, маппингу памяти и настройке Ubuntu
Полный гайд по запуску GPT-OSS 120B на AMD Strix Halo с 128 ГБ ОЗУ. Настройка драйверов ROCm, маппинг памяти, оптимизация Ubuntu 24.04.
6834
Как запустить контекст >128k на 2x RTX 3090: сравнение методов (vLLM, EGPU, RPC, ik_llama)
Полный гайд по запуску длинного контекста на двух RTX 3090. Сравнение методов vLLM, EGPU, RPC и ik_llama с инструкциями и бенчмарками.
6835
DOM-пранинг: как заставить браузерного агента видеть структуру, а не пиксели
Замена скриншотов на структурированные DOM-снимки для локальных агентов. Практический гайд с кодом для Qwen 2.5 3B.
6836
Фреймворки для оркестрации AI-агентов: какой выбрать и почему все они раздражают
Полный обзор и сравнение фреймворков для оркестрации AI-агентов. LangGraph vs CrewAI vs AutoGen: что выбрать для production в 2025 году.
6837
Pathway + Ollama + Llama 2.5: локальный детектор логических дыр в текстах на 100 тысяч слов
Гайд по сборке полностью локальной системы для анализа консистентности в длинных документах с помощью Pathway, Ollama и Llama 2.5 7B.
6838
Discord-бот с мозгами на Raspberry Pi: как запустить LLM на 4 ГБ RAM и не сойти с ума
Подробный гайд по выбору моделей и квантований для Discord-бота с локальной LLM. Ollama, TinyLlama, Phi-2 на слабом железе. Готовый код на Node.js.
6839
Jailbreak SAFi агента: анализ уязвимостей и техник prompt injection на реальном кейсе
Разбор реального jailbreak-челленджа SAFi агента. Анализ уязвимостей, техник prompt injection и answer-in-refusal leak. Как защитить ИИ-агентов.
6840
OpenAgent: контрольная панель для локальных AI-агентов, которая наконец-то изолирует их друг от друга
Обзор OpenAgent — open-source control plane для оркестрации локальных AI-агентов с изоляцией через systemd-nspawn и Git для конфигов.