Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4489
Архитектура мультиагентных систем для юридических задач: практический разбор на примере Ken1.0 и SimCourt
Глубокий технический разбор архитектур мультиагентных систем для юридических задач. Сравнение SimCourt и практической реализации на Ken1.0. Решение проблемы гал
4490
Inheritune: режем жир из LLM — вырезаем вырожденные слои внимания и получаем меньшие, но сильные модели
Полное руководство по Inheritune: как находить и удалять дегенеративные слои внимания в LLM для создания компактных моделей без потери качества. Код, примеры, о
4491
Claude Code: как внутренний инструмент для своих инженеров стал убийцей Copilot
Невероятная история о том, как внутренний инструмент Anthropic для своих инженеров превратился в главного конкурента GitHub Copilot и изменил рынок AI-кодинга.
4492
OpenRA-RL: Однострочная установка и локальный полигон для AI-агентов в стратегиях
Пошаговая установка OpenRA-RL на 21.02.2026. Запускайте AI-агентов в RTS без облаков. Полное руководство по локальному обучению с подкреплением.
4493
Vellium v0.3.5: Нативная интеграция KoboldCpp и режим для писателей — что изменилось на самом деле
Полный разбор Vellium v0.3.5: нативная интеграция KoboldCpp для локальных LLM, новый писательский режим, импорт DOCX и интерфейс Zen Chat. Актуально на 21.02.20
4494
TokenShrink: Как сжать промпт в 1.4 раза без вызовов ИИ и сэкономить токены для локальных моделей
Обзор TokenShrink — инструмента для сжатия промптов на 40% без вызовов ИИ. Экономия токенов для локальных моделей с ограниченным контекстом. Сравнение с аналога
4495
LLM как судья: сравнительный тест GPT-5.2, Claude 4.6 и Gemini 3.1 для анализа судебных решений
Эксперимент: три топовые LLM анализируют арбитражные дела. Кто точнее предсказывает исход? Результаты теста на реальных данных.
4496
Как выбрать LLM для инженерных задач на Python: полный бенчмарк 100+ моделей по скорости и качеству
Практическое сравнение 100+ LLM для инженерных задач на Python. Тестирование на RTX 4060 Ti и OpenRouter. Методология оценки, результаты, рекомендации.
4497
15 бесплатных AI-сервисов для генерации изображений в 2026: практический гид по выбору инструмента
Полный гид по бесплатным AI-сервисам для генерации изображений в 2026 году. Сравнение, реальные примеры, критерии выбора и скрытые ограничения.
4498
Indus от Sarvam: индийский 105B-гигант на кнопочных телефонах бьет по OpenAI
Индийский стартап Sarvam AI выпустил чат Indus на модели 105B с поддержкой 12 языков. Партнерство с Nokia и Bosch. Битва за локальные языки против OpenAI.
4499
NPC с характером: как строить локальных агентов с памятью, которая помнит даже оскорбления
Полное руководство по созданию локальных NPC с долговременной памятью на Ollama, ChromaDB, системой релевантности и динамикой социальных связей.
4500
Qwen3 Coder Next: почему агрессивное квантование (Q2) не убивает его качество и как он обходит 30B модели
Почему Qwen3 Coder Next сохраняет качество при Q2 квантовании и обходит большие модели. Тесты, примеры и рекомендации на 21.02.2026.