Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4489 Архитектура мультиагентных систем для юридических задач: практический разбор на примере Ken1.0 и SimCourt Глубокий технический разбор архитектур мультиагентных систем для юридических задач. Сравнение SimCourt и практической реализации на Ken1.0. Решение проблемы гал 9 мин чтения 4490 Inheritune: режем жир из LLM — вырезаем вырожденные слои внимания и получаем меньшие, но сильные модели Полное руководство по Inheritune: как находить и удалять дегенеративные слои внимания в LLM для создания компактных моделей без потери качества. Код, примеры, о 9 мин чтения 4491 Claude Code: как внутренний инструмент для своих инженеров стал убийцей Copilot Невероятная история о том, как внутренний инструмент Anthropic для своих инженеров превратился в главного конкурента GitHub Copilot и изменил рынок AI-кодинга. 6 мин чтения 4492 OpenRA-RL: Однострочная установка и локальный полигон для AI-агентов в стратегиях Пошаговая установка OpenRA-RL на 21.02.2026. Запускайте AI-агентов в RTS без облаков. Полное руководство по локальному обучению с подкреплением. 6 мин чтения 4493 Vellium v0.3.5: Нативная интеграция KoboldCpp и режим для писателей — что изменилось на самом деле Полный разбор Vellium v0.3.5: нативная интеграция KoboldCpp для локальных LLM, новый писательский режим, импорт DOCX и интерфейс Zen Chat. Актуально на 21.02.20 7 мин чтения 4494 TokenShrink: Как сжать промпт в 1.4 раза без вызовов ИИ и сэкономить токены для локальных моделей Обзор TokenShrink — инструмента для сжатия промптов на 40% без вызовов ИИ. Экономия токенов для локальных моделей с ограниченным контекстом. Сравнение с аналога 4 мин чтения 4495 LLM как судья: сравнительный тест GPT-5.2, Claude 4.6 и Gemini 3.1 для анализа судебных решений Эксперимент: три топовые LLM анализируют арбитражные дела. Кто точнее предсказывает исход? Результаты теста на реальных данных. 8 мин чтения 4496 Как выбрать LLM для инженерных задач на Python: полный бенчмарк 100+ моделей по скорости и качеству Практическое сравнение 100+ LLM для инженерных задач на Python. Тестирование на RTX 4060 Ti и OpenRouter. Методология оценки, результаты, рекомендации. 8 мин чтения 4497 15 бесплатных AI-сервисов для генерации изображений в 2026: практический гид по выбору инструмента Полный гид по бесплатным AI-сервисам для генерации изображений в 2026 году. Сравнение, реальные примеры, критерии выбора и скрытые ограничения. 8 мин чтения 4498 Indus от Sarvam: индийский 105B-гигант на кнопочных телефонах бьет по OpenAI Индийский стартап Sarvam AI выпустил чат Indus на модели 105B с поддержкой 12 языков. Партнерство с Nokia и Bosch. Битва за локальные языки против OpenAI. 5 мин чтения 4499 NPC с характером: как строить локальных агентов с памятью, которая помнит даже оскорбления Полное руководство по созданию локальных NPC с долговременной памятью на Ollama, ChromaDB, системой релевантности и динамикой социальных связей. 9 мин чтения 4500 Qwen3 Coder Next: почему агрессивное квантование (Q2) не убивает его качество и как он обходит 30B модели Почему Qwen3 Coder Next сохраняет качество при Q2 квантовании и обходит большие модели. Тесты, примеры и рекомендации на 21.02.2026. 6 мин чтения