Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
1489
Локальный запуск LLM: как стать «quasi-local summoner» — пошаговое руководство сообщества LocalLLaMA
Полное руководство по запуску больших языковых моделей на арендованных GPU с полным локальным контролем. Команды, конфиги, сравнение с альтернативами.
1490
Лучшие модели до 150GB для общего знания: сравнение Qwen3.5-397B и альтернатив
Сравнение квантованных LLM в лимите 150GB: Qwen3.5-397B Q4, Llama 3.1 405B Q4, Mistral Large 2, Mixtral 8x22B и другие. Тесты, рекомендации, pitfalls.
1491
Борьба с анизотропией эмбеддингов: как центрирование улучшает косинусное сходство на практике
Проблема анизотропии эмбеддингов: почему косинусное сходство врет? Практическое решение — центрирование векторов. Пример из Obsidian-базы, код Python и метрики.
1492
Equinox-31B: создатели AI Dungeon выпустили открытую модель на базе Gemma 3
Equinox-31B — новый финтюн Gemma 3 от создателей AI Dungeon. Разбираем, чем эта модель отличается от других, кому подойдет для локальных экспериментов и сценарн
1493
Gorgon Halo против Strix Halo: почему ваш следующий LLM-чип от AMD прожжет дыру в бюджете
Сравнение Gorgon Halo и Strix Halo для AI-нагрузок: разбор производительности LLM, пропускной способности памяти и сценариев использования. Стоит ли переплачива
1494
Когда 128K токенов — это смешно: Обработка документов-гигантов через Bedrock AgentCore и Recursive Language Models
Пошаговый гайд: преодолеваем ограничение контекстного окна с помощью Recursive Language Models, Amazon Bedrock AgentCore и Code Interpreter. Обработка 500+ стра
1495
Spring AI: универсальный адаптер между Java и LLM — возможности, настройка и интеграция
Полный обзор Spring AI — инструмента для интеграции LLM в Java-приложения. Сравнение с альтернативами, примеры настройки, код, рекомендации. Актуально на 2026 г
1496
Как нейросеть выявляет подмену почерка на экзаменах без эталона: технический разбор на Python
Технический гайд по созданию пайплайна на Python для выявления подмены почерка в экзаменационных работах без эталонного образца. Сиамская нейросеть, сегментация
1497
3 навыка Claude для Data Scientist в 2026: как создавать AI-дашборды и автоматизировать анализ
Научитесь создавать AI-дашборды с Claude 4 Opus, автоматизировать анализ данных и настраивать агентные пайплайны. Реальные промпты, ошибки и чек-лист.
1498
Spotify запускает AI-функции для подкастов: персональные подкасты, Q&A и ежедневные брифы с интеграцией календаря
Spotify запустил десктопное приложение Studio для генерации персональных подкастов, Q&A по документам и аудиобрифов, привязанных к календарю. Аналог NotebookLM
1499
Голос без разрешения: почему маори строят свой TTS, а Big Tech остается за бортом
Как коренной народ Новой Зеландии отказался от ElevenLabs и OpenAI, чтобы сохранить контроль над te reo Māori. Уроки для разработчиков редких языков.
1500
Agent Execution Tax: новый налог, который платят браузерные AI-агенты (и вы заодно)
Новая метрика Agent Execution Tax показывает, сколько времени AI-агент тратит на собственный код, а не на задачу. Разбираем, как это меняет бенчмаркинг агентов.