Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6793 Хакатон по CV: как решить задачу бинарной сегментации для детекции загрязнений камеры Разбор реального хакатонного кейса: бинарная сегментация для детекции загрязнений камеры. YOLO, валидация, промышленный CV. 7 мин чтения 6794 Mamba vs Transformer: Почему ваша RTX 3090 плачет от квадратичной сложности Полный разбор State Space Models: как Mamba обходит квадратичную сложность Transformer, работает с 1M токенов и ускоряет инференс в 5 раз. Практика для локально 5 мин чтения 6795 Миф о бесконечном масштабировании ИИ: когда законы масштабирования перестанут работать Анализ фундаментальных ограничений масштабирования больших языковых моделей. Физические, экономические и математические барьеры, которые остановят экспоненциаль 6 мин чтения 6796 AlphaEarth Foundations: как новый ИИ от DeepMind создаёт детальные карты Земли из спутниковых данных Обзор AlphaEarth Foundations - ИИ от DeepMind для создания эмбеддингов Земли из спутниковых данных. Сравнение с Google Earth Engine, примеры использования для э 5 мин чтения 6797 Personal-Guru: полный гайд по установке и использованию локального AI-репетитора на Ollama Пошаговый гайд по установке Personal-Guru — локального AI-репетитора для структурированного обучения. Работает оффлайн через Ollama, альтернатива NotebookLM. 6 мин чтения 6798 Дипфейки становятся оружием: Сенат США требует действий, а платформы просыпаются Сексуализированные AI-дипфейки, скандал с Grok и жёсткое письмо сенаторов США к платформам. Как регулируют ИИ и почему guardrails не работают. 4 мин чтения 6799 Почему квантованные модели почти одинакового размера? Разбор форматов GGUF и квантования Подробный разбор, почему квантованные модели имеют схожий размер. Форматы GGUF, битность, метаданные и реальные цифры. Практический гайд по выбору квантования. 7 мин чтения 6800 Выбор и настройка open-source OCR моделей: полное руководство по современным пайплайнам Подробное руководство по выбору, настройке и fine-tuning open-source OCR моделей. Сравнение Chandra, OlmOCR-2, практические пайплайны для production. 7 мин чтения 6801 Дистилляция в Mamba: как ServiceNow ускорила модель в 2.1 раза, игнорируя интуицию о данных Глубокий разбор кейса ServiceNow: как дистилляция в Mamba с нарушением интуиции о данных дала ускорение throughput в 2.1 раза. Практический гайд по ретропиттинг 7 мин чтения 6802 Параметры в LLM: почему 175 миллиардов — это не просто цифра Объясняем параметры нейросетей на простых примерах: как 175 миллиардов весов в GPT-3 превращают текст в понимание. Архитектура трансформера, обучение модели и р 8 мин чтения 6803 Механистическая интерпретируемость: как Anthropic и OpenAI заглядывают внутрь ИИ-моделей, как в микроскоп Глубокий разбор механистической интерпретируемости — как Anthropic, OpenAI и DeepMind изучают внутреннюю работу LLM. Методы, инструменты и почему это меняет всё 7 мин чтения 6804 Gemma 3 270M: обзор, бенчмарки и как запустить локально на слабом железе Обзор, тесты производительности и инструкция по установке Gemma 3 270M — самой компактной модели Google для локального запуска на любом железе. 5 мин чтения