Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6793
Хакатон по CV: как решить задачу бинарной сегментации для детекции загрязнений камеры
Разбор реального хакатонного кейса: бинарная сегментация для детекции загрязнений камеры. YOLO, валидация, промышленный CV.
6794
Mamba vs Transformer: Почему ваша RTX 3090 плачет от квадратичной сложности
Полный разбор State Space Models: как Mamba обходит квадратичную сложность Transformer, работает с 1M токенов и ускоряет инференс в 5 раз. Практика для локально
6795
Миф о бесконечном масштабировании ИИ: когда законы масштабирования перестанут работать
Анализ фундаментальных ограничений масштабирования больших языковых моделей. Физические, экономические и математические барьеры, которые остановят экспоненциаль
6796
AlphaEarth Foundations: как новый ИИ от DeepMind создаёт детальные карты Земли из спутниковых данных
Обзор AlphaEarth Foundations - ИИ от DeepMind для создания эмбеддингов Земли из спутниковых данных. Сравнение с Google Earth Engine, примеры использования для э
6797
Personal-Guru: полный гайд по установке и использованию локального AI-репетитора на Ollama
Пошаговый гайд по установке Personal-Guru — локального AI-репетитора для структурированного обучения. Работает оффлайн через Ollama, альтернатива NotebookLM.
6798
Дипфейки становятся оружием: Сенат США требует действий, а платформы просыпаются
Сексуализированные AI-дипфейки, скандал с Grok и жёсткое письмо сенаторов США к платформам. Как регулируют ИИ и почему guardrails не работают.
6799
Почему квантованные модели почти одинакового размера? Разбор форматов GGUF и квантования
Подробный разбор, почему квантованные модели имеют схожий размер. Форматы GGUF, битность, метаданные и реальные цифры. Практический гайд по выбору квантования.
6800
Выбор и настройка open-source OCR моделей: полное руководство по современным пайплайнам
Подробное руководство по выбору, настройке и fine-tuning open-source OCR моделей. Сравнение Chandra, OlmOCR-2, практические пайплайны для production.
6801
Дистилляция в Mamba: как ServiceNow ускорила модель в 2.1 раза, игнорируя интуицию о данных
Глубокий разбор кейса ServiceNow: как дистилляция в Mamba с нарушением интуиции о данных дала ускорение throughput в 2.1 раза. Практический гайд по ретропиттинг
6802
Параметры в LLM: почему 175 миллиардов — это не просто цифра
Объясняем параметры нейросетей на простых примерах: как 175 миллиардов весов в GPT-3 превращают текст в понимание. Архитектура трансформера, обучение модели и р
6803
Механистическая интерпретируемость: как Anthropic и OpenAI заглядывают внутрь ИИ-моделей, как в микроскоп
Глубокий разбор механистической интерпретируемости — как Anthropic, OpenAI и DeepMind изучают внутреннюю работу LLM. Методы, инструменты и почему это меняет всё
6804
Gemma 3 270M: обзор, бенчмарки и как запустить локально на слабом железе
Обзор, тесты производительности и инструкция по установке Gemma 3 270M — самой компактной модели Google для локального запуска на любом железе.