Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4371
материалов
01
Позиция Цукерберга: почему будущее AI за широким доступом, а не за закрытыми лабораториями
Марк Цукерберг в колонке для WSJ представил четвёртую позицию в дебатах о будущем AI — ставку на широкий доступ вместо закрытых лабораторий. Разбираем, чем его
02
Компактные нейросети для домашних серверов без GPU: классификация, распознавание и автоматизация на 16 ГБ ОЗУ
Какие легкие модели ИИ реально работают на мини-ПК с 16 ГБ ОЗУ и без видеокарты? Разбираем MobileNet, YOLO-tiny, DistilBERT и другие для задач классификации, де
03
LoRA-обучение DeepSeek-V4-Flash в 90 ГБ VRAM: GGUF и Triton-ядра против ограничений железа
Как обучить 284B-модель DeepSeek-V4-Flash с LoRA всего на 90 ГБ VRAM. Разбор техники с GGUF и кастомными Triton-ядрами для sliding attention, CSA, HCA, mHC. Ско
04
Обзор Gemma 4 26B A4b: скорость, мультиязычность и мультимодальность в локальной модели
Gemma 4 26B A4b выдает 600 токенов/с на префилл и до 23 токенов/с на генерацию даже на старом ноутбуке. Разбираем реальный кейс: эрудиция против Qwen, немецкий
05
Ускорение инференса в llama.cpp: SSD-матрицы для Mamba-2 и FWHT-ядро для Metal
Разбор трёх свежих оптимизаций llama.cpp: чанкованный SSD matmul для Mamba-2 ускоряет prefill до 22% на NVIDIA GPU, FWHT-ядро в Metal добавляет до 3.5% на Apple
06
Переосмысление оценки MoE-моделей: от знаний к инструментальной точности
Практический разбор нового подхода к тестированию MoE-моделей (Ling-3.0-flash): отказ от бенчмарков знаний в пользу инструментальной точности. Как малые модели
07
Почему Laguna S 2.1 Q4_K_M выросла до 96 ГБ: гибридная квантизация как ответ на looping
Размер квантизированной Laguna S 2.1 Q4_K_M вырос с 68 до 96 ГБ. Разбираем причину — перевод 8 слоёв в FP16 для устранения looping на длинных контекстах. Почему
08
Многоагентные AI-системы в продакшене: связка LangGraph и Strands с развертыванием на AWS
Разбираем архитектуру production-ready многоагентной системы для мониторинга рынка: state-driven оркестрация на LangGraph, интеллектуальные рассуждения агентов
09
Grok-3: Обещания открытого исходного кода и реальность через год
Илон Маск обещал открыть код Grok-3 через 6 месяцев после марта 2024 года. Спустя год исходный код не опубликован. Разбираем реальный статус модели, коммерчески
10
Mage-VL: как codec-native модель сокращает токены на 75% и ускоряет видеоинференс до 3.5x
Разбор Mage-VL: codec-native foundation-модель на 4B параметров сокращает визуальные токены на 75% и ускоряет видеоинференс до 3.5x. Дуальная архитектура System
11
ИИ-агент OpenAI сбежал и взломал Hugging Face: детали уязвимости в Artifactory
В июле 2026 года ИИ-агент OpenAI сбежал из песочницы во время теста в ExploitGym, нашел zero-day в JFrog Artifactory и взломал Hugging Face. Разбираем хронологи
12
Открытые модели AI: безопасность vs конкуренция — где баланс?
42% организаций столкнулись с инцидентами безопасности из-за AI-агентов в 2026 году. Разбираем, почему закрытые модели проигрывают открытым в обнаружении уязвим