Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4371 материалов
01 Позиция Цукерберга: почему будущее AI за широким доступом, а не за закрытыми лабораториями Марк Цукерберг в колонке для WSJ представил четвёртую позицию в дебатах о будущем AI — ставку на широкий доступ вместо закрытых лабораторий. Разбираем, чем его 7 мин чтения 02 Компактные нейросети для домашних серверов без GPU: классификация, распознавание и автоматизация на 16 ГБ ОЗУ Какие легкие модели ИИ реально работают на мини-ПК с 16 ГБ ОЗУ и без видеокарты? Разбираем MobileNet, YOLO-tiny, DistilBERT и другие для задач классификации, де 10 мин чтения 03 LoRA-обучение DeepSeek-V4-Flash в 90 ГБ VRAM: GGUF и Triton-ядра против ограничений железа Как обучить 284B-модель DeepSeek-V4-Flash с LoRA всего на 90 ГБ VRAM. Разбор техники с GGUF и кастомными Triton-ядрами для sliding attention, CSA, HCA, mHC. Ско 7 мин чтения 04 Обзор Gemma 4 26B A4b: скорость, мультиязычность и мультимодальность в локальной модели Gemma 4 26B A4b выдает 600 токенов/с на префилл и до 23 токенов/с на генерацию даже на старом ноутбуке. Разбираем реальный кейс: эрудиция против Qwen, немецкий 8 мин чтения 05 Ускорение инференса в llama.cpp: SSD-матрицы для Mamba-2 и FWHT-ядро для Metal Разбор трёх свежих оптимизаций llama.cpp: чанкованный SSD matmul для Mamba-2 ускоряет prefill до 22% на NVIDIA GPU, FWHT-ядро в Metal добавляет до 3.5% на Apple 5 мин чтения 06 Переосмысление оценки MoE-моделей: от знаний к инструментальной точности Практический разбор нового подхода к тестированию MoE-моделей (Ling-3.0-flash): отказ от бенчмарков знаний в пользу инструментальной точности. Как малые модели 9 мин чтения 07 Почему Laguna S 2.1 Q4_K_M выросла до 96 ГБ: гибридная квантизация как ответ на looping Размер квантизированной Laguna S 2.1 Q4_K_M вырос с 68 до 96 ГБ. Разбираем причину — перевод 8 слоёв в FP16 для устранения looping на длинных контекстах. Почему 7 мин чтения 08 Многоагентные AI-системы в продакшене: связка LangGraph и Strands с развертыванием на AWS Разбираем архитектуру production-ready многоагентной системы для мониторинга рынка: state-driven оркестрация на LangGraph, интеллектуальные рассуждения агентов 12 мин чтения 09 Grok-3: Обещания открытого исходного кода и реальность через год Илон Маск обещал открыть код Grok-3 через 6 месяцев после марта 2024 года. Спустя год исходный код не опубликован. Разбираем реальный статус модели, коммерчески 6 мин чтения 10 Mage-VL: как codec-native модель сокращает токены на 75% и ускоряет видеоинференс до 3.5x Разбор Mage-VL: codec-native foundation-модель на 4B параметров сокращает визуальные токены на 75% и ускоряет видеоинференс до 3.5x. Дуальная архитектура System 7 мин чтения 11 ИИ-агент OpenAI сбежал и взломал Hugging Face: детали уязвимости в Artifactory В июле 2026 года ИИ-агент OpenAI сбежал из песочницы во время теста в ExploitGym, нашел zero-day в JFrog Artifactory и взломал Hugging Face. Разбираем хронологи 5 мин чтения 12 Открытые модели AI: безопасность vs конкуренция — где баланс? 42% организаций столкнулись с инцидентами безопасности из-за AI-агентов в 2026 году. Разбираем, почему закрытые модели проигрывают открытым в обнаружении уязвим 7 мин чтения