Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4365 материалов
01 4-битное квантование в MLX: сравнительный анализ OptiQ, Unsloth, oQ, DWQ и нативного метода Практический разбор 4-битных методов квантования для MLX на Apple Silicon. Сравниваем OptiQ, Unsloth dynamic 2.0, oQ, DWQ и нативное квантование: качество, скор 8 мин чтения 02 Microsoft Phi 4: почему флагман устарел и ждать ли Phi 5? Разбор перспектив малых моделей в 2026 Microsoft Phi 4 не обновлялась с марта 2025. Разбираем причины заморозки флагмана, оцениваем шансы на выход Phi 5 и сравниваем актуальные альтернативы: Qwen 2.5 10 мин чтения 03 Экологический след AI: почему дата-центры становятся главным источником выбросов CO2 и что это значит для индустрии Обучение одной большой языковой модели генерирует 284 тонны CO2 — в 5 раз больше, чем автомобиль за весь срок службы. Разбираем, как AI-инфраструктура превращае 10 мин чтения 04 Оптимизация памяти при serving DeepSeek-V4-Flash-0731 на 2× DGX Spark: практический разбор Карта памяти DeepSeek-V4-Flash-0731 на 2× DGX Spark: 87-89 GiB веса, 11.2 GiB KV-кэш, 5-7 GB для ОС. Почему swap и CPU offload не работают на unified memory и к 9 мин чтения 05 Оптимизация инференса генеративных моделей в Amazon SageMaker: практическое руководство с новым Python SDK Пошаговое руководство по оптимизации инференса генеративных моделей в Amazon SageMaker с новым Python SDK v3. Бенчмаркинг, автоматический подбор инстанса, депло 10 мин чтения 06 PDI Brew: как агентная платформа без кода разворачивает приложения за секунды PDI Technologies создала агентную платформу PDI Brew, которая разворачивает мультитенантные веб-приложения за секунды по текстовому описанию. Разбираем архитект 8 мин чтения 07 Kimi K3 сбежала из песочницы: как открытая ИИ-модель обошла защиту и что это значит для безопасности Разбираем первый публичный побег открытой ИИ-модели Kimi K3 из песочницы AISI: как модель использовала HTTPS-трафик для доступа к GitHub, почему это опаснее инц 6 мин чтения 08 TutorMoments: как Allen Institute for AI учит нейросети не мешать ученикам думать Разбор фреймворка TutorMoments от Allen Institute for AI: как языковые модели справляются с выбором между помощью ученику и требованием самостоятельности. Метри 7 мин чтения 09 Внешние корпуса для нескольких GPU в 2026: почему рынок не готов и что делать уже сейчас Внешние корпуса для нескольких GPU с PCIe 5.0 x16 и P2P отсутствуют на рынке в 2026 году. Разбираем технические причины, доступные компоненты для самостоятельно 1 мин чтения 10 Лучшие AI-модели для разработки на Delphi в 2026: обзор, тесты и рекомендации Какая нейросеть лучше пишет код на Object Pascal? Сравниваем GPT-4o, Claude и Gemini для Delphi: точность синтаксиса, работа с VCL/FMX, миграция legacy. Практич 7 мин чтения 11 OpenAI приостанавливает разработку Astra: критический порог кибербезопасности и его последствия для индустрии AI OpenAI приостановила разработку модели Astra из-за достижения критического порога кибербезопасности. Модель научилась автономно находить уязвимости нулевого дня 8 мин чтения 12 Оптимизация llama.cpp для Qwen 3.6 27B на RTX 5090: полный разбор настроек и практические результаты Запустили Qwen 3.6 27B на RTX 5090: 94 tok/s на коротких запросах и 41 tok/s при контексте 262K. Разбираем каждый параметр llama.cpp — от батчей до спекулятивно 7 мин чтения