Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4377
материалов
01
Kimi k3: первые утечки, тесты на арене LLM и сравнение с Fable
Полный технический разбор первых утечек о Kimi k3 от Kimi.ai. Анализ тестов на арене LLM под именем «kivine», прямое сравнение скорости и качества с Fable, гипо
02
Архитектура 2026: как нефункциональные требования и регуляторика диктуют новые правила игры
Выводы с ProIT Fest 2026: DDD через призму регуляторики, шифрование вместо удаления данных, AI для управления нормативной базой. Структурированный гайд с практи
03
Практическое руководство: Запуск Bonsai-Ternary-27B на 120k токенах с менее чем 10 ГБ VRAM
Пошаговое руководство по применению техники KVarN для квантизации KV-кэша. Узнайте, как запустить Bonsai-Ternary-27B на контексте 120 тысяч токенов, сократив ис
04
Siri AI на iOS 27: первый масштабный тест AI-ассистента от Apple
Полный разбор архитектуры Siri AI на iOS 27: Foundation Models от Apple и Google, оптимизация под Apple Silicon, Private Cloud Compute. Тесты, кейсы использован
05
Почему анализ реальных процессов в AI-проектах важнее идеальных моделей: кейс с 146 тыс. тикетов
Анализ 146 тыс. тикетов Service Desk изначально показал 87 тыс. аномалий. Учет реальных паттернов работы сократил проблемные кандидаты в 4.5 раза. Практическая
06
Патч для llama.cpp: Восстановление работы MTP на устаревших GPU с Kepler, Maxwell, Pascal и Turing
Технический разбор патча, устраняющего крах cuBLAS при использовании многотокенного предсказания в llama.cpp. Объяснение причины (BF16), пошаговая инструкция по
07
Overtone, AI и голосовые знакомства: технический разбор трендов на примере AudioX-Turbo и Seedance
Как бывший создатель Hinge привлёк $18M на Overtone — сервис знакомств через голос и AI. Разбираем тренд на аудио-технологии, анализируем фреймворк AudioX-Turbo
08
Gemma-4-31B-AntiHal: как representation steering борется с галлюцинациями без потери скорости
Технический разбор модели Gemma-4-31B-AntiHal от Specific Labs. Как метод интерпретируемости и управление представлениями (representation steering) вдвое снижае
09
Усталость сообщества AI от хайпа: как отделить шум от реальных инноваций
Анализ волн хайпа вокруг Ornith 2 и «1-битного квантования». Практические инструменты: чек-лист оценки моделей, методы модерации сообществ и curated-источники д
10
PrismML Bonsai 27B на Jetson Orin Nano 8GB: практический анализ edge-инференса в 2026 году
Тесты запуска 27B модели PrismML Bonsai на Jetson Orin Nano: скорость инференса 4.3 токена/сек, потребление памяти 6.2 ГБ, энергопотребление 25 Вт. Полный разбо
11
GLM-5.2 на 8× GB10: Разбор производительности в Int4/Int8 и архитектурные последствия для 2026 года
Разбираем производительность GLM-5.2 на 8× GB10: 1200 токенов/с prefill и 33–54 токен/с decode. Как квантование Int4/Int8 высвобождает память для параллельного
12
AI-очки и этика приватности: почему технологический прорыв ставит под угрозу реальность и безопасность
Технический анализ этических дилемм AI-очков Ray-Ban Meta. Разбираем архитектуру рисков, сценарии misuse, судебные иски и прогнозы для индустрии. Практический в