Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4371 материалов
01 AI-рейк: почему технологические гиганты сокращают сотрудников, несмотря на рекордную выручку 140 000 сокращений в тех-секторе США с начала 2026 года. Monday.com, Intuit, Meta и Amazon связывают увольнения с ИИ, но рынок наказывает их отставанием от Nasd 7 мин чтения 02 GPT-5.6 Sol Ultra против 6-летнего тупика: как AI доказал стойкость нескопируемого квантового шифрования Как GPT-5.6 Sol Ultra через агента Codex сгенерировала доказательство сильной неразличимости для схем нескопируемого шифрования, обойдя классический метод моног 8 мин чтения 03 Практическое сравнение квантизации Qwen3.6-27B: почему FP16 оправдывает затраты ресурсов при разработке сложного кода Реальный кейс: как низкобитная квантизация Qwen3.6-27B приводит к критическим ошибкам в многопоточном C++ коде и почему FP16 экономит дни дебага. Сравнение VRAM 9 мин чтения 04 M2 Ultra 64 ГБ против M1 Ultra 128 ГБ: что выбрать для AI-нагрузок в 2026 году? Прямое сравнение M2 Ultra 64 ГБ и M1 Ultra 128 ГБ для инференса и тонкой настройки LLM. Тесты скорости, таблицы совместимости моделей и честный разбор, когда 12 9 мин чтения 05 RTX PRO 4500 vs RTX 5090 vs Multi-GPU: что выбрать для AI-задач в 2026 году Сравниваем RTX PRO 4500 (300 Вт), RTX 5090 (600 Вт) и 4×RTX 3090 для AI-задач. Расчёты TCO на 3 года, экономия до 10.7 млн рублей на 100 GPU, бенчмарки инференс 12 мин чтения 06 Свой open source AI-ассистент: архитектура, E2E-шифрование RAG и тематические помощники Детальный технический разбор опенсорсного AI-ассистента «Свой»: архитектура на Go, Vue 3 и PostgreSQL 17, долговременная память на pgvector, E2E-шифрованный RAG 8 мин чтения 07 Пределы возможностей малых моделей: упираемся ли мы в стену параметров или VRAM? Разбираем, существует ли жёсткий предел интеллекта для малых моделей (до 48GB VRAM). Анализ факторов: параметры, VRAM, датасет. Тесты Qwen3.6-27b и прогнозы. 8 мин чтения 08 Почему GLM-5.2 с архитектурой DSA падает на длинных контекстах: разбор ошибки NaN и тест конфигураций GPU/CPU GLM-5.2 с DSA выдаёт NaN-логиты при контексте больше 32k? Разбираем причину — переполнение f16 в indexer'е на GPU — и даём проверенные конфигурации для RTX 3060 8 мин чтения 09 Как AI-аналитика меняет спорт: разбор трёх кейсов на платформе AI4BI Разбираем, как платформа AI4BI автоматизирует сбор и анализ данных в спорте. Прогноз финала ЧМ-2026, скаутинг хоккеистов для КХЛ и персонализированная реабилита 12 мин чтения 10 GigaChat Audio 10B: аудио-native LLM с временной локализацией — архитектура и примеры GigaChat Audio 10B обрабатывает аудио напрямую через Conformer-энкодер и Mixture-of-Experts декодер, без транскрипции. Разбираем архитектуру, временную локализа 8 мин чтения 11 Экономика self-hosted моделей vs API: когда своё железо окупается в 2026 году Сравниваем реальную стоимость решённой задачи на своём железе и через API. Точка безубыточности, скрытые риски и кейс с DeepSeek V3.2. Цифры, а не хайп. 1 мин чтения 12 Sapphire Radeon RX 9700: тихий инференс AI-моделей — замеры шума, сравнение с RX 7800 XT и тонкая настройка Замеры шума Sapphire Radeon RX 9700 под нагрузкой Qwen 27B и Gemma 4 31B: 38-42 дБА в стоке, 32 дБА после андервольтинга. Сравнение с RX 7800 XT, таблицы произв 9 мин чтения