Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4377
материалов
01
Разоблачение мошенничества Basalt Labs: Как фейковые заявления о 99.44% на HLE маскируют подмену моделей
Basalt Labs заявил о рекордных 99.44% на бенчмарке HLE, но расследование вскрыло подмену: опубликованная модель — копия Qwen2.5-7B-Instruct, а на сайте работает
02
Strix Halo под нагрузкой: тестирование инференса LLM на мини-ПК с Ryzen AI Max+ 395
14.2 токен/с на Qwen 3.6-35B-A3B под 32 параллельными запросами, 30-минутный тест без критического троттлинга и +28% от оптимизаций. Детальные замеры Beelink GT
03
Trivium: CLI-инструмент для воспроизводимого управления навыками AI-агентов
Trivium — CLI-инструмент для воспроизводимого управления навыками AI-агентов. Фиксация версий по Git-коммитам, lock-файл зависимостей и именованные окружения дл
04
DeepSeek V4: Анонс, тесты и позиционирование на рынке AI в 2026 году
DeepSeek V4 — новая китайская модель ИИ с ценой инференса до 10 раз ниже Fable. Разбираем архитектуру MoE, тесты производительности на MMLU и HumanEval, и сцена
05
Kimi K3: новый виток гонки ИИ между Китаем и США и риски «полного ИИ-коммунизма»
Китайская Moonshot AI выпустила открытую модель Kimi K3 с 2.8 трлн параметров. Результаты бенчмарков, реакция рынка, обвинения в дистилляции и прогноз «полного
06
Полный конвейер генерации игровых анимаций с помощью ИИ: от картинки до скелета и экипировки в MMO
Пошаговое руководство по сборке AI-конвейера для 2D MMO: генерация арта нейросетями, автоматическая нарезка спрайтов, скелетная анимация в Spine/Spriter и удалё
07
openPangu-2.0-Flash: архитектура 92B A6B с MLA-кэшем и контекстом 512K — разбор и практика
Полный технический разбор openPangu-2.0-Flash: MLA-кэш сокращает память в 4-8 раз, DSA/SWA дают 512K контекст без квадратичного роста затрат, MTP ускоряет генер
08
Promptchain: автоматическое управление загрузкой и выгрузкой LLM на одной GPU
Promptchain — Python-библиотека и MCP-сервер для автоматического переключения между локальными LLM на одной consumer GPU. Политики вытеснения LRU, приоритеты, а
09
Вайбкодинг: как дизайнеру сохранить авторский контроль при работе с ИИ-кодером
Практический разбор вайбкодинга на примере сайта-портфолио с управлением жестами. Как дизайнеру делегировать код Claude Code, сохранить уникальность интерфейса
10
Сборка AI-сервера для инференса: Intel Ultra 7 270K vs Ryzen 9 9900X — какой процессор выбрать для 2x RTX 3090 в 2026 году
Сравниваем Intel Ultra 7 270K и Ryzen 9 9900X для сборки AI-сервера с двумя RTX 3090. Бенчмарки prefill: Intel быстрее на 23% и дешевле на 30%. Разбор ограничен
11
Kimi K3 обошла Claude Fable 5 в SpreadsheetBench 2: что это значит для работы с таблицами
Модель Kimi K3 от Moonshot AI заняла первое место в SpreadsheetBench 2, обогнав Claude Fable 5. Разбираем архитектуру mixture-of-experts с 2.8 трлн параметров,
12
Catmind-1.2b: мем-модель для мышления о котах или провал скрытого рейзонинга?
Экспериментальная fine-tune модель catmind-1.2b генерирует истории о котах вместо ответа. Тест на бенчмарке crucible показал падение точности с 75.6% до 24.3%.