- ← предыдущая
- первая
- 1
- 2
- 3
- 4
- 5
- 6
- 7
- последняя
- следующая →
Мы используем файлы cookie и сервисы аналитики. Ознакомьтесь с нашей Политикой сбора данных и выберите, какие типы cookie вы разрешаете:
cookie_policy_accepted — хранит ваш выбор cookiePHPSESSID — сессияkey3 — запоминание входа_ix — единая сессия входа на ixbt.comadminuserskey — вход администратораtopic_add_autosave — автосохранение черновикаls_photoset_target_tmp — временные данные загрузки фотоgeo_country — определяет ваш регион_ga, _ga_*, _ym_uid, _ym_d, _ym_* — статистика посещений__gads, __gpi — таргетирование объявленийВы всегда можете изменить свои предпочтения в настройках.
Или там как в жигулях в далёком прошлом, когда первый владелец докручивал все винты, исправлял косяки завода и машина становилась дороже чем с конвейера?
С учётом того, что эта 5080 местами 7900xtx сливает которой уже несколько лет…
* 16bits. So with 8 fp16 elements we implement that with a f16vec16.
* We then use the coefficient generated by this function to figure out
* how many elements we really have.
*/
Никто никого не обманывает, Вот здесь вполне понятно как это будет считаться… Пока вижу из недостатков только большее потребление памяти, а в случае использования fp16 модели (не сжатой) можно и в скорости выиграть.
Графический драйвер Vulkan для AMD Radeon (RADV), разработанный в качестве альтернативы официальному графическому драйверу Vulkan от AMD (AMDVLK), впервые позволяет выполнять масштабирование ИИ, для которого требуются ускорители ИИ графических процессоров с RDNA 4, на графических картах RDNA 3 (GFX11) с использованием эмуляции FP8 и VKD3D Proton под управлением Linux. Компиляция по-прежнему требует относительно высокого уровня знаний, но готовые пакеты вероятно появятся в обозримом будущем.
Это лишь вопрос времени, когда FSR 4 будет официально реализован в API Proton через VKD3D и затем будет работать на видеокартах RDNA 3 с помощью графических драйверов RADV и программной эмуляции или эмуляции FP8.
FP16 у 7900xtx немного меньше чем у 3090ti, хотя можно и 40 серию глянуть.
FP32 немного меньше чем у 4090D, а FP64 выше 4090. АМД решали текущие задачи. Int8 эти карты могут решать но без удвоения скорости вычисления. См картинку по ссылке. Однако этой производительности за глаза, если мы сравниваем с аналогом cnn от нвидии. С учётом того, что fsr4 гибрид с элементами трансформера, будет на рдна3 картинка процентов на 10 хуже и скорости не +30 кадров, а +23 каких-нибудь условных…
Впрочем как и 7900хтх.
Поэтому фср4 на выходе должен работать бескомпромиссно. Позже можно сделать и немного упрощённую версию для третьего поколения, но позже, что бы это никак не отражалось на рдна4. Примерно так.
С учётом того, что Черни заявил, что псср2 будет, по сути, адаптацией фср4 на пс5про, а она очень далека от рдна4 и скорее гибрид рдна2 и рдна3.5, они уже видят как это сделать. Да и сами амд заявили, что рассмотрят возможности бэкпорта фср4 для рдна3.
По поводу ии погляди на сообщения ниже, там есть и статья и архитектура по ссылкам.