核心多反而慢?AMD联手修Bug,线程撕裂者性能暴涨215%

这事儿挺有意思,AMD和开源转码工具HandBrake坐一块儿,把软件里的线程调度瓶颈给抠出来了。结果就是,线程撕裂者这款CPU,转码性能最高能往上蹿215%。说白了,以前是硬件没跑满,现在终于放开了手脚。

先说说为啥会这么慢。线程撕裂者这系列,核心数动不动就64核,甚至96核,看着吓人。可放在HandBrake里,性能不仅没涨,有时候还往下掉。尤其是在低分辨率的场景下,这种怪象特别明显。用户看着这么多核心,心里肯定犯嘀咕,这钱花得值吗?

AMD的工程师后来查明白了,根子有两个。头一个大坑,是HandBrake压根管不住超过64个逻辑处理器的系统。CPU明明有一堆算力闲着,软件却调不动它们,这就好比仓库里堆满了货,搬运工却只有几个,忙不过来,剩下的只能干瞪眼。

第二个大坑更隐蔽。有些任务被切得太碎了,尤其是720p的测试里,CPU大把的时间都花在协调调度上,真正干活做转码的时间反而少了。这两个问题一叠加,性能损耗直接拉到60%。这可不是小数目,等于白扔了一大半的实力。

修复的方案,跟着HandBrake 1.11.0版本一起推了出来。核心改动就在线程管理和任务调度策略上。简单讲,就是把活儿分配得更均匀,让转码任务能实实在在落到更多的核心上去。这样每个核心都能发挥用处,不再互相打架或者闲置。

为了验证效果,测试用了两版软件对比。一个是新的HandBrake CLI 1.11.1,另一个是老版本的CLI 1.6.1。结果很直观,线程撕裂者PRO 9995WX,96核的那款,性能提升了最高181%。

而线程撕裂者7980X,64核的版本,性能更是涨了最高215%。数字摆在这儿,提升幅度相当可观。 再往细节里看,不同项目的表现也不一样。HEDT平台在Perfume H.264 720p这个场景里,拿到了215%的最大增益。

到了LG_8K HEVC 8-bit 4320p,也有203%的提升。PRO平台这边,Perfume H.264 720p场景涨了181%,Perfume HEVC 10-bit 2160p提升了151%,LG_8K HEVC 8-bit 4320p则是149%。

每一项都在往上走,没有拖后腿的。 为什么低分辨率场景受益最大呢?道理其实不难懂。之前那些调度开销,在轻负载的任务里占的比例本来就高。现在把这些浪费的时间省下来,释放出来的算力比例自然就更大。换句话说,活儿越少,以前折腾的劲儿就越不值当,现在理顺了,效率提升也就越显著。

热门推荐