IT之家 昨天
富士通介绍PHOTON框架:多查询性能至高475倍于Transformer
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

IT 之家 6 月 25 日消息,富士通 ( Fujitsu ) 日本当地时间昨日介绍了其开发的 PHOTON(自上而下网络并行分层计算)架构,宣称其在多查询(生成多个备选结果并在此基础上给出最终答案)场景下性能至高可达主流 Transformer 架构的 475 倍。

富士通表示,Transformer 架构的一大弊病是其在长上下文输入或多线程同步处理的场景下会执行大量访存操作来保留历史信息,这往往会导致处理速度下降。PHOTON 能高效率低开销地处理智能体系统等多 I/O 流程,从而降低 GPU 成本。

▲ 左:语义分层;右:并行计算

PHOTON 架构在语义层面上进行分层处理,相较 Transformer 的词元级分割可降低计算复杂度并提供了更好的并行性。而在多查询最后的决策环节,PHOTON 则采用了多数决定或选择最佳的方式,仅需一次推理。

测试结果表明,PHOTON 在 600M、900M、1.2B 等参数规模相对较小的模型中可实现更高的迭代吞吐量和更低的内存占用,其中 1.2B 模型上实现了 475 倍性能和略低的质量。此外,由于 PHOTON 架构每次迭代所需的 KV Cache 更少,还能提升最大迭代次数。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

富士通 日本 吞吐量 it之家 gpu
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论