怎样看待美国最新超算 Summit

我一直认为超算这种技术美国真想做是绝对可以做出来并领先的,对美国来说只是一个资金分配的问题。
问题是国内官媒民媒沉不住气,忘记了小学课本里的一句话“胜不骄,败不馁“,我们既要追赶硬科技,国民的心理素质也要赶上去。
也许明年又是我们第一了,也许不是,竞争就是这样,不要一天天咋咋呼呼的。
需要角逐的领域很多,量子计算,人工智能等等,将来都是翻天覆地的科技。

■网友
HPC 500发榜了
SUMMIT不出所料霸榜
LINPACK倒是中规中矩,不管实际算力还是效率都在意料之内
【怎样看待美国最新超算 Summit】 效率60%+还不如神威-太湖,后续软件优化大有余地

但是HPCG成绩突破天际,大力出奇迹,2925.75 Tflop/s
橡树岭前代TITAN的近十倍,去年HPCG榜首K的五倍
姐妹机Sierra也跑出1795T flop/s

虽然0.024的HPCG效率,还是输于独步天下的K
至少说明在100p这个量级,当前这套堆料架构还是没啥大问题的

神威-太湖稳定不变,天河二升级换芯后LINPACK翻番
但是HPCG没有数据缺榜,看来还在调试中

HPCG榜单和HPC榜单对照看,还真是别有风景
近年部署的新机HPCG排名普遍高于对应HPC排名甚至高出很多
从这个角度看,霓虹的K (京)还真是相当的亮

E级计算之战大幕已开,K的后续机型也已经有原型设计,
CPU架构从SPARC转为基于扩展ARM V8的多核设计
通过内核不同组合区分IO节点与计算节点
互联升级到Tofu2
Details Emerge On Post-K Exascale System With First Prototype

美国3台E级超算,
A21(就是跳票的Aurora ),Frontier,El Capitan已经开始启动
Intel/cray,18m/NV应该各自认领一台,还有一台很可能有新面孔
2020年前还会有两台百P级超算交付能源部国家实验室,架构希望有惊喜
有不靠谱谣传(期望)说HP可能会和AMD组队,前者面向内存的架构加后者的GPU计算
怎样看待美国最新超算 Summit


天朝一切都在保密,没啥可说的
神威的HPCG成绩依然是个人一块心病

补充,欧洲的E级超算计划也出来了
会基于RISC~V或/和ARM发展一款低功耗高性能计算芯片

并在2024年基于该芯片架构搭建E级超算

European Program to Develop Supercomputing Chips Begins to Take Shape
更新
调试了半年后满载上线的Summit/Sierra占据榜单前二
Linpack效率提升到70+,帮助Sierra挤下神威排进第二


■网友
等看跑分结果再说吧。
看新闻,显卡异构计算的。我觉得显卡异构计算解锁了很大的计算瓶颈问题。计算性能这些年在异构的支持下,发展迅猛。
但似乎带来的显卡计算对于整数计算效率应该不高吧?没注意过 nv 的显卡计算的通用性能能否适应其他非浮点计算的需求,不过超算的非浮点计算都有啥应用?好像暴浮点本来就是超算必须的。
太湖之光的 CPU ,虽然也是异构,但是计算单元是从通用 CPU 缩水而来。而且传说生产技术并不高。和 summit 还真是不好比。
但是毕竟橡树岭是美国研究核弹的地方,钱不是问题,而且美国的技术一直也不是问题,就看应用需求了。
其实我觉得吧,橡树岭能 4 年不在第一名的位置上才是让人意外的事情。
跑分结果出炉,很想知道效率不高是什么地方的瓶颈?
好像传说核弹计算,核弹自己的内存 IO 的效率不高,会不会和这个有关系导致实际运行时,核弹自己要等自己的数据呢?

■网友
(谢邀)
-- 2018.6.10 又更新 --
更详细的报道中提到E级AI算力不仅仅来自于低精度,而是GPU采用了张量计算单元,可以求解D=AB+C,其中ABCD是4x4的32或16位浮点数。相当于把GPU计算能力往特定领域又精进了一步。据称目前在基因组分析上能获得E级算力。直观上看,对于图片视频编解码(有大量8x8小块的计算)也是有好处的。不足之处在于张量单元的计算规模仍然较小,如果支持64位浮点计算,甚至支持8x8,16x16的矩阵的话,对科学计算的意义将会十分重大。PS.仿佛看到了国产E级机的一种可能……


推荐阅读