么也压不住兴奋的笑意。
“林总!安德森先生!跑完了!”
周博士跨进办公室,大步走到桌前,将那张折线图平铺开来:“四千多万用户的稠密特征矩阵分解,全部收敛完成!”
林辰低头看向图纸最底部的计时统计。
实测运行耗时:四十三分二十六秒。
旁边的 AleX也忍不住用英语大声补充道:“林先生,虽然在中间阶段,我们遇到了
PCIe 2.0总线带宽延迟的问题,显存数据交换出现了短暂的等待,但总体算力吞吐表现极其惊人!”
AleX比划着双手,神情振奋:“相比于用至强 CPU 集群跑完整通宵的十八个小时,这套原型阵列的综合运算效率,实现了整整十二倍以上的实测跨越!”
整整十二倍的提升!
这意味着,飞鸽信息流推荐算法的离线批处理周期,从“一天跑一次”,被硬生生压缩到了“可以按小时进行动态更新”。
用户在前台每一次滑动的偏好反馈,在一个小时之后,就能直接反哺到推荐模型中。
站在桌旁的林小雨虽然不懂那些复杂的代数方程,但看着屏幕上那断崖式缩短的时间,也忍不住露出了开心的笑容。
林辰看着图纸上平滑的收敛曲线,神态依旧平稳。
他站起身,走到周博士面前,伸出手拍了拍这位老学者的肩膀:“辛苦了,这几个月的辛苦没有白费。”
周博士眼眶微热,连连摆手:“都是林总您的方向指得准,换作在别的公司,谁敢拿出上千万美金来陪我们疯搞显卡集群。”
林辰收回手,环视着屋内的几个人,有条不紊地下达了后续的工作分工:“测试跑通了,但离真正的工业级部署还差得很远。”
林辰转头看向安德森:“二期的五百一十二颗集群扩建,供电和散热改造立刻启动,钱照常批。”
“好!”
安德森重重点头道。
林辰看向周博士:“周博士,接下来的两周时间,你留在圣克拉拉,跟 AleX 的团队在一起,把国内的自然语言分词代码,彻底适配进他们用 C 语言手写的底层CUDA 库里,搭建一条自动化的跨洋加密数据管道。”
周博士没有任何迟疑,挺直身子点头应下:“明白,林总!两周之内,我一定把数据管道的接口全部封固完毕!”
(国庆快乐!!)