徐聪,现任慧与科技(HPE)首席研究科学家(Principal Research Scientist),长期从事人工智能、计算机体系结构与高性能计算领域的飞球直播
研究,重点关注从人工智能算法、系统软件到计算与存储架构的协同设计,以及如何通过软硬件协同提升大规模人工智能系统的效率、可扩展性与智能化水平。
徐聪已发表60余篇同行评审学术论文,累计引用超过9,000次(H-index 30),研究成果发表于 NeurIPS、ICCV、ISCA、MICRO、DAC、ICCAD、ACL 等人工智能与计算机系统领域的重要国际会议。其参与提出的 TernGrad 分布式深度学习梯度压缩技术发表于 NeurIPS 2017,并入选 Oral Presentation;相关量化技术随后被纳入 Caffe2/PyTorch 1.0,用于降低大规模分布式深度学习中的通信开销。近年来,他的研究进步骤焦于大语言模型评测、大模型智能体、人工智能基础设施以及自我演进的智能系统,探索通过操作系统层的模型与智能体虚拟化,为大模型提供更加高效、可组合、可持续演进的系统基础。
徐聪本科毕业于北京大学,获美国宾夕法尼亚洲立大学计算机科学与工程博士学位。目前,他致力于推动人工智能算法、系统与高性能计算基础设施之间更深层次的融合,并将前沿研究应用于大规模企业级人工智能系统。