近期,新一代星辰大模型Xing4.0-29B-A4B正式发布。天数智芯携手众智FlagOS社区,在模型发布当日完成适配与推理部署验证,并推出基于天数智芯通用GPU平台的BF16版本。

作为面向工程任务和智能体应用的升级模型,Xing4.0-29B-A4B总参数量29B,每token激活参数量仅4B。模型结合mHC、MLA与MTP设计,原生支持256K上下文,并可扩展至512K。这一架构在保持模型能力的同时,显著降低了单次推理的激活开销,更适合在真实业务中高频调用与规模化部署。
此前,对于需要处理代码、日志和长文档的Agent而言,模型往往需要连续调用工具、执行多个步骤,这对底层推理平台的稳定性、兼容性和部署效率提出了更高要求。
本次适配完成后,开发者可在天数智芯通用GPU上直接运行BF16版本,并将模型接入自己的工具链,无需重新开发底层适配代码,从而将更多精力投入应用创新与业务验证。
这背后,既离不开天数智芯通用GPU平台与智算软件栈的支撑,也体现了FlagOS社区统一多芯片软件栈在跨芯片适配与推理验证上的效率。