曦望发布新一代推理GPU芯片启望S3,单位Token推理成本降低90%

1月27日,界面新闻记者获悉,国产GPU厂商曦望(Sunrise)发布新一代推理GPU芯片启望S3。这是曦望在近一年累计完成约30亿元战略融资后的首次集中公开亮相。2025年,曦望芯片交付量已突破万片。

启望S3为面向大模型推理的定制化GPGPU芯片。界面新闻记者了解到,其在典型推理场景下的整体性价比较上一代提升超10倍。算力与存储设计上,该芯片支持FP16至FP4精度切换,采用LPDDR6显存方案,显存容量提升4倍。在DeepSeek V3/R1满血版等主流大模型推理中,单位Token成本较上一代降低约90%。

未经正式授权严禁转载本文,侵权必究。

评论

暂无评论哦,快来评价一下吧!