曦望;新一代推理GPU芯片启望S3;单位Token推理成本降低90%

曦望发布新一代推理GPU芯片启望S3,单位Token推理成本降低90%

1月27日,界面新闻记者获悉,国产GPU厂商曦望(Sunrise)发布新一代推理GPU芯片启望S3。这是曦望在近一年累计完成约30亿元战略融资后的首次集中公开亮相。2025年,曦望芯片交付量已突破万片。

启望S3为面向大模型推理的定制化GPGPU芯片。界面新闻记者了解到,其在典型推理场景下的整体性价比较上一代提升超10倍。算力与存储设计上,该芯片支持FP16至FP4精度切换,采用LPDDR6显存方案,显存容量提升4倍。在DeepSeek V3/R1满血版等主流大模型推理中,单位Token成本较上一代降低约90%。

    广告等商务合作,请点击这里

    未经正式授权严禁转载本文,侵权必究。

    打开界面新闻APP,查看原文
    界面新闻
    打开界面新闻,查看更多专业报道

    热门评论

    打开APP,查看全部评论,抢神评席位

    热门推荐

      下载界面APP 订阅更多品牌栏目
        界面新闻
        界面新闻
        只服务于独立思考的人群
        打开