当前位置:首页 > DeepSeek技术交流 > 正文内容

PPIO 上线 DeepSeek-Prover-V2-671B

19小时前DeepSeek技术交流26

4月30日,DeepSeek 在 Hugging Face 开源了 DeepSeek-Prover-V2-671B 新模型。作为一站式 AIGC 云服务平台,PPIO派欧云在第一时间上线了 DeepSeek-Prover-V2-671B !让开发者能低成本快速使用并助力搭建创新场景。

DeepSeek-Prover-V2-671B 是一款基于 671B 参数的 MoE 大模型。 在模型架构上,该模型使用了DeepSeek-V3架构,采用MoE(混合专家)模式,具有61层Transformer层,7168维隐藏层。同时支持超长上下文,最大位置嵌入达163840,使其能处理复杂的数学证明,并且采用了FP8量化,可通过量化技术减小模型大小,提高推理效率。

PPIO 平台 DeepSeek-Prover-V2-671B 模型的基本信息:

价格: 输入: ¥4/百万 tokens,输出: ¥16/百万 tokens

上下文窗口:160k,最大输出 token 数:160k

据了解,PPIO派欧云是致力于为企业及开发者提供高性能的 API 服务,目前已上线 DeepSeek R1/V3、Llama、GLM、Qwen 等系列模型,仅需一行代码即可调用。并且,PPIO 通过 2024 年的实践,已经实现大模型推理的 10 倍 + 降本,实现推理效率与资源使用的动态平衡。


“PPIO 上线 DeepSeek-Prover-V2-671B” 的相关文章

拥抱新机遇,多家医疗企业接入DeepSeek

拥抱新机遇,多家医疗企业接入DeepSeek

近期,多家医疗企业密集宣布,公司已接入DeepSeek。互联网医疗企业称,DeepSeek可用于AI辅助诊疗、智能医疗服务等场景;医疗体检企业认为,DeepSeek可用于疾病监测、慢病管理等场景;中医...

DeepSeek公布推理引擎开源路径,OpenAI也将开始连续一周发布

DeepSeek公布推理引擎开源路径,OpenAI也将开始连续一周发布

机器之心报道,编辑:Panda。今天下午,DeepSeek 默默地在自己的 open-infra-index 库中发布了一份题为「开源 DeepSeek 推理引擎的路径」的文档,宣布将开源自己的内部推...

DeepSeek于知乎开设官方账号

DeepSeek于知乎开设官方账号

3月1日,DeepSeek于知乎开设官方账号,发布《DeepSeek-V3/R1推理系统概览》技术文章,首次公布模型推理系统优化细节,并披露成本利润率关键信息。文章写道:“DeepSeek-V3/R1...

黄山AI旅行助手全面接入DeepSeek大模型

黄山AI旅行助手全面接入DeepSeek大模型

上证报中国证券网讯(记者 杨翔菲)记者2月21日从黄山旅游获悉,日前,公司旗下途马科技已将黄山AI旅行助手全面接入DeepSeek大模型。此举成为文旅产业与人工智能深度融合的里程碑,黄山景区将成为国内...

当虹科技“DeepSeek+BlackEye”大模型一体机首发

当虹科技“DeepSeek+BlackEye”大模型一体机首发

当虹科技2月21日发布全新一代“DeepSeek+BlackEye”多模态大模型一体机,为传媒行业发展再次注入新活力。当虹科技副总裁、传媒事业部总经理叶建华表示,DeepSeek+BlackEye多模...

“DeepSeek们”爆改短剧,15天完成100集

“DeepSeek们”爆改短剧,15天完成100集

文 | 锌刻度,作者 | 李觐麟当周鸿祎下场演短剧《红衣大叔用AI带我穿越》,为自家的纳米AI站台;当AI动漫短剧《我靠嘴贱登上修真巅峰》开播即引发热潮,单部剧当期收入超过30万元;当央视频、博纳影业...