来源于:DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-pg官网登录地址
发布时间:2026-09-14 03:18:55
文章摘要:
DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-pg官网登录地址:DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-pg官网登录地址 DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-pg官网登录地址
9月13日消息,下波型被本周DeepSeek发布了V4.1 Flash,大模这个大模型架构变化之大,指即开云登入口完全可以称得上是将问V5了,但DeepSeek很低调地没换大版本号。世万数性 Pro系列的亿参新品确定了是V4.1 Pro,具体升级还没公布,下波型被如果是大模V4到V4.1这样的提升幅度,那V4.1 Pro性能上限也会很高,指即开云登入口但考虑到之前V4 Pro-0813正式版的将问不及预期,大家期待值不要拉太高。世万数性 后续还有一波大模型,亿参爆料者称它叫做DeepSeek Code 2.0,下波型被即将发布,大模时间窗口是指即9月份,预计性能会击败Mythos 5.1和GPT-6 Astra,这是当前最强大的两个前沿级大模型。 其他方面,DeepSeek Code 2.0预计会继续保持开源开放,设计重点是Computer Use,也就是电脑控制,AI替代你操作电脑完成很多工作,Astra目前很多让人惊讶的使用就来自这一方面。 这个Code 2.0拥有高达3万亿以上的参数量,显然这也是它提高性能的关键,这方面国内目前最强的是K3大模型的2.8万亿,千问的Qwen 3.8 Max是2.4万亿参数量,DeepSeek V4 Pro是1.6万亿参数。 从V4.1 Flash换用新结构使得参数量翻倍来看,这个Code 2.0从当前1.6万亿提升到3万亿参数的可信度是有的,想跟Mythos 5.1及Astra这样的大模型竞争就需要这个级别的参数量,不然性能上限是很难提升的。 这个爆料的可信度不好说,DeepSeek过去的23-24年倒是推出过三款名字带Code的大模型,不过那时候表现平平,这次要是重推偏向代码/逻辑的Code大模型,作为旗舰级产品倒也不失为一个方向,就让V4.1 Pro及Flash面向通用Agent任务即可。
返回首页