DeepSeek:UE8M0 FP8是针对即将发布的下一代国产芯片设计

美羊羊3周前商机资源1

8月21日,DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度。另外,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。DeepSeek官微在置顶留言里表示,UE8M0 FP8是针对即将发布的下一代国产芯片设计。

国产芯片布局_国产芯片逆袭_

相关报道

DeepSeek发布新模型V3.1 价格涨了但Agent能力提升了

8月21日,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代。

在X上,DeepSeek将V3.1称为“我们迈向智能体时代的第一步”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent能力、混合思考模式和更高的思考效率。

官方表示,通过后训练优化,新模型在工具使用与智能体任务中的表现有较大提升。在编程智能体、搜索智能体测评中, V3.1 相比之前的 DeepSeek 系列模型都有明显提高。

国产芯片逆袭__国产芯片布局

DeepSeek-V3.1 是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网页端体验新模型,通过“深度思考”按钮,实现思考模式与非思考模式的自由切换。DeepSeek API 也已同步升级,deepseek-chat对应非思考模式,deepseek-reasoner对应思考模式,且上下文均已扩展为 128K。

“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。

与之前的版本相比,V3.1也有更高的思考效率。官方表示,DeepSeek-V3.1-Think 在保持与 DeepSeek-R1-0528 相当的答案质量的同时,响应速度更快。

官方测试结果显示,经过思维链压缩训练后,V3.1-Think 在输出 token 数减少 20%-50% 的情况下,各项任务的平均表现与 R1-0528 持平。

在各项评测指标得分基本持平的情况下,R1-0528

同时,V3.1 在非思考模式下的输出长度也得到了有效控制,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。

同步地,DeepSeek进行了价格调整,模型的API接口调用价格有所上涨。自 9 月 6 日凌晨起,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。

国产芯片逆袭__国产芯片布局

官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源。

值得一提的是,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthropic API 生态的使用需求”,用户可以将 DeepSeek-V3.1 的能力接入Claude Code框架。

国产芯片逆袭_国产芯片布局_

相关文章

事关AI芯片!阿里发声:支持国产为真 大规模采购寒武纪不实

事关AI芯片!阿里发声:支持国产为真 大规模采购寒武纪不实

有消息称阿里云通义千问大模型面临算力缺口,阿里紧急追加寒武纪思元370芯片订单至15万片。 对此,阿里云人士回应《科创板日报》表示:“阿里云确实一云多芯支持国产供应链,但传言阿里采购寒武纪15万...

全球汽车芯片乍暖还寒

全球汽车芯片乍暖还寒

原本预估在复苏中的汽车芯片市场,在二季度再度显露出压力。 近期德州仪器、意法半导体、安森美等国际芯片龙头相继发布财报,其中关于汽车芯片的表述都有所转变。与上一个季度有好转迹象不同,在第二季度,汽车芯片...

【风口研报】DeepSeek助力国产芯片  市场空间有望进一步打开

【风口研报】DeepSeek助力国产芯片 市场空间有望进一步打开

A股三大指数今日延续强势表现,沪指再创十年新高。截止收盘,沪指涨1.51%,深证成指涨2.26%,创业板指涨3%。沪深两市成交额史上第二次突破三万亿,今日超过3.1万亿,较上一交易日大幅放量近600...

国产芯片重磅!中芯国际、华虹公司同日公布业绩

国产芯片重磅!中芯国际、华虹公司同日公布业绩

8月7日晚间,国内两大半导体晶圆代工龙头中芯国际、华虹公司发布了第二季度业绩,两家公司第二季度销售收入均实现了同比高两位数的增长,盈利能力得到大幅提升。 比收入增长更引人瞩目的是,两家晶圆厂在产...

东方财富财经早餐 8月22日周五

东方财富财经早餐 8月22日周五

每日精选 国产芯片: DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度。另外,V3.1对分词器及chat...

DeepSeek-V3.1正式发布 UE8M0 FP8技术助力国产芯片加速追赶

DeepSeek-V3.1正式发布 UE8M0 FP8技术助力国产芯片加速追赶

据DeepSeek官方公众号消息,DeepSeek-V3.1正式发布。DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到,DeepSeek-V3.1使用了UE8M0 FP8 Scale...

发表评论    

◎欢迎参与讨论,请在这里发表您的看法、交流您的观点。
客服微信:BT86616hnyanshan点击复制并跳转微信