升级版DeepSeek-V3模型开源!DeepSeek上可试用体验

3月25日消息,DeepSeek在开源平台上线了升级后的DeepSeek-V3模型。新模型的版本号为DeepSeek-V3-0324,模型参数为6850亿,其早期版本参数为6710亿,相比有小幅增长。

开源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3-0324

同时DeepSeek也将DeepSeek-V3模型的开源协议更新为与DeepSeek-R1一致的MIT协议,这一协议允许模型蒸馏、商用等行为,给了开发者更多的自主权。

DeepSeek在其官方交流群中称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。

从网友初步反馈的实测效果来看,V3编码能力已经接近 Claude3.7,在网站开发能力、UI设计方面展现出巨大的进步,数学能力也有提升,能像推理模型一样解题。

DeepSeek于2024年12月26日发布了DeepSeek-V3 首个版本,当时,该版本的DeepSeek-V3 多项评测成绩超越了 Qwen2.5-72B 和 Llama-3.1-405B 等其他开源模型,并在性能上和世界顶尖的闭源模型 GPT-4o 以及 Claude-3.5-Sonnet 不分伯仲。(宜月)

英国版权法修订遭质疑,“内定”AI 训练版权豁免

2月12日消息,英国卫报昨日(2月11日)发布博文,报道称英国就修改版权法征求公众意见,在新的版权豁免下,拟允许人工智能(AI)公司使用创意作品训练算法。注:政府在咨询中提出了四种方案,其中倾向于放宽对AI开发...

亚马逊Meta英特尔AMD英伟达同时投资AI创企Scale 估值138亿美元

5月22日消息,据外媒报道,在OpenAI训练的人工智能聊天机器人ChatGPT大火后,谷歌、亚马逊、Meta等科技巨头们纷纷加大了在生成式人工智能和大模型研发及应用上的投入,也加大了对人工智能领域初创公司的投资,亚马逊...

注册资本1亿元!华为在京成立引望智能技术公司

2月21日消息,华为技术有限公司最近在北京成立了一家名为北京引望智能技术有限公司的新企业。法定代表人为郑丽英,注册资本高达1亿人民币。这家公司的经营范围包括汽车零部件研发、制造、再制造,智能车载设备制造,...

OpenAI 预计 2029 年才能实现盈利,2026 年可能还要亏 140 亿美元

IT之家10月10日消息,北京时间今天凌晨,据TheInformation报道,根据OpenAI公司的预测,直到2029年,公司才能实现盈利,届时公司收入将达到1000亿美元(IT之家备注:当前约7063.46亿元人民币)。根据TheInformation...

浪潮信息赵帅:未来一切计算皆AI,构建开放算力模组规范至关重要

8月12日消息,2024开放计算中国峰会上,开放算力模组(OCM)规范正式启动立项,首批成员包括中国电子技术标准化研究院、浪潮信息、Intel、AMD、百度、小红书、联想、超聚变等,旨在打造国内首个服务器计算模组设计规范...

TAG:DeepSeek AI
上一篇:蚂蚁集团利用国产芯片训练AI模型 成本降低约20%
下一篇:DeepSeek V3模型升级震撼海外用户:2分钟即可完成超400行代码