3月25日消息,DeepSeek在开源平台上线了升级后的DeepSeek-V3模型。新模型的版本号为DeepSeek-V3-0324,模型参数为6850亿,其早期版本参数为6710亿,相比有小幅增长。
开源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3-0324
同时DeepSeek也将DeepSeek-V3模型的开源协议更新为与DeepSeek-R1一致的MIT协议,这一协议允许模型蒸馏、商用等行为,给了开发者更多的自主权。
DeepSeek在其官方交流群中称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。
从网友初步反馈的实测效果来看,V3编码能力已经接近 Claude3.7,在网站开发能力、UI设计方面展现出巨大的进步,数学能力也有提升,能像推理模型一样解题。
DeepSeek于2024年12月26日发布了DeepSeek-V3 首个版本,当时,该版本的DeepSeek-V3 多项评测成绩超越了 Qwen2.5-72B 和 Llama-3.1-405B 等其他开源模型,并在性能上和世界顶尖的闭源模型 GPT-4o 以及 Claude-3.5-Sonnet 不分伯仲。(宜月)
- 蚂蚁数科全球化新进展:海外总部落户香港
- “毛孩子”也能坐高铁了 12306推出“宠物托运”功能
- 亚马逊云科技一站式数据和AI开发环境Amazon SageMaker Unified Studio正式可用
- 2025款小鹏X9亮相:升级“过道版零重力座椅” 预售价39.98万元起
- Llama 4大模型跌落神坛:作弊刷榜、代码能力极差、和DeepSeek比就是伪开源
- 长城汽车官宣与宇树科技合作 首期围绕 “越野车 + 机器狗” 融合场景
- 比亚迪:预计2025年Q1归母净利润85亿元-100亿元,同比增长86.04%-118.88%
- 消息称保时捷与地平线合作研发智驾
- 宁德时代计划拿下蔚来能源控股权?官方回应了
- 网传小米SU7续保遇到被拒或保费上涨问题,小米公司回应
免责声明:本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,应及时向本网站提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明。本网站在收到上述法律文件后,将会依法尽快联系相关文章源头核实,沟通删除相关内容或断开相关链接。