开云体育

DeepSe开云体育eK正实现Meta的目标V3开源升级接近Claude37水平

2025-03-25
浏览次数:
返回列表

  开云体育[永久网址:363050.com]成立于2022年在中国,是华人市场最大的线上娱乐服务供应商而且是亚洲最大的在线娱乐博彩公司之一。包括开云、开云棋牌、开云彩票、开云电竞、开云电子、全球各地赛事、动画直播、视频直播等服务。开云体育,开云体育官方,开云app下载,开云体育靠谱吗,开云官网,欢迎注册体验!

DeepSe开云体育eK正实现Meta的目标V3开源升级接近Claude37水平

  24日夜间,DeepSeek在用户群发出【通知】:DeepSeek V3 模型已完成小版本升级,欢迎前往官方网页、APP、小程序试用体验(关闭深度思考),API 接口和使用方式保持不变。

  不是R2的更新,最终发布的模型为DeepSeek-V3-0324,V3的小模型更新版。如果你开始觉得没什么,那可能结果还是要出乎你的预料。

  V3-0324最惊艳的两个特征,700GB,MIT 许可证。这意味着MaC部署优化以及开源。

  根据文档显示,V3重点提升了数学和编程能力。但最重要的是,能力接近Claude 3.7 Sonnet的模型,却无限制免费提供,对于经常被Claude封号的朋友们,是不是感动到想哭。

  而且Claude超高的价格(每月20美元),有X网友表示:这相当于白送法拉利。

  在了解新版本之前,我们再回顾下V3版本,就是R1之前那个,为DeepSeek立下汗马功劳的版本。

  新发布的V3-0324,在模型参数上略有放大,模型参数为 685B,但还没有上传 Model Card,模型基准能力测试方面也还没有更新。

  在其官网提问,回答是知识截止日期为 2024年7月,之前的DeepSeek-V3 应该是2023年12月。

  不仅是训练数据的更新,其中V3的文档重要变动,显示其优化了Function call。此前版本提示Function call会有调用问题,但目前已经支持调用函数。

  有国外网友评价,自 2024 年 6 月以来,没有一个LLM 能够像 Sonnet 3.5 一样,生成好的前端代码。今天,Deepseek 发布了V3 的更新,终于让Anthropic有了竞争对手。

  在官网关闭深度思考按钮,就能体验V3新版的能力。更强的前端编程能力,接近Claude 3.7 sonnet,更精准的上下文理解能力。

  它还设置了动态产品卡片悬停效果,以及支持手机端的动态响应式布局,甚至能直接采购了。

  对于其数学能力,鲸哥也是找了一个年初大模型都还在做错的小学生数学题。V3-0324直接回答对了。

  V3不是R2,确实是各方面升级后更水桶,不是某一方面能力突出的惊艳。胜在开源好用,API价格大家都能接受,官网则对C端用户免费。

  毕竟MIT 许可证意味着任何人都可以出于任何目的使用、修改和分发它,甚至是商业目的。

  大家很少将这种尺寸的模型直接全部开源。所以在最近,Perplexity CEO阿拉文德在接受专访时提到,“如果封闭模型没有保持领先,而每个人都可以微调开源模型,那么他们(OpenAI等)每次要求筹集100亿美元或甚至1000亿美元的合理性,就会变得越来越危险。

  我认为DeepSeek时刻是真正具有革命性的。他们是否只花了600万美元来训练那个模型还有待商榷,但他们肯定没有花费相同数量级的资金,并且他们制作了一个令人印象深刻的模型,不仅提供了与最佳封闭模型相媲美的出色输出,还提供了透明的推理链。”

  他认为,关键点是DeepSeek出现后,AI巨头以后很难拿到巨额融资了。他又提到DeepSeek对于创业企业意味着什么:

  “也许你可以非常有效地将所有模型中最大的模型提炼成更小的模型,而这才是最终在生产中使用的模型。如果该模型是开源的,或者可以通过API以可承受的价格获得。

  事实上,DeepSeek已经可以在AWS和Azure上以几乎零的边际成本提供,你只需要支付服务器费用。”

  也正如这次V3升级版发布,国外有网友提到:DeepSeek正在实现Meta承诺做到的事。

  与此同时,今天还有一个重要消息值得在本文一提,蚂蚁集团用国产芯片训练AI模型,使用了包括来自阿里巴巴和华为的芯片,开发成本降低高达 20%。

  本文为澎湃号作者或机构在澎湃新闻上传并发布,仅代表该作者或机构观点,不代表澎湃新闻的观点或立场,澎湃新闻仅提供信息发布平台。申请澎湃号请用电脑访问。

搜索