21世纪经济报道记者 袁思杰 香港报道
春节期间,一场“中国AI地震”席卷全球科技圈。
DeepSeek发布的全新人工智能模型 R1,引发了全球范围内的关注和讨论。作为一款主打低成本、高效率的AI语言模型,R1的性能在某些垂直领域已接近甚至媲美OpenAI的ChatGPT-4。更令人瞩目的是,DeepSeek宣称其模型训练成本仅为同类大模型的1/10。
R1发布后,美国科技股大幅波动:英伟达股价暴跌近17%,单日市值蒸发高达5888亿美元,创下美股史上单日市值蒸发新纪录。“木头姐”凯西·伍德也在公开访谈中坦言:“DeepSeek的低成本模式可能颠覆硅谷的算力霸权逻辑。”
同时,DeepSeek已展现出商业化势能:上线18天全球下载量突破1600万次,日活用户超2000万,推动亚马逊Bedrock、微软Azure和华为昇腾云争相接入其模型服务。
DeepSeek是怎样在算力不足的情况下实现低成本训练的?开源大模型的模式是否可以打破巨头垄断?低成本训练反而会引起算力需求激增吗?哪种AI商业化路径更具长期竞争力?AI浪潮下普通人如何自我提升?
围绕这些问题,三七二十一节目邀请到了豆神集团副总裁兼任CTO阎鹏、快思慢想研究院院长和原商汤智能产业研究院创始院长田丰,以及知名科技博主(海宁科技观)陈海宁,共同探讨这些话题!
Show Notes:
03:50 DeepSeek通过架构创新实现低成本训练
04:28 强化学习比重提升使DeepSeek大模型更强大
07:50 2025年是AI大模型的“成本年”
09:20 中国AI技术社区的发展需建立本土技术站
10:00 DeepSeek的成功让资本重新重视开源模型的潜力
12:03 开源模型在企业应用中有技术门槛
14:04 DeepSeek坚持开源策略旨在建立中国AGI技术社区和创新技术站、减少对美国的依赖
16:38 AI大模型开源的好处在于共享成果和共建提升
21:55 随着算力需求持续增长和成本降低,大模型应用和服务普及是必然过程
23:02 AI发展对算力需求只会加速
24:10 “DeepSeek时刻”让AI迈向通用化技术时代
25:52 “成本拐点”:市场规模和产品成本成反比
29:25 AI浪潮已改变普通人的工作和生活
30:30 应尽早使用AI工具提高效率,同时提高数字化教育程度
33:17 AI普及将如智能手机般融入生活,带来商业机会
37:56 进行AI技能学习,建议打基础、学习思维方法以应对AI浪潮
43:31 教育和医疗可能成为AI应用最早爆发领域,服务业可实现规模化和高质量发展
48:03 AI将在互联网、软件、服务业和硬件四方向推进商业化,科研是关键
据法新社巴黎3月15日报道,15日发布的一项新的重要分析称,影响神经系统的疾病——如中风、偏头痛和痴呆症——已经超过心脏病,成为全球范围内导致人们健康损害的主要原因。 随着量子技术的发展,利用量子特性突破传统测量技术极限的新一代精密测量技术——量子测量开始得到应用。记者从中国计量科学研究院获悉,由该院牵头编制的《量子测量术语》《量子精密 中国气象局下一代大气数值模式日前发布。该模式采用完全自主的动力框架算法——多矩约束有限体积方法为基础算法,进一步提升全球公里级和区域百米级尺度数值预报的精度,显著减小全球 有消息称,iPhone在中国寻找本土生成式AI提供方,iPhone讨论了在中国的设备中使用百度的人工智能技术。据《华尔街日报》报道,iPhone与百度进行了谈判,以授权其型号。这可能是为了向中国的iPhone客户提 中新经纬3月22日电 据《日本经济新闻》22日报道,夏普正在讨论缩小液晶显示器业务,夏普已将子公司显示器(SDP、位于市)停产纳入视野。显示器业务持续陷入苦战,成为夏普在2022财年(截至2023年3月)时隔5年陷入最终亏损 3月23日20时30分许,内蒙古自治区鄂尔多斯市,约200米的高楼、磐石造型博物馆、书籍外形图书馆等主要地标建筑纷纷关闭灯光,人们在静下来的城市里感受地球的呼吸与脉动。今年“地球一小时”中国 。本文链接:三七二十一|中国AI的“斯普特尼克时刻”:DeepSeek的崛起与启示http://www.sushuapos.com/show-2-10918-0.html
声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。
上一篇: 外卖骑手上社保:“我可以干到退休了!”