近日,国产AI DeepSeek在中国、美国的科技圈受到广泛关注,甚至被认为是大模型行业的最大“黑马”,在外网,DeepSeek被不少人称为“神秘的东方力量”。
1月27日,DeepSeek应用登顶苹果中国地区和美国地区应用商店免费App下载排行榜,在美区下载榜上超越了ChatGPT。
苹果美国区应用商店
苹果AppStore中国区免费榜
DeepSeek是啥?
DeepSeek,全称杭州深度求索人工智能基础技术研究有限公司,成立于2023年7月17日,是一家创新型科技公司,专注于开发先进的大语言模型(LLM)和相关技术。
近日,DeepSeek发布推理模型R1,在性能逼近OpenAI o1正式版的同时,推理成本却仅为后者的几十分之一。
纽约时报称,DeepSeek大模型以极低成本(600万美元)和少量芯片(2000块)实现了与OpenAI等巨头相媲美的性能,挑战了“唯有科技巨头才能研发尖端AI”的行业共识。
低成本实现高性能模型研发,对用户来说体验感也立竿见影——它功能强大,但却免费使用,并且DeepSeek还将代码面向开发者进行了开源。
据了解,DeepSeek R1没有使用业内普遍使用的监督微调(SFT)训练范式,而是直接通过强化学习让模型自主进化出复杂的推理能力,包括反思和长链思考等能力。这种方法不仅提高了训练效率,还减少了对昂贵计算资源的依赖。与OpenAI的o1相比,DeepSeek模型的百万token输入成本从15美元锐减到0.55美元,输出成本则从60美元降低到2美元。
有人提出,DeepSeek恰恰是美国对华进行芯片出口限制之下所激发出的创新。
1月26日,DeepSeek出现了短时闪崩现象。不少网友反映,使用时遇到 “服务器繁忙” 的提示。对此,DeepSeek回应称,当天下午确实出现了局部服务波动,但问题在数分钟内就得到了解决。此次事件可能是由于新模型发布后,用户访问量激增,服务器一时无法满足大量用户的并发需求。
团队不到140人
创始人来自湛江
据悉,DeepSeek创始人梁文锋来自广东省湛江市,本科、研究生毕业于浙江大学,拥有信息与电子工程学系本科和硕士学位。2008年起,他开始带领团队使用机器学习等技术探索全自动量化交易。2023年7月,DeepSeek正式成立,进军通用人工智能领域。
近日,梁文锋还现身《新闻联播》,以DeepSeek创始人的身份参加了一场座谈会,并现场发言。
梁文锋(左一)
在团队配置上,DeepSeek团队最大的特点是名校、年轻。不到140人的团队,工程师和研发人员几乎都来自清华大学、北京大学、中山大学、北京邮电大学等国内顶尖高校,工作时间都不长。
来源:澎湃新闻(记者 李潇潇 胡含嫣)、北京日报(记者 孙奇茹)、长安街知事、中国新闻社
新快报讯 3月1日晚,由中国音乐家协会、广东省文学艺术界联合会、中共中山市委宣传部主办,广东省音乐家协会、中山市文学艺术界联合会承办的唱响“一带一路”放歌伶仃洋——中国音协“金钟之星”艺术团赴中山慰问演出在 新快报讯 据中山纪检监察3月1日披露,中山翠亨新区党工委委员,南朗街道党工委副书记、办事处主任许行涉嫌严重违纪违法,目前正接受中山市纪委监委纪律审查和监察调查。 采写:新快报记者 李红云 新快报讯 3月1日零时,横琴粤澳深度合作区(以下简称“合作区”)货物“一线”放开、“二线”管住,人员进出高度便利分线管理封关运行正式实施,这是合作区实施高水平制度型开放的重大探索,将进一步丰富“一国两制”实践,有力推 COMEX 4月黄金期货在4日收涨1.31%,报2123美元/盎司,盘中最高曾一度触及2128.4美元。这是COMEX黄金期货合约史上首度收于2100美元上方。 与此同时,现货黄金价格也一举升至了2110美元上方,距离去年12月逾2140美元的高位已相 近日,河南一家公司董事长在接受媒体采访时透露,公司将对员工生育进行奖励,生二胎奖励3万,生三胎奖励10万。这一消息一经报道,立即引发了社会的热议。据悉,该公司的生育奖励政策自2022年1月1日开始实行,目前已有五六名符合条 AI技术持续迭代,各类大模型层出不穷,算力军备竞赛不止。近日,海外人工智能公司推出的大模型Claude3,能力对标GPT-4,在同期AI模型中处于领先水平,进一步带来了AI大模型领域技术层面的新突破。AI模型端的不断 。本文链接:超越ChatGPT,中国“神秘力量”火爆全球http://www.sushuapos.com/show-1-34240-0.html
声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。
上一篇: 巴黎又一古建遭火灾,三十米高钟楼被烧毁