中国科技巨企字节跳动旗下的豆包大模型团队开源优化技术,令其训练成本节约四成。这一技术已在字节跳动的万卡集群训练中得到实际应用。内部数据显示,自采用该技术以来,已累计节省了数百万GPU(图形处理器)小时的训练算力。
日本新创企业Mujin公司因开发出不需要漫长时间学习的智慧机器人,能降低制造、物流等行业工厂自动化的门坎,受到全球瞩目,预料将成为独角兽企业。日本机器人产业举世闻名,发那科、安川电机等企业大家都耳熟能详,不过近来有一家机器人新创企业迅速崛起,就是Mujin(日文「无人」之意)公司。
在 3 月 3 日拉开帷幕的 2025 世界移动通信大会(MWC 2025)上,全球首款端侧部署 DeepSeek 70 亿参数大模型的 AI PC 正式在海外亮相,吸引了广泛围观。据介绍,联想已经成为全球首家在 AI PC 端侧部署和运行 DeepSeek 大模型的 AI 终端品牌。端侧部署 DeepSeek 大模型,使联想 AI PC 的能力又一次获得大幅提升。
深圳市官方发布通知,到2026年深圳市人工智能(AI)终端产业核心竞争力进一步增强,全市AI终端产业规模达8000亿元以上、力争1万亿元,集聚不少于10家现象级AI终端企业,AI终端产品产量突破1亿5000万台,在手机、计算机、大模型一体机、可穿戴设备等领域推出50款以上爆款AI终端产品,在智能制造、智慧金融、智慧城市、智慧养老、智慧政务等领域打造60个以上AI终端典型应用场景。
中国各领域企业掀起接入深度求索(DeepSeek)模型的热潮后,市场对美国人工智能(AI)巨头英伟达晶片的需求水涨船高。H20是英伟达为规避美国技术限制,于2023年10月面向中国市场推出的降级版晶片。H20的算力只有英伟达最先进晶片H100的不到15%,却是中国客户能在合法渠道上买到可用于模型训练的最先进晶片。
中国科技巨头腾讯发布一款快思考模型,并称其输出答案的速度比深度求索(DeepSeek)的R1模型快。腾讯混元团队介绍,区别于DeepSeek-R1、混元T1等需要“想一下再回答”的慢思考模型,混元Turbo S能够实现“秒回”,更快速输出答案,吐字速度提升一倍,首字时延降低44%。
全国多地正在探索DeepSeek的应用场景。广东梅州市政务服务和数据管理局2月22日发文介绍,21日,梅州市12345政务服务便民热线正式接入DeepSeek大模型。借助DeepSeek技术,梅州12345热线应用系统能够实现四大功能,即进行智慧文本机器人应答、智慧辅助填单、智慧工单分类、智慧工单转派,确保热线打得进、接得好、能转办,实现市民诉求「接得更快、分得更准、办得更实」的目标。
深圳市福田区推出基于DeepSeek开发的人工智能(AI)数智员工,首批共70名,辅助开展公共管理和服务。官方强调,这些AI助手并不能单独决策。福田区的这批智慧政务“数智员工”覆盖政务服务全链条,包括公文处理、民生服务、应急管理 、招商引资等,可满足240个业务场景使用。
中国人工智能公司深度求索(DeepSeek)有望显著降低中国企业发展大模型的硬件门槛,中国券商看好阿里巴巴和腾讯等成为中国科技股“七巨头”。展望未来,DeepSeek的突破性成果打破了过去两年美国在前沿大模型的主导地位,有望显著降低中国企业发展大模型的硬件门槛,推动包括算力晶片、云服务、端侧智能和企业对企业、对客户应用在内的中国科技产业链进入新一轮创新周期。
在人工智能(AI)研究方面引领世界的美国在技术和产品开发方面正在加深与中国的对立,但是实际上支撑美国研究能力的「幕后英雄」就是中国人。美国智库的分析显示,在美国企业和研究机构任职的杰出AI研究人员中,中国的大学毕业生占约40%,比例超过美国大学毕业生,这些来自中国的AI研究人才,构筑了美国AI产业的主力。
在中国人工智能(AI)初创企业深度求索(DeepSeek)震撼全球后,其他以发布低成本、高性能生成式的AI企业实力也正在逐步壮大,多款中国AI大语言模型开发商─包括月之暗面(Moonshot AI)开发的Kimi k1.5─也陆续登场。原先由美国初创企业为中心的AI性能竞争赛场迎来美中对抗的全新局面。
上海官方通报,上海人工智能(AI)产业规模突破4000亿元人民币,同比增长超过7%。上海市经济和信息化委员会副主任张宏韬星期五(2月7日)在2025全球开发者先锋大会新闻发布会上表示,截至去年底,上海已有约60款大模型通过相关部门备案,数量位居中国第二。
近期中国AI技术厂商DeepSeek的AI大模型持续火爆,全球云服务及芯片等众多的科技大厂也从一开始的不敢相信、质疑到认可之后,纷纷下场对DeepSeek模型进行支持。
中国新创公司DeepSeek推出低成本高效率的AI开源模型震撼全球,被看好改写人工智能产业的趋势,欧洲科技公司则将DeepSeek视为迎头赶上的机会,冀望拉近与美国科技巨头的差距。尽管市场对DeepSeek仍有许多质疑,包括违规取得英伟达人工智能芯片,以及抄袭运算技术与数据库等,但不可否认的是DeepSeek确实透过相对低很多的成本,达成媲美科技巨头的成就。
最近上线的中国AI软件DeepSeek引发业界震撼,开发商声称建构DeepSeek的基础成本很低,仅是OpenAI的零头,最广为流传的说法之一,是DeepSeek V3的训练成本约为600万美元。不过这个说法被半导业行业研究公司SemiAnalysis质疑,他们认为DeepSeek的成本应该至少13亿美元。
美国虽对中国设下严格的半导体制裁措施,但无法阻止中国发展人工智能技术,经济学人指出,美国面临极大压力,必须采取更积极的应对措施,其中一项是考虑放弃出口管制措施,才能长久维持领先优势。从华为在全面封锁下还能生产5G旗舰型智能手机,到新创公司DeepSeek推出性价比高的AI模型,屡屡证明美国的出口管制措施存在漏洞,严格措施只能拖慢中国发展,无法完全遏止。
阿里云星期三(1月29日)凌晨在微信公众号宣布,Qwen2.5-Max全新升级发布,并说新模型展现出极强劲的综合性能,在多项公开主流模型评测基准上录得高分,全面超越了目前全球领先的开源混合专家(MoE)模型以及最大的开源稠密模型。
中国初创企业深度求索公布低成本大模型后,除夕当天(1月28日)再发布开源文字生成图像(文生图)大模型Janus-Pro 7B,该模型在基准测试中超越美国巨头OpenAI。
国际会展网