于泽远:DeepSeek冲击波
于泽远|yuhs@sph.com.sg中国的科技成果既是强大工业制造能力的体现,也显示中国的人才培养和创业环境在不断改善。 延伸阅读 韩咏红:中国AI科学家的“深度探索” 中国官方据报在DeepSeek发布前造势 分析:难免成为对抗美国科技封锁工具 近几年来,中国科技在多个领域呈现爆发之势。从航天科技、电动汽车、核电技术、无人机到先进雷达、六代战机、大型战舰等军事装备,中国不时推出令人惊讶的新产品。这次DeepSeek带来的冲击,更直接让美国金融市场深受震撼。这些科技成果既是中国强大工业制造能力的体现,也显示中国的人才培养和创业环境在不断改善。 吴恩达认为,当ChatGPT在2022年11月发布时,美国在生成式AI领域明显领先于中国。但过去两年里,凭借Qwen和DeepSeek等来自中国的模型,中国显然一直在缩小差距,并且在视频生成等领域,中国似乎已经处于领先地位。“现在,开源/开源权重模型显然是AI供应链的关键组成部分,许多公司都将使用它们。如果美国继续阻碍开源,中国将主导AI供应链的这一环节。” 2月1日,美国晶片巨头英特尔表示,近日中国AI公司DeepSeek发布Janus Pro模型,其超强性能和高精度引起业界关注,英特尔Gaudi 2D AI加速器现已针对该模型进行深度优化,这使得AI开发者能够以更低成本、更高效率实现复杂任务的部署与优化。英特尔还称,DeepSeek-R1让轻量化模型本地部署更为简单,DeepSeek目前能够在英特尔产品上运行,更可以在AI电脑上实现离线使用。 DeepSeek带来的冲击波让美国AI巨头和资本市场有些手忙脚乱。此前,舆论普遍认为美国在AI领域远远领先中国,而且AI大模型需要的数据训练、算力和电力都十分昂贵,是富国才能玩得起的游戏,但DeepSeek横空出世在一定程度上打破了这些认知。 美国开放人工智能研究中心OpenAI首席执行官奥尔特曼(Sam Altman)1月31日在谈到DeepSeek时说:“这是一个非常好的模型。我们会发展出更好的模型,但我们将不如前几年,保持那么大的领先优势。”奥尔特曼认为,OpenAI也需要制定不同的开源策略。 DeepSeek由中国私募巨头幻方量化的老板梁文锋创办,公司员工不到140人,专注于开发大语言模型和相关技术。去年12月26日,DeepSeek上线DeepSeek-V3首个版本并同步开源,今年1月又发布了DeepSeek-R1等产品。由于DeepSeek产品仅用了几十分之一的成本就达到美国先进大模型的性能,并且以开源冲击美国ChatGPT等大模型的闭源,一时间DeepSeek成了全球许多AI开发者和用户的宠儿,下载量超过了ChatGPT等先进大模型。 经过一番折腾,美国科技巨头突然又纷纷拥抱起DeepSeek,令人颇感意外。…
