DeepSeek的注意力机制算子负责人刘胜与最近发表了一篇名为《我不得不把才华埋葬在昨天》的文章,引发了广泛的讨论和关注。有评论指出,“以DeepSeek为代表的国产大模型开始向Anthropic发起反击,这次出手的不是公关部,而是一位实际参与开发的工程师。”另有观点认为:“在一位亲历技术进步的开发者眼中,他思考的不是如何保住自己的职位,而是如何将火种传递出去。这种对技术的浪漫追求,才是真正值得敬畏的。”此前,Anthropic发布了一份针对DeepSeek等多家国产模型的批评报告,其指责的方式包括直接引用客户的数据进行分析,这一行为引起了行业的普遍警觉。消息还透露,英伟达、帕兰提尔等合作方已经开始限制对Anthropic的Claude模型的使用。
刘胜与在文章中表达了顶尖开发者的困境:他们所编写的高性能代码正在推动人工智能的革新,但仅在未来一年之内,这些自己悉心培育的系统就将在基础算法设计上全面超越他们。刘胜与以极具想象力的比喻说明这种不安:如果你是一位擅长手工编织毛衣的匠人,虽然人们纷纷请你定制,但当一台机器能够在更短的时间内以更高的精度完成相同的工作时,你的心境必然会产生变化。尽管你明白自己可以驾驭这台机器,仍无法避免那种手工创作的优雅与宁静被无情的机械噪音所淹没。
与此同时,算子工程师们在追求极致代码的过程中,尽管意识到新技术将会取代他们的工作,仍然坚守自己的岗位。他们继续优化算子,一方面因运算极限带来的成就感无法抗拒,另一方面,在全球科技竞争的激烈环境中,选择停滞不前是毫无意义的。即使自己放慢脚步,其他实验室也在迅速发展,最终可能会将他们取代。在这样一个技术更新换代迅速的时代,工程师们必须从传统的微观编码者转变为智能体的操控者,以更好地适应新型生产模式。
与此同时,全球工业界也在经历一场关于控制权的根本性震荡。如来自《The Information》的调查所示,英伟达和帕兰提尔等公司正在逐步收紧对Anthropic旗下Claude系列模型的使用权限。这一变动与Anthropic在新版本模型中采用的存储用户交互数据长达30天的做法有关。虽然这种策略在安全性上似乎是合理的,但也引发了外界对数据使用与管理的深层次担忧。