📰36氪10,34136kr.com
沿用DeepSeek架构,美国大模型开始抄中国作业
首次上榜 2026-07-22
摘要
美国大模型开始借鉴DeepSeek的架构,标志着中国AI技术路线首次被海外主流团队效仿。DeepSeek通过稀疏注意力、MoE优化等创新,在保持性能的同时大幅降低训练成本。如今美国团队直接沿用其设计,说明中国在开源大模型领域的创新已获得国际认可,也意味着AI竞争从拼算力转向拼架构效率。
美国大模型开始借鉴DeepSeek的架构,标志着中国AI技术路线首次被海外主流团队效仿。DeepSeek通过稀疏注意力、MoE优化等创新,在保持性能的同时大幅降低训练成本。如今美国团队直接沿用其设计,说明中国在开源大模型领域的创新已获得国际认可,也意味着AI竞争从拼算力转向拼架构效率。