跳至主要内容

揭秘DeepSeek:一个更极致的中国技术理想主义故事

 

做贡献者,而非搭便车者。

文 | 于丽丽
编辑 | 刘旌

中国的7家大模型创业公司中,DeepSeek(深度求索)最不声不响,但它又总能以出其不意的方式被人记住。

一年前,这种出其不意源自它背后的量化私募巨头幻方,是大厂外唯一一家储备万张A100芯片的公司,一年后,则来自它才是引发中国大模型价格战的源头。

在被AI连续轰炸的5月,DeepSeek一跃成名。起因是他们发布的一款名为DeepSeek V2的开源模型,提供了一种史无前例的性价比:推理成本被降到每百万token仅 1块钱,约等于Llama3 70B的七分之一,GPT-4 Turbo的七十分之一。

DeepSeek被迅速冠以“AI界拼多多”之称的同时,字节、腾讯、百度、阿里等大厂也按耐不住,纷纷降价。中国大模型价格战由此一触即发。

弥漫的硝烟其实掩盖了一个事实:与很多大厂烧钱补贴不同,DeepSeek是有利润的。

这背后,是DeepSeek对模型架构进行了全方位创新。它提出的一种崭新的MLA(一种新的多头潜在注意力机制)架构,把显存占用降到了过去最常用的MHA架构的5%-13%,同时,它独创的DeepSeekMoESparse结构,也把计算量降到极致,所有这些最终促成了成本的下降。

在硅谷,DeepSeek被称作“来自东方的神秘力量”。SemiAnalysis首席分析师认为,DeepSeek V2论文“可能是今年最好的一篇”。OpenAI前员工Andrew Carr认为论文“充满惊人智慧”,并将其训练设置应用于自己的模型。而OpenAI前政策主管、Anthropic联合创始人Jack Clark认为,DeepSeek“雇佣了一批高深莫测的奇才”,还认为中国制造的大模型,“将和无人机、电动汽车一样,成为不容忽视的力量。”

在基本由硅谷牵动故事进展的AI浪潮里,这是罕有的情形。多位行业人士告诉我们,这种强烈的反响源自架构层面的创新,是国产大模型公司乃至全球开源基座大模型都很罕见的尝试。一位AI研究者表示,Attention架构提出多年来,几乎未被成功改过,更遑论大规模验证。“这甚至是一个做决策时就会被掐断的念头,因为大部分人都缺乏信心。”

而另一方面,国产大模型之前很少涉足架构层面的创新,也是因为很少有人主动去击破那样一种成见:美国更擅长从0-1的技术创新,而中国更擅长从1-10的应用创新。何况这种行为非常不划算——新一代模型,过几个月自然有人做出来,中国公司只要跟随、做好应用即可。对模型结构进行创新,意味着没有路径可依,要经历很多失败,时间、经济成本都耗费巨大。

DeepSeek显然是逆行者。在一片认为大模型技术必然趋同,follow是更聪明捷径的喧哗声中,DeepSeek看重“弯路”中积累的价值,并认为中国的大模型创业者除应用创新外,也可以加入到全球技术创新的洪流中。

DeepSeek的很多抉择都与众不同。截至目前,7家中国大模型创业公司中,它是唯一一家放弃“既要又要”路线,至今专注在研究和技术,未做toC应用的公司,也是唯一一家未全面考虑商业化,坚定选择开源路线甚至都没融过资的公司。这些使得它经常被遗忘在牌桌之外,但在另一端,它又经常在社区被用户“自来水”式传播。

DeepSeek究竟是如何炼成的?我们为此访谈了甚少露面的DeepSeek创始人梁文锋。

这位从幻方时代,就在幕后潜心研究技术的80后创始人,在DeepSeek时代,依旧延续着他的低调作风,和所有研究员一样,每天“看论文,写代码,参与小组讨论”。

和很多量化基金创始人都有过海外对冲基金履历,多出身物理、数学等专业不同的是,梁文锋一直是本土背景,早年就读的也是浙江大学电子工程系人工智能方向。

多位行业人士和DeepSeek研究员告诉我们,梁文锋是当下中国AI界非常罕见的“兼具强大的infra工程能力和模型研究能力,又能调动资源”、“既可以从高处做精准判断,又可以在细节上强过一线研究员”的人,他拥有“令人恐怖的学习能力”,同时又“完全不像一个老板,而更像一个极客”。

这是一次尤为难得的访谈。访谈里,这位技术理想主义者,提供了目前中国科技界特别稀缺的一种声音:他是少有的把“是非观”置于“利害观”之前,并提醒我们看到时代惯性,把“原创式创新”提上日程的人。

一年前,DeepSeek刚下场时,我们初次访谈了梁文锋 :《疯狂的幻方:一家隐形AI巨头的大模型之路》 。如果说当时那句「务必要疯狂地怀抱雄心,且还要疯狂地真诚」还是一句美丽的口号,一年过去,它已经在成为一种行动。

以下为对话部分:

价格战第一枪是怎么打响的?

「暗涌」:DeepSeek V2模型发布后,迅速引发一场血雨腥风的大模型价格战,有人说你们是行业的一条鲶鱼。

梁文锋:我们不是有意成为一条鲶鱼,只是不小心成了一条鲶鱼。

「暗涌」:这个结果让你们意外吗?

梁文锋:非常意外。没想到价格让大家这么敏感。我们只是按照自己的步调来做事,然后核算成本定价。我们的原则是不贴钱,也不赚取暴利。这个价格也是在成本之上稍微有点利润。

「暗涌」:5天后智谱AI就跟进了,之后是字节、阿里、百度、腾讯等大厂。

梁文锋:智谱AI降的是一个入门级产品,和我们同级别的模型仍然收费很贵。字节是真正第一个跟进的。旗舰模型降到和我们一样的价格,然后触发了其它大厂纷纷降价。因为大厂的模型成本比我们高很多,所以我们没想到会有人亏钱做这件事,最后就变成了互联网时代的烧钱补贴的逻辑。

「暗涌」:外部看来,降价很像在抢用户,互联网时代的价格战通常如此。

梁文锋:抢用户并不是我们的主要目的。我们降价一方面是因为我们在探索下一代模型的结构中,成本先降下来了,另一方面也觉得无论API,还是AI,都应该是普惠的、人人可以用得起的东西。

「暗涌」:在这之前,大部分中国公司都会直接copy这一代的 Llama结构去做应用,为什么你们会从模型结构切入?

梁文锋:如果目标是做应用,那沿用 Llama结构,短平快上产品也是合理选择。但我们目的地是AGI,这意味着我们需要研究新的模型结构,在有限资源下,实现更强的模型能力。这是scale up到更大模型所需要做的基础研究之一。除了模型结构,我们还做了大量其他的研究,包括怎么构造数据,如何让模型更像人类等,这都体现在我们发布的模型里。另外,Llama的结构,在训练效率和推理成本上,和国外先进水平估计也已有两代差距。

「暗涌」:这种代差主要来自哪里?

梁文锋:首先训练效率有差距。我们估计,国内最好的水平和国外最好的相比,模型结构和训练动力学上可能有一倍的差距,光这一点我们要消耗两倍的算力才能达到同样效果。另外数据效率上可能也有一倍差距,也就是我们要消耗两倍的训练数据和算力,才能达到同样的效果。合起来就要多消耗4倍算力。我们要做的,正是不停地去缩小这些差距。

「暗涌」:大部分中国公司都选择既要模型又要应用,为什么DeepSeek目前选择只做研究探索?

梁文锋:因为我们觉得现在最重要的是参与到全球创新的浪潮里去。过去很多年,中国公司习惯了别人做技术创新,我们拿过来做应用变现,但这并非是一种理所当然。这一波浪潮里,我们的出发点,就不是趁机赚一笔,而是走到技术的前沿,去推动整个生态发展。

「暗涌」:互联网和移动互联网时代留给大部分人的惯性认知是,美国擅长搞技术创新,中国更擅长做应用。

梁文锋:我们认为随着经济发展,中国也要逐步成为贡献者,而不是一直搭便车。过去三十多年IT浪潮里,我们基本没有参与到真正的技术创新里。我们已经习惯摩尔定律从天而降,躺在家里18个月就会出来更好的硬件和软件。Scaling Law也在被如此对待。

但其实,这是西方主导的技术社区一代代孜孜不倦创造出来的,只因为之前我们没有参与这个过程,以至于忽视了它的存在。

真正的差距不是一年或两年,而是原创和模仿之差

「暗涌」:为什么DeepSeek V2会让硅谷的很多人惊讶?

梁文锋:在美国每天发生的大量创新里,这是非常普通的一个。他们之所以惊讶,是因为这是一个中国公司,在以创新贡献者的身份,加入到他们游戏里去。毕竟大部分中国公司习惯follow,而不是创新。

「暗涌」:但这种选择放在中国语境里,也过于奢侈。大模型是一个重投入游戏,不是所有公司都有资本只去研究创新,而不是先考虑商业化。

梁文锋:创新的成本肯定不低,过去那种拿来主义的惯性也和过去的国情有关。但现在,你看无论中国的经济体量,还是字节、腾讯这些大厂的利润,放在全球都不低。我们创新缺的肯定不是资本,而是缺乏信心以及不知道怎么组织高密度的人才实现有效的创新。

「暗涌」:为什么中国公司——包括不缺钱的大厂,这么容易把快速商业化当第一要义?

梁文锋:过去三十年,我们都只强调赚钱,对创新是忽视的。创新不完全是商业驱动的,还需要好奇心和创造欲。我们只是被过去那种惯性束缚了,但它也是阶段性的。

「暗涌」:但你们究竟是一个商业组织,而非一个公益科研机构,选择创新,又通过开源分享出去,那要在哪里形成护城河?像5月这次MLA架构的创新,也会很快被其他家copy吧?

梁文锋:在颠覆性的技术面前,闭源形成的护城河是短暂的。即使OpenAI闭源,也无法阻止被别人赶超。所以我们把价值沉淀在团队上,我们的同事在这个过程中得到成长,积累很多know-how,形成可以创新的组织和文化,就是我们的护城河。

开源,发论文,其实并没有失去什么。对于技术人员来说,被follow是很有成就感的事。其实,开源更像一个文化行为,而非商业行为。给予其实是一种额外的荣誉。一个公司这么做也会有文化的吸引力。

「暗涌」:你怎么看类似朱啸虎的这种市场信仰派观点?

梁文锋:朱啸虎是自洽的,但他的打法更适合快速赚钱的公司,而你看美国最赚钱的公司,都是厚积薄发的高科技公司。

「暗涌」:但做大模型,单纯的技术领先也很难形成绝对优势,你们赌的那个更大的东西是什么?

梁文锋我们看到的是中国AI不可能永远处在跟随的位置。我们经常说中国AI和美国有一两年差距,但真实的gap是原创和模仿之差。如果这个不改变,中国永远只能是追随者,所以有些探索也是逃不掉的。

英伟达的领先,不只是一个公司的努力,而是整个西方技术社区和产业共同努力的结果。他们能看到下一代的技术趋势,手里有路线图。中国AI的发展,同样需要这样的生态。很多国产芯片发展不起来,也是因为缺乏配套的技术社区,只有第二手消息,所以中国必然需要有人站到技术的前沿。

更多的投入并不一定产生更多的创新

「暗涌」:现在的DeepSeek有一种OpenAI早期的理想主义气质,也是开源的。后边你们会选择闭源吗?OpenAI和Mistral都有过从开源到闭源的过程。

梁文锋:我们不会闭源。我们认为先有一个强大的技术生态更重要。

「暗涌」:你们有融资计划吗?看有媒体报道,幻方对DeepSeek有独立拆分上市的计划,硅谷的AI创业公司,最终也都难免要和大厂绑定。

梁文锋:短期内没有融资计划,我们面临的问题从来不是钱,而是高端芯片被禁运。

「暗涌」:很多人认为,做AGI和做量化是完全不同的两件事,量化可以闷声去做,但AGI可能更需要高举高打,需要结盟,这样可以让你的投入变大。

梁文锋:更多的投入并不一定产生更多的创新。否则大厂可以把所有的创新包揽了。

「暗涌」:你们现在不做应用,是因为你们没有运营的基因吗?

梁文锋:我们认为当前阶段是技术创新的爆发期,而不是应用的爆发期。长远来说,我们希望形成一种生态,就是业界直接使用我们的技术和产出,我们只负责基础模型和前沿的创新,然后其它公司在DeepSeek 的基础上构建toB、toC的业务。如果能形成完整的产业上下游,我们就没必要自己做应用。当然,如果需要,我们做应用也没障碍,但研究和技术创新永远是我们第一优先级。

「暗涌」:但选择API的话,为什么选择DeepSeek,而不是大厂?

梁文锋:未来的世界很可能是专业化分工的,基础大模型需要持续创新,大厂有它的能力边界,并不一定适合。

「暗涌」:但技术真的可以拉开差距吗?你也说过并不存在绝对的技术秘密。

梁文锋:技术没有秘密,但重置需要时间和成本。英伟达的显卡,理论上没有任何技术秘密,很容易复制,但重新组织团队以及追赶下一代技术都需要时间,所以实际的护城河还是很宽。

「暗涌」:你们降价后,字节率先跟进,说明他们还是感受到某种威胁。你怎么看创业公司与大厂竞争的新解法?

梁文锋:说实话我们不太care这件事,只是顺便做了这件事。提供云服务不是我们的主要目标。我们的目标还是去实现AGI。

目前没有看到什么新解法,但大厂也没有明显占优。大厂有现成的用户,但它的现金流业务也是它的包袱,也会让它成为随时被颠覆的对象。

「暗涌」:你怎么看DeepSeek之外的6家大模型创业公司的终局?

梁文锋:可能活下来2到3家。现在都还处在烧钱阶段,所以那些自我定位清晰、更能精细化运营的,更有机会活下来。其它公司可能会脱胎换骨。有价值的东西不会烟消云散,但会换一种方式。

「暗涌」:幻方时代,面对竞争的姿态就被评价为“我行我素”,很少在意横向比较。关于竞争,你思考的原点是什么?

梁文锋:我经常思考的是,一个东西能不能让社会的运行效率变高,以及你能否在它的产业分工链条上找到擅长的位置。只要终局是让社会效率更高,就是成立的。中间很多都是阶段性的,过度关注必然眼花缭乱。

一群做“高深莫测”事的年轻人

「暗涌」:OpenAI前政策主管、Anthropic联合创始人Jack Clark认为DeepSeek雇佣了“一批高深莫测的奇才”,做出DeepSeek v2的是怎样一群人?

梁文锋:并没有什么高深莫测的奇才,都是一些Top高校的应届毕业生、没毕业的博四、博五实习生,还有一些毕业才几年的年轻人。

「暗涌」:很多大模型公司都执着地去海外挖人,很多人觉得这个领域前50名的顶尖人才可能都不在中国的公司,你们的人都来自哪里?

梁文锋:V2模型没有海外回来的人,都是本土的。前50名顶尖人才可能不在中国,但也许我们能自己打造这样的人。

「暗涌」:这次MLA创新是如何发生的?听说idea最早来自一个年轻研究员的个人兴趣?

梁文锋:在总结出Attention架构的一些主流变迁规律后,他突发奇想去设计一个替代方案。不过从想法到落地,中间是一个漫长的过程。我们为此组了一个team,花了几个月时间才跑通。

「暗涌」:这种发散性灵感的诞生和你们完全创新型组织的架构很有关系。幻方时代,你们就很少自上而下地指派目标或任务。但AGI这种充满不确定性的前沿探索,是否多了管理动作?

梁文锋:DeepSeek也全是自下而上。而且我们一般不前置分工,而是自然分工。每个人有自己独特的成长经历,都是自带想法的,不需要push他。探索过程中,他遇到问题,自己就会拉人讨论。不过当一个idea显示出潜力,我们也会自上而下地去调配资源。

「暗涌」:听说DeepSeek对于卡和人的调集非常灵活。

梁文锋:我们每个人对于卡和人的调动是不设上限的。如果有想法,每个人随时可以调用训练集群的卡无需审批。同时因为不存在层级和跨部门,也可以灵活调用所有人,只要对方也有兴趣。

「暗涌」:一种松散的管理方式也取决于你们筛选到了一批强热爱驱动的人。听说你们很擅长从细节招人, 可以让一些非传统评价指标里优秀的人被选出来。

梁文锋:我们选人的标准一直都是热爱和好奇心,所以很多人会有一些奇特的经历,很有意思。很多人对做研究的渴望,远超对钱的在意。

「暗涌」: transformer诞生在谷歌的AI Lab,ChatGPT诞生在OpenAI,你觉得大公司的AILab 和一个创业公司对于创新产生的价值有什么不同?

梁文锋:不管是Google实验室,还是OpenAI,甚至中国大厂的AI Lab,都很有价值的。最后是OpenAI做出来,也有历史的偶然性。

「暗涌」:创新很大程度也是一种偶然吗?我看你们办公区中间那排会议室左右两侧都设置了可以随意推开的门。你们同事说,这就是给偶然留出空隙。transfomer诞生中就发生过那种偶然经过的人听到后加入,最终把它变成一个通用框架的故事。

梁文锋:我觉得创新首先是一个信念问题。为什么硅谷那么有创新精神?首先是敢。Chatgpt出来时,整个国内对做前沿创新都缺乏信心,从投资人到大厂,都觉得差距太大了,还是做应用吧。但创新首先需要自信。这种信心通常在年轻人身上更明显。

「暗涌」:但你们不参与融资,很少对外发声,社会声量上肯定不如那些融资活跃的公司,怎么确保DeepSeek就是做大模型的人的首选?

梁文锋:因为我们在做最难的事。对顶级人才吸引最大的,肯定是去解决世界上最难的问题。其实,顶尖人才在中国是被低估的。因为整个社会层面的硬核创新太少了,使得他们没有机会被识别出来。我们在做最难的事,对他们就是有吸引力的。

「暗涌」:前一段OpenAI的发布并没有等来GPT5,很多人觉得这是技术曲线明显在放缓,也很多人开始质疑Scaling Law,你们怎么看?

梁文锋:我们偏乐观,整个行业看起来都符合预期。OpenAI也不是神,不可能一直冲在前面。

「暗涌」:你觉得AGI还要多久实现,发布DeepSeek V2前,你们发布过代码生成和数学的模型,也从dense模型切换到了MOE,所以你们的AGI路线图有哪些坐标?

梁文锋:可能是2年、5年或者10年,总之会在我们有生之年实现。至于路线图,即使在我们公司内部,也没有统一意见。但我们确实押注了三个方向。一是数学和代码,二是多模态,三是自然语言本身。数学和代码是AGI天然的试验场,有点像围棋,是一个封闭的、可验证的系统,有可能通过自我学习就能实现很高的智能。另一方面,可能多模态、参与到人类的真实世界里学习,对AGI也是必要的。我们对一切可能性都保持开放。

「暗涌」:你觉得大模型终局是什么样态?

梁文锋:会有专门公司提供基础模型和基础服务,会有很长链条的专业分工。更多人在之上去满足整个社会多样化的需求。

所有的套路都是上一代的产物

「暗涌」:过去这一年,中国的大模型创业还是有很多变化的,比如去年开头还很活跃的王慧文中场退出了,后来加入的公司也开始呈现出差异化。

梁文锋:王慧文自己承担了所有的损失,让其他人全身而退。他做了一个对自己最不利,但对大家都好的选择,所以他做人是很厚道的,这点我很佩服。

「暗涌」:现在你的精力最多放在哪里?

梁文锋:主要的精力在研究下一代的大模型。还有很多未解决的问题。

「暗涌」:其他几家大模型创业公司都是坚持既要又要,毕竟技术不会带来永久领先,抓住时间窗口把技术优势落到产品也很重要,DeepSeek敢于专注在模型研究上是因为模型能力还不够吗?

梁文锋:所有的套路都是上一代的产物,未来不一定成立。拿互联网的商业逻辑去讨论未来AI的盈利模式,就像马化腾创业时,你去讨论通用电气和可口可乐一样。很可能是一种刻舟求剑。

「暗涌」:过去幻方就有很强的技术和创新基因,成长也比较顺利,这是你偏乐观的原因吗?

梁文锋:幻方某种程度上增强了我们对技术驱动型创新的信心,但也不都是坦途。我们经历了一个漫长的积累过程。外部看到的是幻方2015年后的部分,但其实我们做了16年。

「暗涌」:回到关于原创式创新的话题。现在经济开始进入下行,资本也进入冷周期,所以它对原创式创新是否会带来更多抑制?

梁文锋:我倒觉得未必。中国产业结构的调整,会更依赖硬核技术的创新。当很多人发现过去赚快钱很可能来自时代运气,就会更愿意俯身去做真正的创新。

「暗涌」:所以你对这件事也是乐观的?

梁文锋:我是八十年代在广东一个五线城市长大的。我的父亲是小学老师,九十年代,广东赚钱机会很多,当时有不少家长到我家里来,基本就是家长觉得读书没用。但现在回去看,观念都变了。因为钱不好赚了,连开出租车的机会可能都没了。一代人的时间就变了。

以后硬核创新会越来越多。现在可能还不容易被理解,是因为整个社会群体需要被事实教育。当这个社会让硬核创新的人功成名就,群体性想法就会改变。我们只是还需要一堆事实和一个过程。

评论

此博客中的热门博文

2026年中央一号文件(全文)

                                                                         中共中央 国务院 关于锚定农业农村现代化 扎实推进乡村全面振兴的意见 (2026年1月3日) 农业农村现代化关系中国式现代化全局和成色。“十四五”时期,农业综合生产能力迈上新台阶,脱贫攻坚成果巩固拓展,农民生活水平显著提高,乡村全面振兴取得明显进展。“十五五”时期是基本实现社会主义现代化夯实基础、全面发力的关键时期,要加快补上农业农村领域突出短板,加快建设农业强国。2026年是“十五五”开局之年,做好“三农”工作至关重要。要坚持以习近平新时代中国特色社会主义思想为指导,深入贯彻党的二十大和二十届历次全会精神,认真落实四中全会部署,全面贯彻习近平总书记关于“三农”工作的重要论述和重要指示精神,坚持把解决好“三农”问题作为全党工作重中之重,坚持和加强党对“三农”工作的全面领导,完整准确全面贯彻新发展理念,坚持稳中求进工作总基调,坚持农业农村优先发展,坚持城乡融合发展,锚定农业农村现代化,以推进乡村全面振兴为总抓手,以学习运用“千万工程”经验为引领,以改革创新为根本动力,提高强农惠农富农政策效能,守牢国家粮食安全底线,持续巩固拓展脱贫攻坚成果,提升乡村产业发展水平、乡村建设水平、乡村治理水平,努力把农业建成现代化大产业、使农村基本具备现代生活条件、让农民生活更加富裕美好,为推进中国式现代化提供基础支撑。 一、提升农业综合生产能力和质量效益 (一)稳定发展粮油生产。粮食产量稳定在1.4万亿斤左右。坚持产量产能、生产生态、增产增收一起抓,加力实施新一轮千亿斤粮食产能提升行动,促进良田良种良机良法集成增效,推进粮油作物大面积提单产。因地制宜优化农业生产结构和区域布局,推动粮食品种培优和品质提升,实施粮食流通提质增效项目,促进适销对路、优质优价。巩固提升大豆产能,做好产销衔接...

中国国家队计划在上半年减持90%的ETF股份

  据彭博行业研究分析,中国所谓的 “国家队” 在2026年上半年将其持有的追踪国内股票的交易所交易基金(ETF)的份额削减约90%。 分析发现,由中国主权财富基金旗下机构牵头的国有投资者集团已抛售约1700亿美元的2026年到期ETF,其中自4月初以来已抛售300亿美元。这波抛售潮表明,投资者仍在努力抑制市场泡沫,此举可能给沪深300 指数带来压力 。 彭博行业研究分析师Rebecca Sin 在一份报告中指出,中央汇金投资有限公司和其他国家队成员减持ETF持仓,从长远来看可能是一个利好因素,因为它降低了进一步抛售的可能性。 此次减持已将该集团在多只ETF中的持仓比例降至 20%以下 ,这意味着这些持仓不再需要披露。 阅读: 中国国家队退出ETF可能接近尾声,或将提振沪深300指数 分析师表示:“全面清算可能至少需要八周时间,但我们预计减持幅度将达到约90%,这将使他们的持股比例保持在披露门槛以下,这一点至关重要。他们不希望出现在上半年的股东名单中,因为大多数主权财富基金都不喜欢公开其投资活动。” 今年以来,沪深 300指数 累计上涨3.3%,而MSCI 亚太 指数则上涨了17%。与大盘走势平淡形成鲜明对比的是,科技股指数表现强劲,创业板指数在本月初创下历史新高。 国家队已大幅减持了部分国内规模最大的ETF基金。分析 发现 ,CSI 300指数基金是该队目前仍持有大量股份的唯一主要指数,这意味着其减持进程更为漫长。 国家队的销售被其他一些来源增加的购买所抵消。股市散户开户及 观点综述:中国社融已经下行压力犹存资金价格或从偏低位置温和放缓非银行金融机构 存款 增加 为大盘提供支撑。 根据彭博社的计算,上个月 海外投资者也是中国股票的净买家。 “尽管ETF出现赎回,但整体市场指标依然非常强劲,流动性并未受到显著影响,” 摩根大通驻上海中国股票策略师张艾琳表示 。“这是一个积极的信号,表明支撑市场韧性的正是内在的、自我维持的力量,即便一些投资者想要获利了结。”

中国月之暗面新模型加剧华尔街芯片股抛售

WSJ: 中国上周五出人意料地发布了一款突破性的人工智能(AI)模型,加剧了美国芯片股的抛售,引发了市场对AI领域竞争以及支撑AI建设的巨额企业支出的担忧。 这种焦虑情绪将费城半导体指数推入熊市区域,该指数成分股包括英伟达(Nvidia)、博通(Broadcom)和美光科技(Micron Technology)等行业重量级企业。该指数上周重挫10%,创下2025年4月以来最大单周跌幅。熊市的定义是从近期高点下跌20%或以上。 科技股引领了上周五的抛售,到后市尾段,抛售范围已扩大至标普500指数11个板块中的10个。该基准指数下跌1%,当日仅能源股走高,而科技股集中的纳斯达克综合指数下跌1.4%。 最新的导火索是中国的月之暗面(Moonshot AI),该公司上周五发布了其Kimi K3大语言模型。这家总部位于北京的初创公司声称,该模型优于一些尖端的美国系统,引发了一些分析师所称的“DeepSeek 2.0担忧”——指的是去年初震动全球市场的另一家中国AI初创公司。 “这令人担忧,”总统科学技术顾问委员会联合主席大卫·萨克斯(David Sacks)在社交媒体上谈到月之暗面领先美国顶级模型时写道。 月之暗面称其发布的Kimi K3是全球最大开源模型。在某些编码基准测试中,它超越了一些知名的美国同类产品,包括Anthropic的Opus 4.8和OpenAI的GPT 5.5。 编码能力被视为模型性能的基准,因为它们使许多AI系统能够接管计算机操作或自主完成耗时较长的任务。像Kimi K3这样所谓的开放权重模型可供用户免费下载,用户可以使用公司特定的数据对其进行定制,并大幅降低成本。 更便宜、可定制的模型的兴起威胁到了像Anthropic和OpenAI这样的前沿模型开发商,这些开发商对计算资源的需求支撑了大量资本支出,而这些支出帮助推动了美国经济。 随着开放模型开始能与开发专有系统的顶级AI初创公司的模型相抗衡,许多美国公司正转向更便宜的选项以控制AI成本。英伟达、法国的Mistral AI以及其他美国和欧洲公司也已开始开发开放权重模型。 处理AI查询的初创公司OpenRouter表示,在2025年秋季至2026年春季期间,在其支出最高的客户中,开放模型的使用量增长速度是专有模型的四倍。该公司还看到超过500家组织转向开放模型。“性价比实在好太多了,”代码安全公司Semg...

反内卷推动中国股市上涨

 彭博: 对于摩根大通和高盛集团的策略师以及香港和新加坡的基金经理来说,一个晦涩难懂的术语突然成为解读中国政策意图和引导股市的流行语。 “反 内卷 ”一词 在过去一年的政府文件中出现过,但在本月初国家领导人 主持召开 高层会议承诺规范“无序”价格竞争后,这一说法更加引人注目。“反过密化”指的是为根除中国工业弊病而采取的措施。中国工业弊病的特点是残酷的价格战和产能过剩,这些因素损害了太阳能、新能源汽车和钢铁等行业的盈利能力。 尽管北京方面尚未发布任何计划,但投资者仍对政府即将出台更协调一致的政策 应对措施 充满希望,以应对通货紧缩的驱动因素。市场上充斥着关于这一主题的分析师报告,而太阳能和钢铁股在7月份也出现上涨。摩根士丹利的策略师 上周将他们的投资偏好从香港股票  转向了在岸股票。 瑞银集团亚太区首席投资办公室主管陈敏兰 表示:“投资者在中国投资的最大问题之一是过度竞争。 政府自上而下地意识到了这一点,并直接表示必须停止破坏性竞争,这实际上是一个非常积极的进展。这是一个强有力的政策信号。” “反内卷化”成为中国最新流行语 资料来源:彭博社、360搜索引擎 汉语中“内卷”的字面意思是向内滚动。在实践中,它用来描述一种竞争激烈、却几乎没有产生任何实质性进展的体制。 巨额的产能建设支出帮助中国企业提升了全球地位。如今,中国企业已主导 太阳能 供应链的每一个环节,而其电动汽车制造商也已撼动了特斯拉的主导地位。然而,结束破坏性竞争从未像现在这样重要。生产者通货紧缩正在加剧,贸易紧张局势意味着中国无法再将部分过剩产能释放到其他国家。 加拿大皇家银行财富管理亚洲区高级投资策略师 Jasmine Duan 表示:“随着国外市场关闭中国的贸易路线,部分竞争被迫回归国内市场。” 中国太阳能亏损加剧 五大龙头企业一季度合计亏损逾80亿元 资料来源:公司文件、彭博计算 这一举措似乎有助于改善内地股市的投资者情绪。内地股市受政策驱动因素的影响更大,工业股的权重也更大。 7月份迄今,在岸沪深300 指数 已上涨2%,在全年大部分时间落后于 恒生中国企业指数后, 目前已跑赢该 指数。 太阳能股票 新疆大全新能源股份有限公司和通威股份本月股价上涨至少 19%。柳州钢铁股份有限公司股价飙升逾 50%,鞍钢股份股价上涨约 16%。玻璃、水泥和化工类股也出现上涨。 摩根大通中国及香港股...

2024 年全球最富有家族榜单

 BMG: 这栋位于西北第二街的朴素砖砌建筑丝毫没有显示出它所蕴藏的巨额财富。 该地产坐落在阿肯色州本顿维尔市中心,是沃尔顿企业的所在地,该企业是世界上最大家族财富的管理者。 正是通过这个私人投资办公室, 沃尔玛公司(Walmart Inc.) 的创始人萨姆·沃尔顿(Sam Walton)的后代们将自己的财富一代代地积累到了一起。 哦,他们的财富是如何积累起来的。今天,在第一家真正的沃尔玛开业 62 年后,沃尔顿家族比以往任何时候都更富有。他们的总财富已飙升至创纪录的 4324 亿美元,使他们重回彭博年度全球最富有家族排行榜榜首。 你不需要成为亿万富翁就能掌握富人的金科玉律:巨大的财富会带来更大的财富。 沃尔顿家族一直是我们榜单上的常客,他们不断致富的原因很简单:沃尔玛股票。截至 12 月 10 日,今年以来,沃尔玛股价上涨了 80%。这一增长使该家族的总财富在 12 个月内增加了 1727 亿美元,相当于每天 4.732 亿美元,或每分钟 328,577 美元,超过了 2023 年彭博榜单上位居榜首的阿联酋王室成员的财富。 山姆·沃尔顿 为此奠定了基础。他策略性地将自己的财富分配给子女,以保持家族控制权并确保他们的财富不断增长。 自 1992 年沃尔顿去世以来,他的继承人一直坚守着一个原则,这个原则为沃尔顿家族和我们名单上的许多其他家族带来了丰厚的回报:团结一致。沃尔顿企业通过管理沃尔顿家族在沃尔玛的大部分合并且越来越有价值的股份,为这些家族提供了粘合剂。 这一原则对未来 25 年将继承数万亿美元 的许多人具有指导意义 。那些在主要资产所有权上保持团结的家族受益于增强的复利和控制力。奢侈品牌爱马仕和制药商罗氏背后的家族就是那些通过协议确保凝聚力的家族之一。 和沃尔顿家族一样,彭博榜单上的 25 个家族中的大多数今年都因市场强劲而变得更富有。他们总共赚了 4065 亿美元。其中许多都是耳熟能详的名字:约翰逊家族(共同基金和退休账户)、汤姆森家族(媒体)、玛氏和费列罗(糖果)。 一位新进入者是奥弗斯家族,他们的财富源自一家以色列航运公司。如今,他们的帝国横跨全球多个行业,资产分别由第二代兄弟 埃亚尔 和 伊丹 控制。 另一位新来者是泰国家族的谢氏,其企业集团正大集团 (CP Group) 经营着养鱼场、7-Eleven 便利店并生产动物饲料等。 金钱可以拆散家...

印度的“蟑螂”一代Z世代已经受够了

 FT: 十多年来,印度总理纳伦德拉·莫迪一直以一套模式治理着这个世界上最大的民主国家:持续的宗教动员,加上对经济发展和“美好时光”( acche din )的承诺。在过去的12年里,这套模式几乎奏效。 如今,印度的Z世代——全球人口最多的群体,超过3.7亿——正在对这项政策进行考验。本周,成千上万的印度年轻人连续五天走上全国各地的街头,向莫迪总理发起了他执政以来面临的最大挑战。 今年年初,当局发现5月份的医学院入学考试遭到泄题,此后这场运动开始兴起。超过200万名考生被迫重考,而他们为了这场考试已经准备了数年,其中许多人还花费了巨额资金。至少有12名考生因此自杀。警方对泄题事件的调查发现,泄题者是与考试流程相关的内部人员。 在教育部长达尔门德拉·普拉丹任期内,全国各地多次发生考试泄题事件,学生们要求他辞职。印度首席大法官将该国失业青年比作“蟑螂”(他后来声称这仅适用于那些拥有假学位的人),这进一步激起了民众的愤怒。 数百万民众涌入社交媒体,随后阿比吉特·迪普克创立了蟑螂人民党(CJP)。该党取名为“蟑螂人民党”,意在讽刺莫迪领导的印度人民党(BJP)。如今,蟑螂人民党在Instagram上拥有超过2500万粉丝,远远超过印度人民党的940万粉丝。 在当今的印度,政治问责的概念已基本从公众视野中消失。无论情况如何,莫迪都对要求其解雇党内成员和部长的呼声嗤之以鼻。虽然老一辈印度人已经习以为常,但许多面临自身日益严峻挑战的Z世代却对此一无所知。 印度青年处境艰难。该国失业人口中,超过五分之四的人年龄在30岁以下。更令人担忧的是,大学毕业生的失业率是文盲的九倍。 与此同时,实际工资却停滞不前。政府的技能发展计划也无济于事——在过去十年中,1600万接受培训的人员中只有15%找到了工作。就连印度著名的信息技术公司也在裁员,并冻结招聘。在2025-2026财年的前九个月,该行业的五大巨头仅净增17名员工。 因此,许多年轻人被迫从事与自身技能严重不符的工作。我曾见过在建筑工地担任工头的工程师,也见过研究生从事数据录入工作。如今,数以百万计的人从事着收入微薄且往往充满剥削的零工。目前,超过1200万印度人受雇于该行业,预计仅在未来三年内,这一数字就将翻一番。 这种不稳定的生活状况带来的后果难以概括,而且影响范围还在不断扩大。有些男人因为没有体面的工作而找不到妻子。许多人即...

2014-2024,仅仅10年 大象公社

 《2014-2024,仅仅10年》 大象公社 十年前的夏天,年轻人不愿当公务员,国考人数锐减36万,热帖称“机关钱少活多”。 那年全国毕业生700余万,就业率超九成,复旦学生租游艇办毕业舞会,女孩们花两千元买晚礼服,夜游江海。 那年世界的齿轮咬合稳定,中美迎来建交35周年。美国民调中,超72%年轻人,将中国视为“朋友”。 夏天前,奥巴马夫人到访,体验了长城、紫禁城与成都火锅。 慕田峪长城上,总统夫人看燕山起伏,觉得一切宽阔且美妙,“长城的长度几乎相当于从美国缅因州到俄勒冈州的四倍”。 那年的国运也如山峦起伏。 夏天时,股市清冷,七成账户闲置,股民调侃关灯吃面,7月IPO开闸,并购潮掀起,年底股市单日放量7100亿,狂飙冲天。 楼市故事也相似。十年前的五一,房企奄奄一息,北京楼盘推出零首付,南京楼盘跳远减十万,上海房展出动比基尼美女吸引眼球。9月楼市松绑,炒房客陷入狂欢。 十年前的人们尚不知卷与颓,偶有下挫,也认为不过是插曲,对一切满怀自信。 贾跃亭宣布要造超级互联网汽车,罗永浩宣布要发布东半球最好用的手机。真正手机大卖的是小米,第一季度销量超过苹果。 夏天过后,雷军去乌镇参加首届互联网大会。他磕磕巴巴说,梦想还是要有,万一实现呢? 那年乌镇最风光还是BAT,三家都在硅谷设立了分支,李彦宏说机会太多,他很着急: 我们其实处在非常有意思的时代,这是魔幻一般的时代,正好我们这一代人赶上互联网的兴起。 入夜,乌镇白墙黑瓦水音桨声。丁磊拼起旧木桌,摆起乌镇宴,座中人微博记录:十几瓶黄酒喝去,陈年故事吐出,煮酒笑谈云中事,天罗地网立旌旗。 未被邀请的马云,才是那年真正的主角。十年前的夏天,阿里启动全球最大规模IPO。 上市前,马云发内部邮件,建议员工不要挥霍,处理好财富,“我们这么辛苦,可不是为了变成一群土豪”。 当年9月,阿里上市,马云登顶中国首富,万名阿里员工成千万富翁,宝马销售和房产中介堵在阿里园区门口。 十年前的夏天蒸腾如梦,浩荡热风吹过中国。北京高温刷新了1951年以来纪录,居民用水多喝出4.5个昆明湖。 济南、上海、重庆、吐鲁番尽成火炉,更大热浪在互联网彩票服务器上。那年是巴西世界杯,足彩卖出23亿。 在广州,恒大正在冲击中超三连冠,教练席上,新任助教李铁说,有很多东西不是金钱所能衡量,“我给自己十年左右的时间,争取成为国家队的主教练”。 那个夏天,恒大冰...

付鹏11月24日在HSBC内部演讲速记

《2024年年终回顾和2025年展望——对冲风险VS软着陆》   上篇 正值年底,虽然刚才汇丰一直强调大家不录音不录像,但大概率你挡不住。我在这儿讲话会谨慎一些,非常小心谨慎,大概率会有人透露出去,放到YouTube上,基本上所有见我都说付总我在YouTube上看过你的视频,我说那都是盗版的,靠盗版发财的也不少。 今天和大家分享的内容基本上都是官方的,回顾会多一点,展望不多,因为这个月展望完了之后下个月怎么办?有些话对我来讲我倒觉得很简单,本质上原来我们是做Hedge Fund出身,所以我们的逻辑框架整体具有极强的延续性,不是说今年去讨论,或者说明年去讨论。 惯性思维从2016年开始,我一直在跟大家强调这个世界已经完全不一样了。当然经历过过去的几年时间,我相信在座各位应该对这番话的理解变得越发深刻。 2016年实际上是美国特朗普的第一次大选,我有一个特点,我的特征是如果我觉得什么地方有投资机会,我可能第一时间去一线调研,我不喜欢看YouTube,我也不喜欢在网上扒。当然你会说,现在ChatGPT很强大了,人工智能好像能帮你解决很多问题,但你们有没有想过,可能广泛流传或者广泛传播的很多信息是错的。这一点在2012年当时我从日本做完调研回来之后,我的感悟是最深的。 当然去日本有一个重要的人物,名字叫本森特,很快大家就会非常熟悉他的,目前来讲应该是特朗普政府提名的美国财长。本森特原来是索罗斯基金实际掌控人,因为索大爷已经年龄很大了,去年的时候才刚刚把基金的业务交给他儿子亚历山大,但在这之前,最主要的几场战役本质上来讲都是本森特在主导。 2012年当时我从北京去香港约朋友们吃饭的饭局上,当时斯索罗斯基金在香港办公室跟我说,本森特从这儿去了日本。我说OK。我经常说一句话“站在巨人的肩膀上看问题。” 当然你知道,网民们最可怕的地方是巴菲特“SB”、索罗斯“SB”,我最“牛逼”。你要记住,他们的所有行为一定有很大的变化,很多人可能都不知道,巴菲特第一次去是2011年,我们正在讲福岛核电站泄漏,核废水污染以后海鲜不能吃的时候,一个80多岁的老头顶着核辐射泄漏去日本吃海鲜了,当然他去日本干吗,这其实很关键。 之后我们跑到日本做完调研回来之后那几年,我陆陆续续跟很多人讲,日本正在发生变化,日本的利率结构都会随之变化的,当然包括日本的证券市场。今年日本股市终于走出这35年了,创下...

WSJ:盘点2026年上半年标普500指数表现最好的20只股票

  2026年已过半,现在是时候盘点一下今年迄今表现最佳的股票了。 标普500指数今年迄今已累计上涨9.5%,表现不俗;根据 伦敦证券交易所集团 (LSEG)的数据,这一美国大盘基准指数在过去10年中平均每年上涨12.8%。 今年我们还看到了一轮由盈利增长驱动的牛市——或者说是分析师对滚动12个月每股收益预期的上调,这些预期被用于计算预期市盈率。 这些盈利增长一直是标普500指数信息技术板块股票上涨的驱动力,其中许多股票实现了三位数的涨幅。今年迄今,IT板块在标普500指数的11个板块中表现位居第二,该指数按价格涨幅排名的前10大股票全部来自科技板块。在该指数表现最佳的前20只股票中,除三只外,其余均为科技股。 标普500指数成分股中,今年有62%的股票实现上涨。以下是2026年上半年标普500指数中价格涨幅最大的20只股票。(本文中所有股价变动均不含股息。) 公司 2026年价格变动 2025年价格变动 预期市盈率 截至12月31日的预期市盈率 2026年滚动12个月每股收益预期变动 闪迪 858% N/A 12.0 13.6 987% 美光科技 304% 239% 8.1 7.9 294% 英特尔 278% 84% 103.8 61.2 123% Western Digital 271% 282% 35.0 19.6 107% Marvell Technology 251% -23% 60.2 24.0 40% Seagate Technology Holdings 250% 219% 34.6 20.5 107% 戴尔 243% 9% 21.2 11.1 79% 康宁 192% 84% 68.8 28.2 19% 应用材料 181% 58% 47.3 26/0 55% Advanced Micro Devices 171% 77% 56.4 33.1 59% Flex 168% 57% 31.3 17.4 49% 泛林集团 153% 137% 54.1 32.1 50% 泰瑞达 150% 54% 56.4 36.7 63% KLA 148% 93% 58.7 31.0 31% 莫德纳 137% -29% N/A N/A 1% Lumentum Holdings 133% 339% 47.6 50.2 145% Generac Holdings 115%...

一只杠杆ETF正在重塑全球顶级人工智能内存股的交易格局

  上周, 韩国综合股价指数 暴跌10%, 引发 科技股暴跌并迅速蔓延至全球,韩国在全球市场中新近确立的强国地位显而易见。 在很大程度上,这体现了韩国芯片制造商 SK海力士 和 三星电子 在人工智能热潮中扮演的关键角色,而人工智能热潮正是推动市场走高的重要因素。但当天的疯狂抛售导致 纳斯达克指数下跌 3%,同时也凸显了另一个问题:一只与SK海力士挂钩的杠杆型交易所交易基金(ETF)的出现。分析师表示,这只ETF规模如此庞大、增长如此迅速,以至于放大了SK海力士股价以及整个韩国综合股价指数(KOSPI)的波动。 自CSOP SK海力士杠杆ETF 在香港推出 以来的九个月里,该基金规模已膨胀至130亿美元,成为全球同类基金中规模 最大的 。这家芯片制造商助力韩国综合股价指数(KOSPI)今年上涨近100%。在市场波动剧烈的日子里,该ETF及其规模较小的同类基金的交易量可 占 SK海力士股票总交易量的三分之二——对于一家市值高达1.2万亿美元的公司而言,这是一个惊人的数字——迫使从华尔街到香港的各大银行不得不精心策划复杂的融资和对冲交易,以维持这些产品的正常运作。 这种在上涨日买入、下跌日卖出的持续不断的节奏如此之大,以至于投资者表示,该 ETF 已经开始影响股票走势,而不仅仅是跟踪股票。 6月18日,首尔举行仪式庆祝韩国综合股价指数(KOSPI)突破9000点。摄影:Jung Yeon-Je/AFP/Getty Images 随着投资者争相押注人工智能热潮,杠杆ETF已发展成为一个规模达 2700亿美元的 庞大产业,这种现象在全球范围内日益普遍。而随着这种新的金融炼金术在市场中掀起波澜,首尔的形势尤为严峻。SK海力士在韩国综合股价指数(KOSPI)中占比高达28%(其竞争对手三星则占29%),并日益成为衡量全球人工智能泡沫风险的风向标。 换句话说,如果 CSOP SK 海力士 ETF 再次像 6 月 23 日那样暴跌 23%,并且这种暴跌持续足够长的时间,可能会造成更大的痛苦。 “我并不是说SK海力士会拖垮标普500指数,但这确实是更大趋势的一部分,”宏观风险顾问公司首席执行官 迪恩·库努特表示 。“科技股的强劲回报令人瞩目,而这种上涨过程中的反馈机制最终也会在下跌过程中发挥作用。” Curnutt表示,SK海力士和韩国综合股价指数(Kospi)的下跌可能会引发...