跳至主要内容

揭秘DeepSeek:一个更极致的中国技术理想主义故事

 

做贡献者,而非搭便车者。

文 | 于丽丽
编辑 | 刘旌

中国的7家大模型创业公司中,DeepSeek(深度求索)最不声不响,但它又总能以出其不意的方式被人记住。

一年前,这种出其不意源自它背后的量化私募巨头幻方,是大厂外唯一一家储备万张A100芯片的公司,一年后,则来自它才是引发中国大模型价格战的源头。

在被AI连续轰炸的5月,DeepSeek一跃成名。起因是他们发布的一款名为DeepSeek V2的开源模型,提供了一种史无前例的性价比:推理成本被降到每百万token仅 1块钱,约等于Llama3 70B的七分之一,GPT-4 Turbo的七十分之一。

DeepSeek被迅速冠以“AI界拼多多”之称的同时,字节、腾讯、百度、阿里等大厂也按耐不住,纷纷降价。中国大模型价格战由此一触即发。

弥漫的硝烟其实掩盖了一个事实:与很多大厂烧钱补贴不同,DeepSeek是有利润的。

这背后,是DeepSeek对模型架构进行了全方位创新。它提出的一种崭新的MLA(一种新的多头潜在注意力机制)架构,把显存占用降到了过去最常用的MHA架构的5%-13%,同时,它独创的DeepSeekMoESparse结构,也把计算量降到极致,所有这些最终促成了成本的下降。

在硅谷,DeepSeek被称作“来自东方的神秘力量”。SemiAnalysis首席分析师认为,DeepSeek V2论文“可能是今年最好的一篇”。OpenAI前员工Andrew Carr认为论文“充满惊人智慧”,并将其训练设置应用于自己的模型。而OpenAI前政策主管、Anthropic联合创始人Jack Clark认为,DeepSeek“雇佣了一批高深莫测的奇才”,还认为中国制造的大模型,“将和无人机、电动汽车一样,成为不容忽视的力量。”

在基本由硅谷牵动故事进展的AI浪潮里,这是罕有的情形。多位行业人士告诉我们,这种强烈的反响源自架构层面的创新,是国产大模型公司乃至全球开源基座大模型都很罕见的尝试。一位AI研究者表示,Attention架构提出多年来,几乎未被成功改过,更遑论大规模验证。“这甚至是一个做决策时就会被掐断的念头,因为大部分人都缺乏信心。”

而另一方面,国产大模型之前很少涉足架构层面的创新,也是因为很少有人主动去击破那样一种成见:美国更擅长从0-1的技术创新,而中国更擅长从1-10的应用创新。何况这种行为非常不划算——新一代模型,过几个月自然有人做出来,中国公司只要跟随、做好应用即可。对模型结构进行创新,意味着没有路径可依,要经历很多失败,时间、经济成本都耗费巨大。

DeepSeek显然是逆行者。在一片认为大模型技术必然趋同,follow是更聪明捷径的喧哗声中,DeepSeek看重“弯路”中积累的价值,并认为中国的大模型创业者除应用创新外,也可以加入到全球技术创新的洪流中。

DeepSeek的很多抉择都与众不同。截至目前,7家中国大模型创业公司中,它是唯一一家放弃“既要又要”路线,至今专注在研究和技术,未做toC应用的公司,也是唯一一家未全面考虑商业化,坚定选择开源路线甚至都没融过资的公司。这些使得它经常被遗忘在牌桌之外,但在另一端,它又经常在社区被用户“自来水”式传播。

DeepSeek究竟是如何炼成的?我们为此访谈了甚少露面的DeepSeek创始人梁文锋。

这位从幻方时代,就在幕后潜心研究技术的80后创始人,在DeepSeek时代,依旧延续着他的低调作风,和所有研究员一样,每天“看论文,写代码,参与小组讨论”。

和很多量化基金创始人都有过海外对冲基金履历,多出身物理、数学等专业不同的是,梁文锋一直是本土背景,早年就读的也是浙江大学电子工程系人工智能方向。

多位行业人士和DeepSeek研究员告诉我们,梁文锋是当下中国AI界非常罕见的“兼具强大的infra工程能力和模型研究能力,又能调动资源”、“既可以从高处做精准判断,又可以在细节上强过一线研究员”的人,他拥有“令人恐怖的学习能力”,同时又“完全不像一个老板,而更像一个极客”。

这是一次尤为难得的访谈。访谈里,这位技术理想主义者,提供了目前中国科技界特别稀缺的一种声音:他是少有的把“是非观”置于“利害观”之前,并提醒我们看到时代惯性,把“原创式创新”提上日程的人。

一年前,DeepSeek刚下场时,我们初次访谈了梁文锋 :《疯狂的幻方:一家隐形AI巨头的大模型之路》 。如果说当时那句「务必要疯狂地怀抱雄心,且还要疯狂地真诚」还是一句美丽的口号,一年过去,它已经在成为一种行动。

以下为对话部分:

价格战第一枪是怎么打响的?

「暗涌」:DeepSeek V2模型发布后,迅速引发一场血雨腥风的大模型价格战,有人说你们是行业的一条鲶鱼。

梁文锋:我们不是有意成为一条鲶鱼,只是不小心成了一条鲶鱼。

「暗涌」:这个结果让你们意外吗?

梁文锋:非常意外。没想到价格让大家这么敏感。我们只是按照自己的步调来做事,然后核算成本定价。我们的原则是不贴钱,也不赚取暴利。这个价格也是在成本之上稍微有点利润。

「暗涌」:5天后智谱AI就跟进了,之后是字节、阿里、百度、腾讯等大厂。

梁文锋:智谱AI降的是一个入门级产品,和我们同级别的模型仍然收费很贵。字节是真正第一个跟进的。旗舰模型降到和我们一样的价格,然后触发了其它大厂纷纷降价。因为大厂的模型成本比我们高很多,所以我们没想到会有人亏钱做这件事,最后就变成了互联网时代的烧钱补贴的逻辑。

「暗涌」:外部看来,降价很像在抢用户,互联网时代的价格战通常如此。

梁文锋:抢用户并不是我们的主要目的。我们降价一方面是因为我们在探索下一代模型的结构中,成本先降下来了,另一方面也觉得无论API,还是AI,都应该是普惠的、人人可以用得起的东西。

「暗涌」:在这之前,大部分中国公司都会直接copy这一代的 Llama结构去做应用,为什么你们会从模型结构切入?

梁文锋:如果目标是做应用,那沿用 Llama结构,短平快上产品也是合理选择。但我们目的地是AGI,这意味着我们需要研究新的模型结构,在有限资源下,实现更强的模型能力。这是scale up到更大模型所需要做的基础研究之一。除了模型结构,我们还做了大量其他的研究,包括怎么构造数据,如何让模型更像人类等,这都体现在我们发布的模型里。另外,Llama的结构,在训练效率和推理成本上,和国外先进水平估计也已有两代差距。

「暗涌」:这种代差主要来自哪里?

梁文锋:首先训练效率有差距。我们估计,国内最好的水平和国外最好的相比,模型结构和训练动力学上可能有一倍的差距,光这一点我们要消耗两倍的算力才能达到同样效果。另外数据效率上可能也有一倍差距,也就是我们要消耗两倍的训练数据和算力,才能达到同样的效果。合起来就要多消耗4倍算力。我们要做的,正是不停地去缩小这些差距。

「暗涌」:大部分中国公司都选择既要模型又要应用,为什么DeepSeek目前选择只做研究探索?

梁文锋:因为我们觉得现在最重要的是参与到全球创新的浪潮里去。过去很多年,中国公司习惯了别人做技术创新,我们拿过来做应用变现,但这并非是一种理所当然。这一波浪潮里,我们的出发点,就不是趁机赚一笔,而是走到技术的前沿,去推动整个生态发展。

「暗涌」:互联网和移动互联网时代留给大部分人的惯性认知是,美国擅长搞技术创新,中国更擅长做应用。

梁文锋:我们认为随着经济发展,中国也要逐步成为贡献者,而不是一直搭便车。过去三十多年IT浪潮里,我们基本没有参与到真正的技术创新里。我们已经习惯摩尔定律从天而降,躺在家里18个月就会出来更好的硬件和软件。Scaling Law也在被如此对待。

但其实,这是西方主导的技术社区一代代孜孜不倦创造出来的,只因为之前我们没有参与这个过程,以至于忽视了它的存在。

真正的差距不是一年或两年,而是原创和模仿之差

「暗涌」:为什么DeepSeek V2会让硅谷的很多人惊讶?

梁文锋:在美国每天发生的大量创新里,这是非常普通的一个。他们之所以惊讶,是因为这是一个中国公司,在以创新贡献者的身份,加入到他们游戏里去。毕竟大部分中国公司习惯follow,而不是创新。

「暗涌」:但这种选择放在中国语境里,也过于奢侈。大模型是一个重投入游戏,不是所有公司都有资本只去研究创新,而不是先考虑商业化。

梁文锋:创新的成本肯定不低,过去那种拿来主义的惯性也和过去的国情有关。但现在,你看无论中国的经济体量,还是字节、腾讯这些大厂的利润,放在全球都不低。我们创新缺的肯定不是资本,而是缺乏信心以及不知道怎么组织高密度的人才实现有效的创新。

「暗涌」:为什么中国公司——包括不缺钱的大厂,这么容易把快速商业化当第一要义?

梁文锋:过去三十年,我们都只强调赚钱,对创新是忽视的。创新不完全是商业驱动的,还需要好奇心和创造欲。我们只是被过去那种惯性束缚了,但它也是阶段性的。

「暗涌」:但你们究竟是一个商业组织,而非一个公益科研机构,选择创新,又通过开源分享出去,那要在哪里形成护城河?像5月这次MLA架构的创新,也会很快被其他家copy吧?

梁文锋:在颠覆性的技术面前,闭源形成的护城河是短暂的。即使OpenAI闭源,也无法阻止被别人赶超。所以我们把价值沉淀在团队上,我们的同事在这个过程中得到成长,积累很多know-how,形成可以创新的组织和文化,就是我们的护城河。

开源,发论文,其实并没有失去什么。对于技术人员来说,被follow是很有成就感的事。其实,开源更像一个文化行为,而非商业行为。给予其实是一种额外的荣誉。一个公司这么做也会有文化的吸引力。

「暗涌」:你怎么看类似朱啸虎的这种市场信仰派观点?

梁文锋:朱啸虎是自洽的,但他的打法更适合快速赚钱的公司,而你看美国最赚钱的公司,都是厚积薄发的高科技公司。

「暗涌」:但做大模型,单纯的技术领先也很难形成绝对优势,你们赌的那个更大的东西是什么?

梁文锋我们看到的是中国AI不可能永远处在跟随的位置。我们经常说中国AI和美国有一两年差距,但真实的gap是原创和模仿之差。如果这个不改变,中国永远只能是追随者,所以有些探索也是逃不掉的。

英伟达的领先,不只是一个公司的努力,而是整个西方技术社区和产业共同努力的结果。他们能看到下一代的技术趋势,手里有路线图。中国AI的发展,同样需要这样的生态。很多国产芯片发展不起来,也是因为缺乏配套的技术社区,只有第二手消息,所以中国必然需要有人站到技术的前沿。

更多的投入并不一定产生更多的创新

「暗涌」:现在的DeepSeek有一种OpenAI早期的理想主义气质,也是开源的。后边你们会选择闭源吗?OpenAI和Mistral都有过从开源到闭源的过程。

梁文锋:我们不会闭源。我们认为先有一个强大的技术生态更重要。

「暗涌」:你们有融资计划吗?看有媒体报道,幻方对DeepSeek有独立拆分上市的计划,硅谷的AI创业公司,最终也都难免要和大厂绑定。

梁文锋:短期内没有融资计划,我们面临的问题从来不是钱,而是高端芯片被禁运。

「暗涌」:很多人认为,做AGI和做量化是完全不同的两件事,量化可以闷声去做,但AGI可能更需要高举高打,需要结盟,这样可以让你的投入变大。

梁文锋:更多的投入并不一定产生更多的创新。否则大厂可以把所有的创新包揽了。

「暗涌」:你们现在不做应用,是因为你们没有运营的基因吗?

梁文锋:我们认为当前阶段是技术创新的爆发期,而不是应用的爆发期。长远来说,我们希望形成一种生态,就是业界直接使用我们的技术和产出,我们只负责基础模型和前沿的创新,然后其它公司在DeepSeek 的基础上构建toB、toC的业务。如果能形成完整的产业上下游,我们就没必要自己做应用。当然,如果需要,我们做应用也没障碍,但研究和技术创新永远是我们第一优先级。

「暗涌」:但选择API的话,为什么选择DeepSeek,而不是大厂?

梁文锋:未来的世界很可能是专业化分工的,基础大模型需要持续创新,大厂有它的能力边界,并不一定适合。

「暗涌」:但技术真的可以拉开差距吗?你也说过并不存在绝对的技术秘密。

梁文锋:技术没有秘密,但重置需要时间和成本。英伟达的显卡,理论上没有任何技术秘密,很容易复制,但重新组织团队以及追赶下一代技术都需要时间,所以实际的护城河还是很宽。

「暗涌」:你们降价后,字节率先跟进,说明他们还是感受到某种威胁。你怎么看创业公司与大厂竞争的新解法?

梁文锋:说实话我们不太care这件事,只是顺便做了这件事。提供云服务不是我们的主要目标。我们的目标还是去实现AGI。

目前没有看到什么新解法,但大厂也没有明显占优。大厂有现成的用户,但它的现金流业务也是它的包袱,也会让它成为随时被颠覆的对象。

「暗涌」:你怎么看DeepSeek之外的6家大模型创业公司的终局?

梁文锋:可能活下来2到3家。现在都还处在烧钱阶段,所以那些自我定位清晰、更能精细化运营的,更有机会活下来。其它公司可能会脱胎换骨。有价值的东西不会烟消云散,但会换一种方式。

「暗涌」:幻方时代,面对竞争的姿态就被评价为“我行我素”,很少在意横向比较。关于竞争,你思考的原点是什么?

梁文锋:我经常思考的是,一个东西能不能让社会的运行效率变高,以及你能否在它的产业分工链条上找到擅长的位置。只要终局是让社会效率更高,就是成立的。中间很多都是阶段性的,过度关注必然眼花缭乱。

一群做“高深莫测”事的年轻人

「暗涌」:OpenAI前政策主管、Anthropic联合创始人Jack Clark认为DeepSeek雇佣了“一批高深莫测的奇才”,做出DeepSeek v2的是怎样一群人?

梁文锋:并没有什么高深莫测的奇才,都是一些Top高校的应届毕业生、没毕业的博四、博五实习生,还有一些毕业才几年的年轻人。

「暗涌」:很多大模型公司都执着地去海外挖人,很多人觉得这个领域前50名的顶尖人才可能都不在中国的公司,你们的人都来自哪里?

梁文锋:V2模型没有海外回来的人,都是本土的。前50名顶尖人才可能不在中国,但也许我们能自己打造这样的人。

「暗涌」:这次MLA创新是如何发生的?听说idea最早来自一个年轻研究员的个人兴趣?

梁文锋:在总结出Attention架构的一些主流变迁规律后,他突发奇想去设计一个替代方案。不过从想法到落地,中间是一个漫长的过程。我们为此组了一个team,花了几个月时间才跑通。

「暗涌」:这种发散性灵感的诞生和你们完全创新型组织的架构很有关系。幻方时代,你们就很少自上而下地指派目标或任务。但AGI这种充满不确定性的前沿探索,是否多了管理动作?

梁文锋:DeepSeek也全是自下而上。而且我们一般不前置分工,而是自然分工。每个人有自己独特的成长经历,都是自带想法的,不需要push他。探索过程中,他遇到问题,自己就会拉人讨论。不过当一个idea显示出潜力,我们也会自上而下地去调配资源。

「暗涌」:听说DeepSeek对于卡和人的调集非常灵活。

梁文锋:我们每个人对于卡和人的调动是不设上限的。如果有想法,每个人随时可以调用训练集群的卡无需审批。同时因为不存在层级和跨部门,也可以灵活调用所有人,只要对方也有兴趣。

「暗涌」:一种松散的管理方式也取决于你们筛选到了一批强热爱驱动的人。听说你们很擅长从细节招人, 可以让一些非传统评价指标里优秀的人被选出来。

梁文锋:我们选人的标准一直都是热爱和好奇心,所以很多人会有一些奇特的经历,很有意思。很多人对做研究的渴望,远超对钱的在意。

「暗涌」: transformer诞生在谷歌的AI Lab,ChatGPT诞生在OpenAI,你觉得大公司的AILab 和一个创业公司对于创新产生的价值有什么不同?

梁文锋:不管是Google实验室,还是OpenAI,甚至中国大厂的AI Lab,都很有价值的。最后是OpenAI做出来,也有历史的偶然性。

「暗涌」:创新很大程度也是一种偶然吗?我看你们办公区中间那排会议室左右两侧都设置了可以随意推开的门。你们同事说,这就是给偶然留出空隙。transfomer诞生中就发生过那种偶然经过的人听到后加入,最终把它变成一个通用框架的故事。

梁文锋:我觉得创新首先是一个信念问题。为什么硅谷那么有创新精神?首先是敢。Chatgpt出来时,整个国内对做前沿创新都缺乏信心,从投资人到大厂,都觉得差距太大了,还是做应用吧。但创新首先需要自信。这种信心通常在年轻人身上更明显。

「暗涌」:但你们不参与融资,很少对外发声,社会声量上肯定不如那些融资活跃的公司,怎么确保DeepSeek就是做大模型的人的首选?

梁文锋:因为我们在做最难的事。对顶级人才吸引最大的,肯定是去解决世界上最难的问题。其实,顶尖人才在中国是被低估的。因为整个社会层面的硬核创新太少了,使得他们没有机会被识别出来。我们在做最难的事,对他们就是有吸引力的。

「暗涌」:前一段OpenAI的发布并没有等来GPT5,很多人觉得这是技术曲线明显在放缓,也很多人开始质疑Scaling Law,你们怎么看?

梁文锋:我们偏乐观,整个行业看起来都符合预期。OpenAI也不是神,不可能一直冲在前面。

「暗涌」:你觉得AGI还要多久实现,发布DeepSeek V2前,你们发布过代码生成和数学的模型,也从dense模型切换到了MOE,所以你们的AGI路线图有哪些坐标?

梁文锋:可能是2年、5年或者10年,总之会在我们有生之年实现。至于路线图,即使在我们公司内部,也没有统一意见。但我们确实押注了三个方向。一是数学和代码,二是多模态,三是自然语言本身。数学和代码是AGI天然的试验场,有点像围棋,是一个封闭的、可验证的系统,有可能通过自我学习就能实现很高的智能。另一方面,可能多模态、参与到人类的真实世界里学习,对AGI也是必要的。我们对一切可能性都保持开放。

「暗涌」:你觉得大模型终局是什么样态?

梁文锋:会有专门公司提供基础模型和基础服务,会有很长链条的专业分工。更多人在之上去满足整个社会多样化的需求。

所有的套路都是上一代的产物

「暗涌」:过去这一年,中国的大模型创业还是有很多变化的,比如去年开头还很活跃的王慧文中场退出了,后来加入的公司也开始呈现出差异化。

梁文锋:王慧文自己承担了所有的损失,让其他人全身而退。他做了一个对自己最不利,但对大家都好的选择,所以他做人是很厚道的,这点我很佩服。

「暗涌」:现在你的精力最多放在哪里?

梁文锋:主要的精力在研究下一代的大模型。还有很多未解决的问题。

「暗涌」:其他几家大模型创业公司都是坚持既要又要,毕竟技术不会带来永久领先,抓住时间窗口把技术优势落到产品也很重要,DeepSeek敢于专注在模型研究上是因为模型能力还不够吗?

梁文锋:所有的套路都是上一代的产物,未来不一定成立。拿互联网的商业逻辑去讨论未来AI的盈利模式,就像马化腾创业时,你去讨论通用电气和可口可乐一样。很可能是一种刻舟求剑。

「暗涌」:过去幻方就有很强的技术和创新基因,成长也比较顺利,这是你偏乐观的原因吗?

梁文锋:幻方某种程度上增强了我们对技术驱动型创新的信心,但也不都是坦途。我们经历了一个漫长的积累过程。外部看到的是幻方2015年后的部分,但其实我们做了16年。

「暗涌」:回到关于原创式创新的话题。现在经济开始进入下行,资本也进入冷周期,所以它对原创式创新是否会带来更多抑制?

梁文锋:我倒觉得未必。中国产业结构的调整,会更依赖硬核技术的创新。当很多人发现过去赚快钱很可能来自时代运气,就会更愿意俯身去做真正的创新。

「暗涌」:所以你对这件事也是乐观的?

梁文锋:我是八十年代在广东一个五线城市长大的。我的父亲是小学老师,九十年代,广东赚钱机会很多,当时有不少家长到我家里来,基本就是家长觉得读书没用。但现在回去看,观念都变了。因为钱不好赚了,连开出租车的机会可能都没了。一代人的时间就变了。

以后硬核创新会越来越多。现在可能还不容易被理解,是因为整个社会群体需要被事实教育。当这个社会让硬核创新的人功成名就,群体性想法就会改变。我们只是还需要一堆事实和一个过程。

评论

此博客中的热门博文

“合肥模式”启示录

  本版文章由中经记者吴清采写 编者按/ 近日,上海证券交易所科创板迎来历史性一刻。长鑫科技(688825.SH)挂牌上市,收盘较发行价暴涨465.82%,市值突破3.28万亿元,成为A股“市值一哥”。合肥市区两级国资体系穿透合计持股约36.79%,对应持股市值超过1.2万亿元——这笔账面浮盈相当于合肥市2025年一般公共预算收入977亿元的12倍。 紧接着,国仪公司在科创板上市。至此,合肥今年已有三家企业登陆科创板。不仅如此,从京东方到蔚来汽车再到长鑫科技,过去五年合肥GDP连续跨越1.2万亿、1.3万亿、1.4万亿三个千亿元台阶,年均增长6.1%,规模以上工业增加值年均增长13.7%。 从20年前GDP仅1000亿元的内陆三线小城,到2025年GDP破1.4万亿元、常住人口超千万的科创高地,合肥靠的不是运气豪赌,而是一套“逆周期重仓、长期主义陪跑、产业链深耕、制度化容错”的硬核理念。这份理念,藏在京东方、蔚来汽车、长鑫科技三大经典案例里,也藏在合肥崛起的“芯屏汽合”“急终生智”的八大产业地标里,“合肥模式”也引发广泛关注和热议。 合肥为何能够在20年间获得如此巨大的增长?“合肥模式”背后的投资底层逻辑是什么?本期商业案例,《中国经营报》记者通过采访业内人士,解析合肥的三个经典投资项目——引入京东方、纾困蔚来汽车、孵化长鑫科技,还原合肥产业投资模式的演进路径和制胜秘诀。 “芯屏汽合”背后:合肥模式的三大经典战役 如果把长鑫科技的上市看作合肥发展的一个高潮,那这幕大戏的真正开场,要追溯到二十年前。当时的合肥,起点并非半导体或新能源汽车,而是家电。 2005年,合肥确立“工业立市”战略。作为全国重要的家电制造基地,美菱、荣事达、海尔、美的、格力在此聚集。但家电产业面临致命短板——“缺芯少屏”,液晶显示屏长期依赖进口,面板成本被日韩企业层层压榨。 2008年,合肥做出震动业内的重大决策:拿出当年财政收入近四成(约60亿元)引入当时亏损超10亿元的京东方,建设国内首条液晶面板6代线。 彼时,合肥一年的财政收入不到200亿元。如果要吃下这个总投资175亿元的大项目,全市都可能要做好发不了工资的准备。 但合肥接了。除资金支持外,合肥花6个月建好了一座110千伏变电站,用以解决京东方的用电问题 。合肥还给京东方提供土地、能源和财政补贴,连续三年每年安排1.5亿元贷款贴息...

2026年中央一号文件(全文)

                                                                         中共中央 国务院 关于锚定农业农村现代化 扎实推进乡村全面振兴的意见 (2026年1月3日) 农业农村现代化关系中国式现代化全局和成色。“十四五”时期,农业综合生产能力迈上新台阶,脱贫攻坚成果巩固拓展,农民生活水平显著提高,乡村全面振兴取得明显进展。“十五五”时期是基本实现社会主义现代化夯实基础、全面发力的关键时期,要加快补上农业农村领域突出短板,加快建设农业强国。2026年是“十五五”开局之年,做好“三农”工作至关重要。要坚持以习近平新时代中国特色社会主义思想为指导,深入贯彻党的二十大和二十届历次全会精神,认真落实四中全会部署,全面贯彻习近平总书记关于“三农”工作的重要论述和重要指示精神,坚持把解决好“三农”问题作为全党工作重中之重,坚持和加强党对“三农”工作的全面领导,完整准确全面贯彻新发展理念,坚持稳中求进工作总基调,坚持农业农村优先发展,坚持城乡融合发展,锚定农业农村现代化,以推进乡村全面振兴为总抓手,以学习运用“千万工程”经验为引领,以改革创新为根本动力,提高强农惠农富农政策效能,守牢国家粮食安全底线,持续巩固拓展脱贫攻坚成果,提升乡村产业发展水平、乡村建设水平、乡村治理水平,努力把农业建成现代化大产业、使农村基本具备现代生活条件、让农民生活更加富裕美好,为推进中国式现代化提供基础支撑。 一、提升农业综合生产能力和质量效益 (一)稳定发展粮油生产。粮食产量稳定在1.4万亿斤左右。坚持产量产能、生产生态、增产增收一起抓,加力实施新一轮千亿斤粮食产能提升行动,促进良田良种良机良法集成增效,推进粮油作物大面积提单产。因地制宜优化农业生产结构和区域布局,推动粮食品种培优和品质提升,实施粮食流通提质增效项目,促进适销对路、优质优价。巩固提升大豆产能,做好产销衔接...

荷兰以地缘政治动荡为由,将黄金从纽约转移至伦敦

WSJ: 荷兰央行将78吨黄金从纽约曼哈顿街下的金库转移到了伦敦。这批黄金按当前价格计算价值110亿美元。该行表示,此举将提升其在紧急情况下交易黄金的能力。 这项高度安保的行动耗时数月才完成。部分黄金在美国售出,然后在英国重新购入。另一些金条则被空运至欧洲,很可能存放在飞机的货舱中。结果是:荷兰近三分之一的黄金储备现存于伦敦,而纽约仍存有19%的相当份额,两地的比重分布正好与此前对调。 荷兰央行在一份声明中表示:“鉴于地缘政治动荡加剧,本行正在加强应对危机的准备。”该央行还从加拿大的金库中转移了部分黄金。 荷兰央行行长奥拉夫·斯莱彭(Olaf Sleijpen)说:“我们希望永远不需要动用它们,但我们确实需要加强我们的韧性和准备。” 该行没有具体说明地缘政治动荡所指为何。此举发生前的18个月里,美欧关系因关税、美国总统特朗普威胁要攫取格陵兰岛以及他对美国军事支持含糊其辞而出现裂痕。 随着20世纪70年代布雷顿森林货币体系的瓦解,黄金作为全球金融支柱的地位宣告终结。但各国央行仍持有一些黄金,作为储备的一部分,以便在货币承压时出售以捍卫本币。 根据国际货币基金组织(IMF) 2023年的一份文件,在经历了长期下降后,各国央行在2008年金融危机前后再次开始增持黄金。自那以来,日益增多的制裁措施促使许多央行(尤其是俄罗斯央行)囤积黄金,以防美国将其排除在银行体系之外。 包括荷兰央行在内的许多央行,都贯彻了“不把鸡蛋放在同一个篮子里”的原则,将黄金分散存放在世界各地以确保安全。纽约和伦敦是两大黄金交易中心。 纽约联储将黄金储存在海平面以下50英尺处、坐落在曼哈顿岛坚固基岩之上的金库中,其岩层强度足以承载数十万根金条的重量。这里的安保极其严密,即便是更换一个灯泡也需要三人在场。 不过,伦敦仍然是实物黄金交易的全球中心。荷兰央行表示,存放在英国央行(Bank of England)的金条必须符合国际市场标准,因此“被认为是世界上最容易交易的黄金”。该行称,存放在纽约和渥太华的金条“在危机情况下”则没那么容易交易。 英国央行的金库也是一个活跃的黄金借贷市场。各地央行可以通过将金块借给其他参与者来换取利息,从而获得回报。纽约联储金库中金条规格形状千差万别、参差不齐,这限制了纽约市场此类出借业务的发展。 此次行动涉及金融和物流两方面的专业操作。 荷兰央行首先在纽约卖出59吨黄金,同时...

付鹏11月24日在HSBC内部演讲速记

《2024年年终回顾和2025年展望——对冲风险VS软着陆》   上篇 正值年底,虽然刚才汇丰一直强调大家不录音不录像,但大概率你挡不住。我在这儿讲话会谨慎一些,非常小心谨慎,大概率会有人透露出去,放到YouTube上,基本上所有见我都说付总我在YouTube上看过你的视频,我说那都是盗版的,靠盗版发财的也不少。 今天和大家分享的内容基本上都是官方的,回顾会多一点,展望不多,因为这个月展望完了之后下个月怎么办?有些话对我来讲我倒觉得很简单,本质上原来我们是做Hedge Fund出身,所以我们的逻辑框架整体具有极强的延续性,不是说今年去讨论,或者说明年去讨论。 惯性思维从2016年开始,我一直在跟大家强调这个世界已经完全不一样了。当然经历过过去的几年时间,我相信在座各位应该对这番话的理解变得越发深刻。 2016年实际上是美国特朗普的第一次大选,我有一个特点,我的特征是如果我觉得什么地方有投资机会,我可能第一时间去一线调研,我不喜欢看YouTube,我也不喜欢在网上扒。当然你会说,现在ChatGPT很强大了,人工智能好像能帮你解决很多问题,但你们有没有想过,可能广泛流传或者广泛传播的很多信息是错的。这一点在2012年当时我从日本做完调研回来之后,我的感悟是最深的。 当然去日本有一个重要的人物,名字叫本森特,很快大家就会非常熟悉他的,目前来讲应该是特朗普政府提名的美国财长。本森特原来是索罗斯基金实际掌控人,因为索大爷已经年龄很大了,去年的时候才刚刚把基金的业务交给他儿子亚历山大,但在这之前,最主要的几场战役本质上来讲都是本森特在主导。 2012年当时我从北京去香港约朋友们吃饭的饭局上,当时斯索罗斯基金在香港办公室跟我说,本森特从这儿去了日本。我说OK。我经常说一句话“站在巨人的肩膀上看问题。” 当然你知道,网民们最可怕的地方是巴菲特“SB”、索罗斯“SB”,我最“牛逼”。你要记住,他们的所有行为一定有很大的变化,很多人可能都不知道,巴菲特第一次去是2011年,我们正在讲福岛核电站泄漏,核废水污染以后海鲜不能吃的时候,一个80多岁的老头顶着核辐射泄漏去日本吃海鲜了,当然他去日本干吗,这其实很关键。 之后我们跑到日本做完调研回来之后那几年,我陆陆续续跟很多人讲,日本正在发生变化,日本的利率结构都会随之变化的,当然包括日本的证券市场。今年日本股市终于走出这35年了,创下...

美欧日政府债券收益率创新高为何引发担忧

 BBG: 由于投资者要求更高的回报以吸引他们持有长期债券,全球 政府的借贷成本一直在 飙升。日本30年期国债收益率接近历史高位,达到4.19%,而英国30年期国债收益率则创下1998年以来的最高水平。彭博社追踪 七国集团(G7 )政府债务的指标 目前平均收益率也达到2000年9月以来的最高水平。 投资者纷纷抛售长期主权债务,其原因包括财政赤字不断攀升和通胀居高不下等一系列问题。此外, 由于科技公司 发行巨额债券 以资助人工智能基础设施建设,各国政府也不得不 竞相吸引投资者的注意力。 由于美国国债收益率达到近二十年来的最高水平,美国 财政部 在8月份表示将加大 长期政府债券 回购力度。此举一度稳定了债券市场,但此后收益率又恢复了上涨趋势。 长期债券有何特别之处? 富裕国家发行的债券被广泛认为是世界上最安全的证券,因为这些国家的政府极有可能偿还投资者。政府通常会锁定长达30年的融资成本。有些国家甚至发行百年后才到期的债券。 但这并不意味着这些债券对投资者来说没有风险。如果通货膨胀和短期利率上升,就会侵蚀债券票息的实际价值,以及债券到期时最终偿还的本金。 债券期限越长,通货膨胀的影响就越大。这就是为什么长期债券对利率和通货膨胀的上升更为敏感,也是为什么它们成为近期抛售潮的焦点。 8月中旬,30年期美国国债收益率达到2007年以来的 最高水平,尽管 此后 收益率略有回落至5.27%, 而德国国债收益率则达到了2011年以来的最高水平。 近期长期债券与短期债券为何出现背离? 投资者担心各国央行在抑制通胀方面做得不够,而 由于唐纳德·特朗普总统 发起的贸易战以及中东冲突导致能源成本上涨,通胀问题依然难以解决。 7月份,由于美联储 维持利率不变,且美联储主席 凯文·沃什的言论令投资者质疑其能否在连续五年多未能实现通胀目标后,将通胀率拉回美联储2%的目标水平 ,长期美国国债的抛售潮加速 。(沃什在8月下旬于怀俄明州杰克逊霍尔发表的演讲中,对通胀问题采取了更为激进的立场。) 维持利率不变虽然有助于降低短期债券收益率(短期债券收益率与央行利率的短期前景密切相关),但却损害了长期债券的走势,因为投资者担心缺乏政策行动会在未来加剧通胀压力。这导致短期和长期利率之间的差距扩大,即所谓的收益率曲线陡峭化。 这并非美国独有的现象。在日本,央行加息步伐缓慢,目前日本的利率仍处于发达国家的...

三联深度:逃出妙瓦底 缅甸诈骗园区

 原创 飞天小豚 三联生活周刊 2025年01月10日 18:06 北京 *本文为「三联生活周刊」原创内容 没有高薪,没有偷渡,更没有去缅甸、柬埔寨这些危险的国家,中国留学生李奥不明白,为什么自己只是在安全的国家想正常找一份工作,却不断跌入招聘陷阱,最终沦为人口贩卖的牺牲品。在经历过一场在缅东的死亡之旅后他才明白,海外华人招聘圈已经被博彩、诈骗等灰色产业渗透,而印象中的那些城市,已经不同以往。 记者|夏杰艺 实习记者|顾靓楠 陷阱 2022年6月5日,李奥站在东南亚一条混浊的泥水河前。河很窄,不过五六米,两岸是一样的黄褐色烂泥地和杂乱的野树林,河面上一条孤零零的小船。 很久之后他才知道,这条不起眼的小河是莫伊河,位于泰缅边境交界处,是知名的偷渡“天堂”。 这里荒无人烟,见不到警察和海关人员,和他同行的是一个肯尼亚女人和一个二三十岁的中国男子。三人的背后跟着四名大汉,他们不怎么说话,但其中一人手上拿着一把小臂长的砍刀,明晃晃的。 泰缅边境的莫伊河岸(摄于2022年) “They are human traffic.”旁边的肯尼亚女人意识到自己的命运,轻声说道。李奥也明白,他们三人已经沦为“猪仔”——人口贩卖的牺牲品。 李奥是浙江台州人,27岁,高二时被父母送到英国读书,随后进入英国利物浦大学学习,但因家中破产被迫辍学,没能获得高中和大学文凭。他的唯一优势是英语,所以工作后有一半时间都在中东、非洲等地的华人企业就职,从事翻译或行政工作。在李奥看来,海外华人企业的待遇更优厚:工资大多在每月一万五千元以上,还包食宿。 2022年初,他先是在肯尼亚的蒙巴萨为江门机械松林有限公司工作,后来又换到阿联酋阿布扎比,在中国通信服务(CCS)的分公司做项目经理,由于岗位期望与公司产生冲突,5月,他辞职来到迪拜,边旅行边求职。 李奥对本刊回忆,自己当时在迪拜当地的华人生活网站“迪拜全酋通”上浏览招聘信息,注意到了一家泰国曼谷的企业。该企业声称从事跨境电商业务,老板需要招聘一名助理兼翻译。该企业跟李奥约了一次英文电话面试,并要求他录制了一则自我介绍的英文短片,然后发放了入职邀请。在李奥看来,该企业和大部分他打过交道的海外华人企业类似——入职程序比较随意,薪资每月一万多元,包住宿和来程机票,但不愿意给劳动者办工签,而是以旅游签入境。“曼谷,在我心里还是一个比较安全、讲法治的地方,...

关于2025年中央和地方预算执行情况与2026年中央和地方预算草案的报告

  关于2025年中央和地方预算执行情况与2026年中央和地方预算草案的报告 ——2026年3月5日在第十四届全国人民代表大会第四次会议上 财政部 各位代表: 受国务院委托,现将2025年中央和地方预算执行情况与2026年中央和地方预算草案提请十四届全国人大四次会议审查,并请全国政协各位委员提出意见。 一、2025年中央和地方预算执行情况 2025年是很不平凡的一年。面对国内外形势深刻复杂的变化,在以习近平同志为核心的党中央坚强领导下,各地区各部门坚持以习近平新时代中国特色社会主义思想为指导,深入贯彻党的二十大和二十届历次全会精神,认真落实四中全会部署,按照党中央和国务院决策部署,坚定不移贯彻新发展理念、推动高质量发展,统筹国内国际两个大局,严格执行十四届全国人大三次会议审查批准的预算,实施更加积极有为的宏观政策,我国经济顶压前行、向新向优发展,现代化产业体系建设持续推进,改革开放全面深化,重点领域风险化解取得积极进展,民生保障更加有力,社会大局保持稳定,全年经济社会发展主要目标任务顺利完成,“十四五”圆满收官,中国式现代化迈出新的坚实步伐。中央和地方预算执行情况总体较好。 (一)2025年一般公共预算收支情况。 1.全国一般公共预算。受国际经贸环境急剧变化、物价低位运行、房地产市场仍在调整等因素影响,财政收入增长面临较大压力。各地区各有关部门积极采取措施,依法依规组织收入、应收尽收,加强财政支出管理、能省则省,基本完成年初预算。 全国一般公共预算收入216044.88亿元,为预算的98.3%,比2024年下降1.7%。其中,税收收入176363.23亿元,增长0.8%;非税收入39681.65亿元,下降11.3%,主要是上年一次性安排中央单位上缴专项收益抬高基数。加上从预算稳定调节基金、政府性基金预算、国有资本经营预算调入资金及使用结转结余15753.78亿元,收入总量为231798.66亿元。全国一般公共预算支出287395.42亿元,完成预算的96.8%,增长1%,主要是落实党政机关过紧日子要求,压减非刚性非重点支出,以及部分据实结算支出低于年初预计等。加上补充中央预算稳定调节基金1003.24亿元,支出总量为288398.66亿元。收支总量相抵,赤字56600亿元,与预算持平。 2.中央一般公共预算。中央一般公共预算收入93962.62亿元,为预算的...

调查数据 | 2019年中国城镇居民家庭资产负债情况调查

  中国人民银行调查统计司城镇居民家庭资产负债调查课题组于2019年10月中下旬在全国30个省(自治区、直辖市)对3万余户城镇居民家庭开展了资产负债情况调查。从当前掌握的资料看,这是国内关于城镇居民资产负债情况最为完整、详实的调查之一。 根据《2019年中国城镇居民家庭资产负债情况调查》显示: 第一,城镇居民家庭户均总资产317.9万元,资产分布分化明显;家庭资产以实物资产为主,住房占比近七成,住房拥有率达到96.0%;金融资产占比较低,仅为20.4%,居民家庭更偏好无风险 金融资产。 第二,城镇居民家庭负债参与率高,为56.5%,负债集中化现象明显,负债最高20%家庭承担总样本家庭债务的61.4%;家庭负债结构相对单一,负债来源以银行贷款为主,房贷是家庭负债的主要构成,占家庭总负债的75.9%。 第三,城镇居民家庭净资产均值为289.0万元,分化程度高于资产的分化程度。与美国相比,我国城镇居民家庭财富分布相对均衡(美国净资产最高1%家庭的净资产占全部家庭净资产的比重为38.6%,我国为17.1%)。 第四,城镇居民家庭资产负债率为9.1%,总体稳健,少数家庭资不抵债;居民家庭债务收入比为1.02,略高于美国居民水平(0.93);偿债能力总体较强,偿债收入比为18.4%,居民家庭债务风险总体可控。 第五,需关注两方面问题。一是居民家庭金融资产负债率较高,存在一定流动性风险。二是部分家庭债务风险相对较高,主要表现在以下几个方面:部分低资产家庭资不抵债,违约风险高;中青年群体负债压力大,债务风险较高;老年群体投资银行理财、资管、信托等金融产品较多,风险较大;刚需型房贷家庭的债务风险突出。 城镇居民家庭资 产分化明显,金融资产占比低,房产占比超七 成 城镇居民家庭资产分化明显 调查数据显示,城镇居民家庭总资产均值为317.9万元,中位数为163.0万元。均值与中位数之间相差154.9万元,表明居民家庭资产分布不均。居民家庭资产分布不均衡主要体现在以下四个方面。 第一,居民家庭资产的集中度较高,财富更多地集中在少数家庭。 将家庭总资产由低到高分为六组,最低20%家庭所拥有的资产仅占全部样本家庭资产的2.6%,而总资产最高20%家庭的总资产占比为63.0%,其中最高10%家庭的总资产占比为47.5%。 第二,区域间的家庭资产分布差异显著,经济发达地区的居民家庭资产...

揭底数十亿美元 “杀猪盘” 背后的神秘犯罪头目 - WSJ

  今年早些时候,网上流传的一段视频显示,一名据信是中国商人、知名黑帮头目尹国驹 (Wan Kuok-koi) 的男子在老挝中部石灰岩峭壁上玩滑翔伞时面带微笑并竖起大拇指。 世界各地的执法官员表示,尹国驹在 “杀猪盘” 这种新型网络诈骗的兴起中扮演了核心角色。尹国驹绰号“崩牙驹”(Broken Tooth),这个绰号来自他十几岁时在澳门发生的一场摩托车事故。 在 “杀猪盘” 骗局中,骗子在网上结识受害者,取得他们的信任,然后说服他们把钱投入虚假的投资。美国官员表示,此类骗局每年给美国人造成数十亿美元的损失。然而,似乎没有人真的在努力抓捕崩牙驹。 他不断出现在社交媒体上,在亚洲各地旅行。今年出现在中国社交媒体、Telegram 和中国新闻网站的一段视频中,崩牙驹在老挝走下飞机,身穿一件印有俄罗斯准军事组织瓦格纳集团 (Wagner Group) 标志的 T 恤,与另一名据称是中国犯罪头目的人会面。 崩牙驹的案例表明,全球对网络诈骗的应对措施支离破碎,导致犯罪嫌疑人在 “杀猪盘” 诈骗蔓延之际逍遥法外。崩牙驹曾在澳门因参与有组织犯罪、洗钱和其他罪行被判刑,服刑约 14 年,于 2012 年获释。 美国财政部在 2020 年以腐败为由对崩牙驹实施了制裁。美国财政部还将据称由崩牙驹拥有或控制的三个实体列入了制裁名单,其中包括一家名为东美集团 (Dongmei Group) 的公司,该公司开发了缅甸 “东美园区”(Dongmei Zone) 项目。该园区后来成为最早的诈骗窝点之一。 华盛顿方面还表示,尹国驹拥有或控制着世界洪门历史文化协会 (World Hongmen History and Culture Association, 以下简称:洪门协会)。美国当局称,该协会是一个受中国传统帮会启发而成立的犯罪网络,在东美园区有势力。 联合国官员和研究人员认为,已有数千人被贩运到东美园区,被迫参与网络诈骗。调查人员表示,人们被以合法工作的承诺引诱到这些园区。在园区内,他们被迫交出护照,并使用虚假的社交媒体身份(通常是年轻漂亮的女性)来引诱有钱但孤独的人。 这类骗局之所以被称为 “杀猪盘”,是因为骗子通过建立关系来“养肥” 受害者,然后通过骗取他们的钱财并将其拉黑来“杀猪”。据信已有数千名美国人成为受害者。 至少有四个国家的政府对崩牙驹及其同伙进行了调查,但自他出狱以来,...

全球债券抛售潮导致10年期美国国债收益率逼近5%

  债券空头正将基准国债收益率推向备受关注的 5% 水平,而美国通胀数据即将公布,这将决定市场对美联储下周加息的预期。 本周10年期国债收益率上涨18个基点,略低于具有重要心理意义的水平,这可能吸引逢低买盘,但也可能引发进一步抛售,并波及全球市场。上周五,该收益率达到4.96%,创下2023年以来的最高水平,并逼近2007年以来的最高点。 收益率飙升之际,交易员们正努力应对不断上涨的油价和 持续五年高于 美联储 目标的通胀。周五公布的美国消费者价格指数(CPI)数据将是最重要的参考数据之一。美国市场展望:8月CPI数据将使美联储的决策变得异常艰难, 因为交易员们预计美联储在9月16日的会议上加息的可能性约为70%。 荷兰国际集团 美洲研究主管 帕德里克·加维 表示:“10年期美国国债收益率达到5%看起来更像是不可避免的,而不是预测。 这对债券市场来说是一个令人担忧的时期。” 对美联储利率变动更为敏感的两年期国债收益率本周一度升至4.59%。30年期国债收益率则创下2007年以来的 最高水平 ,在国债拍卖中引发了强劲的需求。 这些波动已蔓延至全球债券市场,澳大利亚基准国债收益率周五触及2011年以来的最高水平,日本国债收益率也逼近3%的关键心理关口。全球收益率 指标 也达到2007年以来的最高水平。 “目前来看,美国消费者物价指数(CPI)走低和美联储加息是仅有的两大可能触发熔断机制的因素,否则我认为没有人会愿意长期持有利率头寸,” 澳大利亚联邦银行驻悉尼的利率策略师迈克尔·唐表示 。“现在市场鹰派情绪非常高涨。” 这令交易员们在周五的主要经济数据公布前感到紧张——尤其是在美联储官员近几周强调了对通胀的关注之后。 道明证券 美国利率策略师 莫莉·布鲁克斯 认为,高于预期的通胀数据将提振市场对9月份加息和进一步收紧货币政策的预期。 彭博社对经济学家进行的调查显示,剔除食品和能源价格的核心消费者价格指数(CPI)预计8月份环比上涨约0.2%。此前一天,一项衡量 生产者价格通胀的指标 显示,上月能源价格上涨再次对CPI构成压力。 违规率 5% 对于规模达32万亿美元的美国国债市场而言,10年期国债收益率跌破5%将对财政部长 斯科特·贝森特构成日益严峻的挑战。贝森特 一直努力阻止中期选举前债券市场的抛售。周四,财政部在首次扩大回购规模的行动中,实际 购买的 债券数量低...