储能融资租赁接连爆雷,千亿金租公司总裁被带走,交银金租、长江金租齐齐起诉,576亿赛道亮起红灯

(本文作者为 预见能源,钛媒体经授权发布)

文 | 预见能源

预见能源从多个媒体渠道获悉,光大金融租赁党委副书记、总裁魏超被有关部门带走。

消息传开时,行业里的反应可能是”果然来了”。

魏超任内最重要的事情之一,就是推动光大金租大举杀入储能。2023年代行董事长职责,2025年正式出任总裁,这期间光大金租运营了多座风光储能电站。今年3月,他和储能系统龙头海博思创签了合作协议。然后,人就被带走了。

光大金租总资产1592亿元,净利润超21亿元。一家千亿级金租公司的掌舵人,在力推的业务板块刚刚成型时出事,这件事本身已经够让同行掂量。更让行业坐不住的是,就在魏超被带走前后,交银金租和长江联合金租几乎同时把储能巨头南都电源告上了法庭。

两件事加在一起,储能融资租赁这条赛道上,警报已经拉响。

金租公司为什么集体往储能里冲

截至2025年末,金融租赁行业总资产5.23万亿元,新型储能租赁资产余额567.32亿元,同比增长154.66%。在所有业务中增速最快。

翻倍增长,这个速度放在任何一个行业里都算疯狂。金租公司不是做慈善的,它们冲进去的逻辑很清晰。

传统基建和城投业务饱和了,利差在收窄,手里攥着大把资金没地方去。储能正好撞上”双碳”风口,规模起得快,单体项目动辄上亿,而且储能电站是标准动产,权属清晰、可移动、可估值。对金租公司来说,这几乎是个完美的新赛道。

所以你能看到,国银金租、兴业金租、华夏金租、昆仑金租、越秀租赁,一排排地往里扎。远景能源拉上华润融资租赁、太平石化金租、苏州金租搞”益企储”计划。海博思创和中信银行、中信金租签协议。

大家都觉得找到了新的利润增长点。

银行业协会的数据显示,行业整体不良率0.91%。这个数字放在金融行业里是非常低的水平。但需要注意的是,这个漂亮的数据是行业平均值。在金融租赁大力扩张的新型储能等领域,风险正在暴露。随着部分企业爆雷,相关资产质量可能显著恶化,行业均值可能掩盖了局部板块的真实风险。

企业接连爆雷,金租公司被拖下水

南都电源只是一个缩影。交银金租和长江金租追着它打官司,是因为这家曾经的行业龙头两年内资产负债率冲到92%以上,163个账户被冻结,2026年7月进入预重整。金租公司手里的租赁合同,变成了一纸空文。

被拖下水的远不止这两家金租公司。

棒杰股份2022年跨界光伏,通过融资租赁加杠杆扩张。皖江金融租赁和苏州金融租赁先后起诉,法院判扬州棒杰支付租金及违约金合计超1.7亿元。截至2025年6月,光伏板块子公司借款逾期合计约8.72亿元。

同德化工子公司同德科创,被海通恒信国际融资租赁起诉,要求支付剩余租金5541.52万元。ST泉为子公司被苏银金融租赁起诉,法院判支付租金1614万元。

这些企业的共同点是什么?都是在行业高点通过融资租赁加杠杆扩张产能。2025年上半年电芯价格跌破二三线厂商成本线,储能系统价格较2023年高点跌去近八成。光伏组件价格跌到现金成本以下,全行业普遍亏损。

金租公司往里冲的时候,看的都是行业增速。没人认真想过,增速越快的行业,掉头的时候摔得越狠。

租赁物处置,一个被忽略的死穴

融资租赁的核心逻辑很简单:我出钱买设备租给你用,你还不上钱我就把设备收回来卖掉。

这套逻辑在飞机、船舶、工程机械上跑得通,因为二手市场成熟,设备残值可预期。但在储能行业,这套逻辑正在失效。

储能电池能量密度持续提升,光伏组件转化效率年年提高。三年前安装的设备,放到今天技术上已经落后一到两代。更关键的是,这些设备根本没有形成成熟的二手流通市场。

承租人违约了,租赁公司把设备拆回来,卖给谁?谁愿意接手一套技术落后、残值难以估算的储能系统?

金租公司在做项目的时候,尽调报告里写的都是”租赁物特定化、可处置”。可真到了处置的时候才发现,所谓的”可处置”只存在于PPT里。

魏超被带走,南都电源被起诉,这两件事放在一起看,折射出的问题其实是一个:金租公司在储能赛道上的风险控制,从一开始就是纸糊的。

为了抢市场,尽调标准可以放松。为了冲规模,售后回租模式下连租赁物的实物管控都做不到位。大家都在赌行业一直涨,没人想过行业跌下来怎么办。

富银融资租赁2026年上半年预亏1100万到1250万元,主因就是储能业务收入大幅下降。这还只是开始。

567亿元的新型储能租赁资产,对应的是154%的增速。这些资产里有多少正在变成不良,目前没人说得清。南都电源的案例已经说明,当一家公司的资产负债率超过92%、163个账户被冻结的时候,靠诉讼追回租金的可能性微乎其微。

魏超被带走调查,具体原因还不清楚。但这件事给整个行业敲的警钟是:过去几年在储能赛道上狂奔的金租公司们,该停下来看看自己手里到底攥着什么东西了。

光大金租的总裁被带走了,交银金租和长江金租的官司还在打。储能融资租赁这场狂欢,到了该买单的时候。

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

Continue Reading储能融资租赁接连爆雷,千亿金租公司总裁被带走,交银金租、长江金租齐齐起诉,576亿赛道亮起红灯

商业火箭“一公斤两万元”,真的有这么便宜吗?

(本文作者为 反熵,钛媒体经授权发布)

文 | 反熵

一公斤两万元,已经成了中国商业火箭最诱人的数字。

这个数字从企业规划流入证券研报和媒体标题,几经转述,已经越来越像一张可以下单的市场价目表。

2024年1月,蓝箭航天在接受媒体采访时表示,朱雀二号经过持续优化,最终价格将在每公斤4万至5万元,朱雀三号将做到每公斤2万元。此后,中科宇航提出,未来力箭二号凭借重复使用、推进剂成本和结构优化,发射成本有望降至每公斤2万多元。2026年初,箭元科技也提出,在一级复用20次的前提下,将单公斤载荷发射成本降至2万元以下。

当多家公司先后给出相近数字,一公斤两万元便逐渐从一家企业的产品目标,变成了衡量中国商业火箭能否降本的常用标尺。可这些数字采用的前提和口径并不相同。在上述公开表述中,蓝箭航天公开使用的是“价格”,中科宇航和箭元科技使用的则是“成本”。后两者虽然给出了重复使用等测算前提,但公开信息仍不足以判断这些数字包括哪些成本项、按照怎样的运力利用率计算,以及“成本”与最终面向客户的发射服务报价之间还有多大距离。

这些测算服务于产品规划,本来就要根据未来的制造成本、发射频率、载荷率和复用次数,估算火箭进入成熟运营阶段后的单位成本或服务价格。只是在一次次转述中,测算所依据的时间条件被逐渐省略,未来目标也越来越像今天已经实现的数字。

01

“一公斤两万元”最容易被忽略的,是中间那条斜杠。

如果说的是每公斤发射成本,斜杠上面应当是一次发射任务的总成本。问题在于,这笔总成本究竟包含哪些费用。

有些测算主要计算把发动机、贮箱、航电和整流罩组装成一枚火箭要花多少钱,但另一些计算还会计入运输、测试、加注、测发、靶场保障以及任务组织费用。试车台、总装厂房和发射工位也在持续折旧,一年飞两三次与飞二三十次,分摊到每次任务中的固定成本自然不同。

当讨论对象从成本变成价格,斜杠上面的数字也随之改变。每公斤发射价格的分子,是客户为发射服务支付的费用,而不是火箭公司完成任务的内部成本。

企业为了争取首飞客户、示范任务或者星座订单,可以暂时压低价格;当发射机会紧张、轨道特殊或者任务保障更加复杂时,报价又可能上浮。保险、载荷适配、分离装置和轨道转移服务,也未必包含在基础报价中。

因此,同样是“一公斤两万元”,可以指企业完成任务所付出的成本,也可以指客户购买运力所支付的价格。成本降到两万元,不代表客户一定能以两万元买到一公斤运力;对外报出两万元,也不能证明企业已经把全部成本压到两万元以下。

02

斜杠下面的“公斤”,同样没有看起来那么简单。

假设一枚大型液体火箭完成一次任务的总成本为2亿元,近地轨道最大运力为20吨,直接相除,每公斤只要1万元;如果当次实际只装入5吨载荷,单位成本立即变成4万元。若2亿元还是未来批产后的预计成本,而首批火箭的制造和任务保障费用更高,实际数字还要继续上升。

成本测算如此,价格折算也面临同样的问题。客户购买的并非可以任意切分的一公斤运力,而是特定轨道、发射窗口和接口条件下的一次运输机会。卫星的体积、外形和部署顺序,都可能比重量更早触及限制;火箭即使还有剩余运力,也未必能临时找到条件合适的卫星补上。

猎鹰9号就是最清楚的例子。NASA一篇研究曾用6200万美元的公开价格除以22.8吨最大近地轨道运力,得到2720美元/公斤。这个数字采用的是整箭公开价格和额定运力,并不是SpaceX披露的内部成本。

SpaceX目前公开的太阳同步轨道拼车起价则是50公斤35万美元,超出部分7000美元/公斤。对小卫星客户而言,这才是一种可以实际预订的拼车服务价格。

同一枚火箭,2720美元是用整箭价格和最大运力计算出的理论值,7000美元则是小卫星客户购买有限运力的拼车价格。两者都来自公开价格,却不是同一种产品。

国内的真实采购数据也呈现出类似差异。长光卫星在上交所问询回复中披露,2020年至2023年上半年,其单位重量火箭发射费用总体在每公斤7.52万至10.17万元之间;宽幅系列及“一箭41星”任务约为5.94万至7.46万元,其他卫星则达到12万至15.09万元。

真实市场里,从来没有一个脱离轨道、载荷率和服务条件的统一公斤价。

03 

火箭公司的真实成本通常不会完整公开。目前外界能够观察到的,主要是企业报价、卫星客户披露的发射支出,以及按照额定运力进行的理论折算。它们不足以还原企业内部成本,却可以大致呈现国内商业发射服务的价格水平。

按照现有公开数据粗略估算,每公斤5万至10万元更接近当前国内商业发射的常见报价和客户支出。中大型火箭在载荷较满时可能进一步降低,但国内许多液体型号仍处于首飞、复飞或早期运营阶段,生产线、试验设施和发射工位尚未充分利用,实际任务也未必每次接近满载。

也有一种更乐观的判断:中国拥有完整的制造业体系,即使液体火箭不回收,也能依靠供应链和规模生产追上猎鹰9号。力箭二号首飞后,其总指挥在接受《科创板日报》采访时表示,该火箭不回收状态下的单次发射成本为每公斤3万元,与猎鹰9号每公斤5000美元基本相当。

但双方均未公开具体核算口径,3万元采用额定运力还是实际载荷,5000美元又包括哪些成本,目前都无法核验。数字接近显示了中国制造的降本潜力,却不足以证明双方的真实成本已经相当。

完整的供应链可以降低发动机、贮箱、结构件和航电产品的采购与制造费用,也能通过标准化和批量生产继续降本。但不用回收,一级箭体和发动机每飞一次仍要重新生产。供应链可以把下一枚一级造得更便宜,却无法省去重新制造这一环节。

因此,每公斤2万元仍是建立在批量生产、较高载荷率或多次复用之上的未来目标,不能直接当做今天已经兑现的市场价格或企业成本。

04

重复使用有机会降低火箭成本,但火箭回来以后,成本不会自动除以复用次数。

一级复用十次,能够摊薄的主要是一级制造成本。二级仍要重新生产,回收场地或平台、返程运输、检测、翻修和部件更换也会产生费用。采用动力回收的一级还要预留再入、减速和着陆所需的推进剂,并增加回收相关装置,能够送入轨道的载荷随之减少。因此,不能用回收任务的成本,去除以一次性构型的最大运力。

设计复用二十次与真正飞满二十次之间,还隔着损伤、故障、翻修周期和任务需求。即使一级具备飞行二十次的寿命,如果一年只有三次任务,它也要等待很多年。复用的经济性最终取决于一年能够飞多少次,也取决于每次复飞需要付出多少检测和维护成本。

中国已经完成轨道发射后的一级回收验证,接下来真正能够回答成本问题的,是回收一级能否再次发射,复飞需要多长时间,又要更换多少部件。完成复飞,回收才从一次飞行结果变成可重复使用的工程能力;连续复飞并把客户价格压下来,才能进一步转化为商业结果。

所以,一公斤两万元不是假话,却是一句带着许多前提的真话。

以后再看到一个低得惊人的公斤数字,可以继续追问:说的是成本还是价格,包含哪些费用和服务,采用什么构型、送往哪条轨道;分母使用额定运力还是实际载荷,是否回收,以及回收一级究竟已经复飞了多少次。

当“一公斤两万元”能够在实际发射中反复兑现,并支撑火箭公司持续运营,它才算从未来时变成现在时。

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

Continue Reading商业火箭“一公斤两万元”,真的有这么便宜吗?

AI救活了马桶企业?股价一年暴涨120%,靠AI芯片赚疯了

(本文作者为 新质动能,钛媒体经授权发布)

文 | 新质动能

马桶公司靠AI赚翻了。

截至2026年3月的最新财年,日本知名卫浴企业TOTO的归母净利润达到403亿日元(约合人民币17.52亿元),是上一财年的3.3倍。与AI相关的板块销售额暴增34%,营业利润大涨42%。

过去一年里,TOTO股价一度上涨超120%。8月5日,最新财报发布后,高盛又给出“强烈买入”评级,目标价较当时股价隐含超过76%的上涨空间。

有网友调侃:“还以为智能马桶都内置AI了,蹲坑的时候能陪你聊天。”但TOTO这次吃到的AI红利,和“AI马桶”没什么关系。

这家日本卫浴巨头真正搭上的,是AI芯片背后的材料生意。公司的先进陶瓷,营收只占集团总营收约10%,却贡献了超过一半的集团利润。

对一家以马桶、卫浴洁具闻名的百年企业来说,这样的表现多少有些出人意料。不仅如此,一批卖马桶、卖味精、做日化的传统企业,也悄悄吃上了AI红利……

一、马桶越卖越差,股价却越涨越猛

近一年来,日本知名卫浴企业TOTO,股价一度最高上涨约120%,明显跑赢同期日本大盘。但资本市场最近关注它,却并不是因为马桶卖得有多好。而是集团内部一块规模并不算大的业务:先进陶瓷。

过去一个财年,TOTO先进陶瓷业务销售额同比增长34%,营业利润同比增长42%,达到289亿日元。更关键的是,这块业务营收只占集团总营收约10%,却贡献了超过一半的集团利润。

按最新披露口径计算,先进陶瓷业务贡献了TOTO集团约61%的营业利润,利润率达到30%,是卫浴主业的三倍有余。

也就是说,先进陶瓷虽然不是TOTO最大的业务,却正在成为这家公司最赚钱的业务之一。

截至2026年3月的最新财年,TOTO总销售额7374亿日元,同比增长2%;营业利润538亿日元,同比增长11%;归属于母公司股东的净利润403亿日元,是上一财年的3.3倍。

今年2月,英国激进投资机构Palliser Capital专门致信TOTO董事会,称其是“最被低估、最被忽视的AI受益者之一”,并建议公司进一步加大半导体业务投入。

路博迈亚洲主题股票投资负责人温演道也表示,这轮AI热潮不仅带动了芯片企业,也让一些看似与科技业毫无关系的日本传统制造企业进入市场视野,TOTO正是其中的代表。

那么,TOTO的先进陶瓷,究竟是怎么搭上AI这趟车的?

答案指向一个绝大多数消费者从没听说过的陶瓷零件:静电吸盘。

芯片制造的刻蚀工序中,硅晶圆需要被牢牢固定,同时又不能让机械夹具直接接触晶圆表面,否则容易造成污染,影响芯片制造。

于是,工程师利用静电产生的吸附力,将晶圆固定在加工平台上。这个负责“吸住”晶圆的部件,就是静电吸盘。

看起来只是一个“吸盘”,但它面对的却是芯片制造中极其苛刻的环境。它不仅需要极高的尺寸精度,还要耐受等离子体侵蚀,实现精确控温,保持稳定的绝缘性能,并拥有足够长的使用寿命。

这也是为什么静电吸盘对材料的要求如此苛刻。在极端的加工环境下,金属容易受到腐蚀,聚合物也可能发生分解,而高纯度氧化铝陶瓷则成为重要的材料选择。

而这恰恰是TOTO做了一百多年卫浴陶瓷积累下来的能力。TOTO成立于1917年,是日本最知名的卫浴企业之一,主营卫浴洁具、厨房产品等,在全球多个市场都有业务。

二、从卫浴陶瓷到芯片吸盘,TOTO花了几十年铺路

TOTO并不是因为AI才突然闯进半导体行业。

早在上世纪80年代,TOTO就已经开始布局半导体材料,把长期做卫浴陶瓷积累下来的高温烧结等工艺,逐步应用到半导体领域。

说来有趣,两个八竿子打不着的行业,底层材料科学却出奇地相通。

马桶需要耐腐蚀、耐污染、长期稳定,半导体设备里的陶瓷部件,恰好也要面对高温、腐蚀性气体和极端洁净环境。

只是,这条跨界路线走得并不顺利。

在AI浪潮到来之前,TOTO的半导体材料业务长期表现平淡,甚至一度持续亏损。直到2020年前后,公司推动部分生产线自动化改造,成本结构开始改善,随后AI芯片需求快速增长,静电吸盘订单也随之增加,这块业务才真正迎来拐点。

不过,TOTO并不是简单地把陶瓷卖给芯片厂,而是进入了半导体设备供应链。

目前,TOTO主要向应用材料、泛林集团、东京电子等半导体设备厂商供应静电吸盘,设备厂商再将搭载相关部件的刻蚀设备交付给三星、SK海力士、美光等晶圆厂。

这门生意还有一个特点:静电吸盘是会消耗的。

随着设备持续运行,吸盘需要定期更换,这意味着TOTO卖出的并不只是一次性的设备零件,而是一门能够持续产生复购的耗材生意。

中国市场同样是这条供应链的重要一环,中芯国际、长鑫存储、长江存储、华虹等晶圆厂均使用相关设备。

AI需求带来的订单增长,也开始反过来推动TOTO加大投入。

TOTO计划未来五年向半导体材料业务投入约800亿日元,约合33.5亿元人民币。其中390亿日元的投资项目已经确定,其余资金将根据市场需求逐步投入,主要用于扩大AI相关产品产能,并推进面向1nm时代的下一代材料研发。

作为参考,目前台积电最先进的量产逻辑芯片才刚进入2nm节点。

截至2026年3月的财年,半导体相关业务仅占TOTO总资本开支的11%,但未来几年,这个比例预计将超过一半。

可以说,TOTO并不是突然踩中了AI风口,而是终于等到了一个足够大的需求场景。TOTO真正押中的,或许并不是AI本身,而是自己积累了几十年的材料和制造能力。

三、卖味精的、做日化的,也悄悄吃上了AI红利

TOTO并不是唯一一个吃到这波红利的日本传统企业。

在AI产业链上,还有一些看起来更加“不搭边”的公司,早就藏在芯片产业的上游。

比如味之素。这家以味精闻名的企业,在上世纪90年代中期研发过程中,从味精发酵副产物中发现了一种绝缘性能优良的树脂材料,并在1999年将其做成ABF积层膜。

如今,这种材料已经成为CPU、GPU等高性能芯片封装基板的重要材料,味之素在全球高性能半导体用绝缘膜市场的份额超过95%。

最新财年,味之素相关业务所属板块利润同比增长45.1%,达到662亿日元。今年5月,公司还宣布收购新的工业用地,用于扩建生产设施。

另一边,做洗护产品起家的花王,也在半导体产业链中找到了自己的位置。

花王切入的是半导体清洗剂。芯片制造过程中,晶圆要经历大量复杂工序,每次加工后都需要进行清洗,以去除表面的颗粒和残留物。看起来只是“洗东西”,但在纳米级芯片制造中,清洗本身就是决定良率的重要环节。

花王凭借多年积累的清洗技术进入这一市场,目前市占率超过六成。据花王年报介绍,半导体制造工序超过500道,其中清洗环节占到三到四成,公司也在持续扩大相关产能。

如果把TOTO、味之素和花王放在一起看,会发现它们其实有一个很有意思的共同点:它们都没有真正去做AI。

TOTO没有去造AI芯片,味之素也没有去开发大模型,花王更没有转型做AI软件。它们真正提供的,是芯片制造过程中那些不太起眼,却又很难被替代的材料和零部件。

这也是AI产业链最容易被忽略的一面。

当市场把目光集中在英伟达、OpenAI等热门标的时,一批卖马桶、卖味精、做日化的传统企业,也正在凭借几十年前埋下的技术种子,获得这轮AI浪潮带来的意外红利。

参考资料:

《AI浪潮救活了马桶企业,基金经理:不买英伟达,买它》,腾讯财经;

《卖马桶的TOTO杀疯了,成了AI芯片的幕后赢家》,APPSO;

《马桶公司,靠AI发财了》,浪潮工作室;

《东亚土老板,正在集体”反杀”AI》,凤凰WEEKLY;

《一家马桶公司成了AI概念股》,第一财经;

《黄仁勋,被马桶巨头”卡脖子”?》,中国新闻周刊;

《杀疯了!万亿巨头,突然暴涨超18%!发生了什么?》,券商中国;

《这家卖马桶的日企,成了AI概念股?》,科创日报;

《卖马桶的,靠AI芯片赢麻了》,芯东西;

《TOTO单季营收71亿元,中国大陆事业改善显著》,厨卫资讯;

《TOTO2025财年销售额约320.53亿元,净利润达上年3.3倍》,厨卫头条。

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

Continue ReadingAI救活了马桶企业?股价一年暴涨120%,靠AI芯片赚疯了

Grok 4.6上了牌桌,马斯克还差一部《奥德赛》

(本文作者为 AIX财经,钛媒体经授权发布)

文 | AIX财经,作者 | 陈丹,编辑 | 魏佳

马斯克想让Grok在今年年底前拍完一部《奥德赛》。

这听起来像一个典型的马斯克式Flag:用AI挑战诺兰、好莱坞和2.5亿美元制作预算。但真正值得关注的,并不是Grok能不能在五个月里生成几千个镜头,而是它是否已经拥有把一项复杂任务从头做到尾的能力。

Grok 4.6发布后,这个问题有了更具体的答案。

在最新一轮模型竞争中,它已经挤进美国大模型的第一梯队:能力接近OpenAI和Anthropic的旗舰模型,编程成绩甚至在部分榜单领先,API价格却明显更低。与此同时,它在长链条Agent任务上的短板依然存在——会理解问题、会搭框架、会快速启动,却还不够稳定地收尾。

这恰好也是眼下大模型竞争的缩影。

当能力差距缩小、Token越来越便宜,真正决定商业价值的,已经不只是“模型有多聪明”,还要看一次任务能否稳定完成,以及完成一次到底要花多少钱。

对于一年向AI投入上百亿美元资本开支的马斯克来说,Grok也不能只是偶尔冲上一次榜单。它必须持续留在第一牌桌,并把算力、数据和分发真正变成收入。

01.Grok 4.6上了牌桌,但还拍不了《奥德赛》

诺兰的《奥德赛》上映前,马斯克已经骂了这部电影好几轮。骂选角,骂改编,骂诺兰为了奥斯卡“亵渎荷马”。电影上映后,他干脆在X上立了一个Flag,今年年底前,Grok Imagine要做出一部“符合历史、忠于荷马艺术”的完整《奥德赛》。

马斯克转发的三分钟《奥德赛》短片确实不错。盔甲、海岸、人物特写都有电影预告片的质感,但三分钟精修短片和九十分钟长片之间,还隔着几千个镜头,以及一群AI演员。

趁着Grok 4.6发布,我们没有再测试视频,而是给它出了两道更适合语言模型的题。第一道,看它能不能读懂荷马。第二道,看它能不能搭出一套把三分钟样片扩展成九十分钟长片的制片系统。

第一题,Grok答得比马斯克本人靠谱。

“符合历史”和“忠于荷马”听起来不难,真翻开《奥德赛》就会发现,这两个维度很难同时实现。《奥德赛》经过数百年口述传播,青铜时代的武器、铁器时代的习俗和诗人的神话想象全叠在一起。你可以考证奥德修斯该用什么剑、坐什么船,却没法从遗址里挖出独眼巨人、女神和冥界。

Grok把问题拆成了四层,青铜时代考古、荷马史诗里的混合时间层、作品本身的诗学,以及诺兰的现代改编。

它给出的办法是,考古负责约束器物、服装和地理,荷马负责约束人物、叙事和诗学。它还顺手纠正了一个流传很广的错误,「让千艘战船起航的面孔」出自马洛,不是荷马。

这题说明Grok 4.6不仅会查资料,还能拆开一个内部冲突的命题,替争议双方构造最强论证。

第二题更接近真正的制片工作。

Grok搭了一个《奥德赛》制片计算器,把成片时长、平均镜头长度、首轮可用率、复杂镜头占比、并发任务数、人工审核时间、成本和工期全部做成可调参数。

Grok4.6生成的电影制片系统

按照默认参数,它估算一部90分钟长片需要约208个工作日。Grok自己算完都觉得有点悬,最后给出了一条“识时务”的建议:做一部12到20分钟的荷马选篇。

当然,208天不能当作实测结果。首轮可用率、连续性失败率、每个可用镜头需要生成几次,都是模型设定的假设。计算器证明Grok会拆解工程、建立公式和搭建生产系统,没有证明这套系统真的能在208天内交片。

而且,它点出了AI电影最难的部分。现在生成一个漂亮镜头已经不稀奇。难的是让几千个镜头中的脸、衣服、船只、空间和叙事保持一致,同时把废片、重做和人工审核压到制片方能承受的范围。

外部榜单给出的结论差不多。

在Artificial Analysis的榜单上,Grok 4.6的综合智能指数是61分,与GPT-5.6 Sol同分,距离Claude Fable 5只有1分。CursorBench 3.2上,Grok 4.6 High拿到69.9%,超过Sol的67.2%。它完成一次任务的成本约2.34美元,Sol约5.69美元。Grok 4.6的API的起价在每百万输入Token 2美元、输出6美元——价格确实有杀伤力。

图源 / SpaceX

但到了DeepSWE和TerminalBench这类长链条任务,Grok分别拿到65.9%和26%。Sol是73%和34.6%,Fable 5是70%和34.1%。

Grok已经很会理解问题、启动项目和搭建框架,到了需要连续执行、处理意外和稳定收尾的阶段,仍然会掉链子。

综合来看,Grok 4.6已经坐上美国大模型的第一桌,而且在OpenAI和Anthropic旗舰模型面前,打出了一张很凶的性价比牌。

它会读荷马,会写分镜,会算工期,也会搭制片系统。只是奥德修斯漂了十年才回到伊萨卡,想让Grok在年底前带着几千个连续镜头顺利“返乡”,现在看还很难。

02.35天一代,马斯克先要确保Grok别掉队

从7月8日Grok 4.5开始对外推送,到8月12日Grok 4.6发布,中间只隔了35天。马斯克还预告,拥有2.1万亿参数的Grok 4.7将在几周后到来,能力更强,Token效率更高,只是推理稍慢。

4.7还没发布,参数和能力也只有马斯克一家的说法,但4.5到4.6至少完成了一次有效的月度升级。如果4.7按时落地,SpaceXAI就更显示出自己能够停留在第一梯队的能力。

这件事放在两年前,还有点难以想象。

2023年11月,Grok-1发布时,OpenAI已经拿出GPT-4,Anthropic已经发布Claude,Google背后则有TPU、搜索和云。那时候,Grok更像X Premium附赠的聊天机器人,企业客户、开发者生态和模型透明度都没建立起来,B端的市场占有率也很低。今年4月,在Ramp客户的企业付费样本里,xAI的采用率只有1.9%,而Anthropic和OpenAI的这一数字分别是34.4%和32.3%。

在很多从业者的眼中,和Meta一样,SpaceXAI的大模型也长期困于第二梯队。

但现在Grok端着凳子挤过来了。它能追上来,主要是大力出奇迹,靠算力、数据和工程速度一起硬堆。

xAI用122天建成了首期10万张Hopper GPU的Colossus,随后又用92天扩到20万张。服务器到场19天后,集群已经开始跑训练任务。黄仁勋把这段部署速度称为“超人级”。X给Grok提供实时信息、用户和分发入口。Cursor则提供真实的编程任务和开发者与Agent的交互数据。Cursor称,Grok 4.5的训练使用了数万亿Token的Cursor数据。

模型也不必每个月从头练一遍。Grok 4.6建立在4.5的基础上,主要升级监督微调、强化学习和Agent训练环境。Colossus负责把训练规模堆上去,X和Cursor负责不断喂回真实任务,SpaceXAI再用后训练把这些任务压进下一版模型。

这套流水线跑顺以后,版本号就能按月往前拱。

Grok也必须跑这么快,因为SpaceX已经把太多钱押在AI上了。

SpaceX招股书显示,2025年AI分部收入32亿美元,经营亏损64亿美元,资本开支127亿美元,占公司总资本开支约61%。2026年一季度,SpaceX又向AI分部投入77亿美元,占全公司资本开支的76%。到了2026年二季度,AI分部资本开支进一步升至158.28亿美元,占三大分部资本开支的约86%,单季已经超过2025年全年;上半年累计达到236亿美元。

SpaceX给投资者讲的故事已经很明确。公司把AI和Space、Connectivity并列为三大业务分部,并把AI称为未来垂直整合的基础平台。在SpaceX自己测算的28.5万亿美元可量化市场中,AI占26.5万亿美元,火箭和卫星连接业务加起来只有约2万亿美元。马斯克预计AI收入可能在2026年9月超过SpaceX其他业务收入之和,四五年后,AI可能贡献SpaceX 99%的公司价值。

Grok是这笔重投入能否获得更高回报的关键变量。AI分部可以直接把算力卖给第三方,但只有自有模型稳定留在第一梯队,SpaceX才有机会把同一套基础设施向上延伸到API、订阅和Agent等更高附加值的业务。

如果Grok保持第一梯队,SpaceX可以同时赚模型、应用和算力的钱,还能用自己的模型给Colossus乃至未来的轨道算力制造需求。如果Grok掉队,Colossus照样可以把GPU租给Anthropic和Google,但SpaceX会从全栈AI公司退回成重资产算力房东,负责建机房、买芯片和交电费。

而且236亿美元资本开支,如果最后只训练出一个二流模型,这个故事恐怕马斯克自己都不好意思讲。

03.从比Token单价,到比“一次交付”

过去几个月,大模型竞争堪称惨烈。

Anthropic依靠Claude Code和Fable 5在编程场景建立优势,OpenAI随后用Codex和新模型追赶,Grok又在一个多月内连续更新两代。

榜单前排的保鲜期,已经从几个月缩短到几周。当头部模型之间的能力差距只剩几个百分点,另一个数字就会变得格外显眼——价格。

来自中国的模型,把这种压力进一步往前推。

7月,月之暗面发布拥有2.8万亿参数和100万Token上下文的Kimi K3。它的价格虽不算便宜,但开放权重本身就在削弱头部模型厂商对推理价格的控制力。

DeepSeek走得更彻底。截至8月13日,DeepSeek V4 Flash每百万输入和输出Token的价格分别只有0.14美元和0.28美元。在DeepSeek公布的结果中,它的推理能力已经接近V4 Pro,简单Agent任务也能做到相近水平。当天,DeepSeek虽然宣布从北京时间8月17日0点起改用峰谷定价,但即便按高峰价计算,仍明显低于Grok 4.6的2美元和6美元。

OpenAI也开始重新算这笔账。

7月30日,在GPT-5.6发布仅三周后,OpenAI将Luna价格下调80%,Terra下调20%。目前,Luna每百万输入和输出Token分别为0.2美元和1.2美元,Terra则为2美元和12美元。

OpenAI的打法非常清晰:Sol处理最复杂的判断和规划,Terra承担日常工作,Luna执行大量边界清晰、重复度高的任务。它争夺的是通过模型分工,把整条工作流的平均成本压下来。

图源 / Artificial Analysis

大模型竞争由此进入了一套更复杂的计分规则。

模型能力决定能不能上桌,长任务可靠性决定客户敢不敢把活交给你,单位任务成本决定客户能够用多少次。再往后,还要比较算力、分发、企业客户,以及持续烧钱的耐力。

Token单价只是其中最容易看到的数字。

一个模型即使每百万Token便宜一半,如果执行任务需要更多步骤、更频繁重试,或者总是在最后20%失败,节省下来的推理费用很快就会被返工和人工审核吃掉。客户真正购买的,其实是一次成功交付。

这也是为什么Grok 4.6眼下最值得关注的指标,并不只是2美元输入、6美元输出。如果它能以更低成本完成同样的任务,它就是更便宜的模型;但如果它在TerminalBench这类长任务里更容易失败,那么“便宜”就可能只是停留在价目表上。

拿这把尺子再看硅谷,各家手里的牌并不相同。

Anthropic握着Claude Code、长任务能力和企业客户信任,但它必须不断证明,这些优势值得更高的价格。OpenAI拥有ChatGPT、Codex和覆盖不同价位的模型矩阵,可以在能力、速度和价格之间灵活调兵。Google手里则有TPU、Google Cloud、搜索、Workspace和Android,可能是所有玩家中基础设施和分发最完整的一家。Meta走的是另一条路,通过开放权重和社交平台分发,不断压低通用模型能力的稀缺性,只是如何把这种影响力真正转化成收入,始终是另一道题。

SpaceXAI的特殊之处在于,它没有哪一张牌绝对领先,但几张牌已经开始互相喂养。Colossus提供算力,X提供实时信息、用户和分发,Cursor提供真实编程任务、工具调用轨迹和开发者反馈,Grok再把这些资源转化成API、订阅和Agent产品。模型进入X和Cursor之后产生的新反馈,又可以继续回到下一轮后训练。

随着Grok重新挤进第一牌桌,黄仁勋2025年的一段评价也被重新翻了出来。他当时认为,马斯克同时押注基础模型、自动驾驶和人形机器人,进入了AI最重要的三个方向,并因为掌握大量真实世界数据而处在“绝佳位置”。这个判断现在更容易理解了。

但拥有版图,不等于已经形成闭环。

特斯拉仍然是一家独立公司。自动驾驶、机器人、X和Grok之间究竟能够共享多少数据、模型和客户,还受到组织边界、隐私与监管的约束。SpaceXAI也没有Google Cloud、Microsoft Azure或者企业办公软件那样成熟的销售和交付渠道。

更现实的问题是,Grok在TerminalBench等长链条Agent测试中仍然落后。企业客户对于安全、稳定性、透明度以及品牌风险的顾虑,也没有因为一次榜单上升就自动消失。

从“最有性价比的第一梯队模型”到“最大的商业赢家”之间,仍然隔着可靠性、企业信任、渠道和真实采用率。

就像马斯克想让Grok拍完《奥德赛》一样,生成短片已经不是最难的事。真正难的是,别在返乡路上翻船。

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

Continue ReadingGrok 4.6上了牌桌,马斯克还差一部《奥德赛》

DeepSeek Harness 公测,对标 Claude Cowork ;长鑫科技市值超越腾讯;OpenAI 年化营收有望翻番达 400 亿美元

对标 Claude Cowork:DeepSeek Harness 公测,同步开放插件生态

8 月 13 日消息,DeepSeek-V4-Pro-0813 正式开源,同时还推出了其开源(MIT 协议)的代码智能体框架 Harness 的 v0.1 开发者预览版(基于 Cordis),并同步开放了配套的插件生态系统。相关 GitHub 仓库也已公开。

DeepSeek 正式开源 DeepSeek‑V4‑Pro‑0813 模型,同步推出基于 Cordis、采用 MIT 协议的代码智能体框架 Harness v0.1 开发者预览版,并开放配套插件生态,GitHub 仓库现已公开,开发者可通过 npx 命令或源码两种方式启动 WebUI,该产品定位对标 Claude Cowork 与 OpenAI Codex,面向编程办公 AI 生产力场景。

Harness 贯彻「一切皆插件」的设计理念,依托 Cordis 元框架,模型、工具、UI、沙箱等全部 Agent 能力都以插件形式存在,无需修改源码就可以自由替换扩展。框架提供 dsh 命令行工具,拥有标准、PTC 程序化工具调用、极简、创造四种运行模式,适配基准测试、插件开发等不同开发者场景,落实「模型 + Harness=Agent」的技术思路,完成从需求理解到代码交付的闭环。

DeepSeek‑V4‑Pro‑0813 为 MoE 混合专家架构,总参数 1.6 万亿,推理时仅激活 490 亿参数,拥有 100 万 token 上下文窗口,最大输出 38.4 万 token,支持思考 / 非思考模式,兼容多种主流 API 接口。内部测评显示,该版本相比预览版能力大幅提升,多项测试接近甚至超越 Claude Fable 5,编程相关基准分数提升显著。

该模型权重基于 MIT 协议开放,开发者可以直接下载本地部署,不再单纯依赖云端服务,普通通用算力卡即可运行,降低政企私有化部署门槛,也提升供应链抗风险能力。(来源:IT 之家)

备战 IPO 上市:彭博社称 2026 年 OpenAI 年化营收有望翻番达 400 亿美元

8 月 14 日消息,彭博社发布博文,报道称在收 IPO(首次公开募股)上市前,OpenAI 的发展势头良好,2026 有望实现年化收入超过 400 亿美元(现汇率约合 2,702.76 亿元人民币),比 2025 年收入(约 200 亿美元(现汇率约合 1,351.38 亿元人民币))翻一番。

据彭博社报道,联合创始人兼总裁格雷格 · 布罗克曼在内部公告中告知员工,仅 7 月份,月度营收增长率就增长了 20% 以上。首席财务官莎拉 · 弗莱尔此前曾指出,公司经历了快速扩张期,2025 年的年化营收增长率超过 200 亿美元(现汇率约合 1,351.38 亿元人民币)。

在市场竞争方面,Anthropic 在今年 5 月公布的年化营收为 470 亿美元(现汇率约合 3,175.75 亿元人民币),不过彭博社指出由于两家公司在计算统计上存在差异,很难直观、公平对比两家公司的年化营收。

在市场竞争策略方面,OpenAI 公司为抵御外部竞争对手的冲击,捍卫市场份额,积极调整其市场策略和定价策略,通过降低部分 AI 模型的价格,从而吸引注重成本的开发者。OpenAI 公司还聘请了一位经验丰富的网络安全高管,以提振企业销售。(来源:IT 之家)

投资者押注 Anthropic 估值达 2 万亿美元,冲击史上最大 IPO

Anthropic 的投资者正押注这家 AI 初创公司将在 10 月以 2 万亿美元或更高的估值上市。如果成真,这将超越 SpaceX,成为史上规模最大的 IPO。多位公司早期投资者表示,Anthropic 收入的爆发式增长,足以支撑其在秋季上市时将当前估值翻倍以上。

投资者认为,市场对 Anthropic 先进 AI 模型与工具的强劲需求,足以支撑这一高估值。按公司偏好的年化收入计算方式(根据近期表现推算全年销售额),他们预计到 2026 年底,Anthropic 的年化收入将达到 1000 亿至 1200 亿美元,相当于在 2026 年实现超过 10 倍的增长。

一位投资者表示:「如果 Anthropic 年增长 800%,哪怕按极低端的 30 倍收入估值,也该是个 3 万亿美元的公司。」

目前 Anthropic 缺乏直接可比的美国上市同业。但被视为 AI 受益者的公司,如 Palantir 和 Nebius,今年的估值大约在 55 倍收入左右。多位投资者透露,Anthropic 高管尚未在私下确定最终估值目标,但他们已各自建立财务模型。

乐观预期背后,公司面临多重压力:来自竞争对手的「斩杀」、AI 监管压力,以及与美国政府之间的紧张关系。

Anthropic 已于 6 月向美国证券交易委员会提交上市文件,目前处于静默期。2 万亿美元的 IPO 预期,既反映了市场对其增长速度的极度乐观,也暴露出 AI 行业高估值背后的巨大不确定性。(来源:环球市场播报)

长鑫科技超越腾讯控股,成中国市值最高上市公司

8 月 13 日,腾讯控股收跌 4.46%,市值报 4 万亿港元,约合 3.44 万亿元人民币。长鑫科技当日收盘市值为 3.5 万亿元人民币,已超越腾讯控股,成为中国市值最大的上市公司。

7 月 27 日,国产 DRAM 存储龙头长鑫科技正式登陆科创板,彻底「引爆」A 股资本市场。上市首日,长鑫科技开盘报 49.5 元/股,较 8.66 元/股的发行价暴涨 471.59%,盘中一度来到 55.03 元/股的高点。截至当天收盘,长鑫科技报 49 元/股,单日涨幅 465.82%,总市值达 3.28 万亿元,一举超越工商银行,成为 A 股有史以来首家在上市首日收盘即登顶市值榜首的公司。

8 月 12 日,腾讯控股披露财报显示,第二季度营收实现 2047.9 亿元,同比增长 11%,预估 2028.4 亿元。财报显示,二季度,腾讯游戏收入同比增长 11%,其中本土游戏收入增长 17%,国际游戏收入按固定汇率计算增长 4%;营销服务收入同比增长 22%;金融科技及企业服务收入同比增长 9%。(来源:凤凰网科技)

维珍银河新一代 Delta 级飞船首飞推迟至 2027 年,75 万美元太空票获超额认购

8 月 13 日消息,维珍银河(Virgin Galactic)在 2026 年第二季度财报电话会议上宣布,其新一代「Delta 级」亚轨道太空飞机的首次商业飞行将推迟至 2027 年 2 月。此前的计划是在 2026 年第四季度开始商业运营。

维珍银河 CEO 迈克尔 · 科尔格拉齐尔(Michael Colglazier)表示,此次推迟并非由单一重大问题导致,而是在新飞船的组装过程中遇到了「数百个相对较小但重要的安装任务」的工期延长。

他举例称,许多组件的尺寸存在「千分之几英寸」的偏差。科尔格拉齐尔指出,这类「未预期到的安装不匹配」数量超出了预留的缓冲时间,尤其是在 7 月底之后此类问题开始加速累积。他强调,团队需要更多时间来以正确的方式完成工作。

根据调整后的计划,维珍银河预计将于本月晚些时候开始集成飞行器地面测试,并于 10 月将该飞行器运至美国新墨西哥州的美国太空港(Spaceport America)开始一系列飞行测试。公司已增派人员以加快组装进度,实行两班倒、每周工作七天的工作制。

维珍银河还宣布,已完成今年 3 月启动的以每张 75 万美元(现汇率约合 506.8 万元人民币)价格销售的一批太空旅行机票。原计划销售 50 张,因需求旺盛超额认购,总预订金额超过 5,000 万美元(现汇率约合 3.38 亿元人民币)。( 来源:IT 之家)

部分 Claude 模型将添加「文本水印」,Anthropic 回应各界关切

8 月 13 日消息,Anthropic 本周宣布,部分 Claude 模型会直接在输出文本中嵌入一种「难以察觉的水印」。内容被复制粘贴后,水印仍会随文本保留,经过一定程度修改后也可能继续存在,用于帮助判断一段文字究竟由 AI 生成还是由人类撰写。

Anthropic 目前尚未公开水印系统的完整技术原理。技术细节的不透明已经引发一些科技从业者担忧。具体来看,版权如何认定、Claude 输出质量是否会受到影响,以及只使用 AI 进行少量辅助的作品会不会因此被误判等问题,备受关注。

据《商业内幕》报道,Anthropic 就 Claude 文本水印相关争议作出回应。针对投资人担忧只有该公司能识别水印,形成既当裁判又当判定方的问题,Anthropic 表示会开放免费 API,允许普通用户与第三方自行检测文本水印。

不少开发者和行业人士顾虑水印的判定边界,担心轻微修改、仅交给 Claude 校对语法的文本,也会被判定为 AI 创作。Anthropic 称水印不会损害文本质量与可读性,水印仅代表该文本经过 Claude 处理,即便只是校对、翻译、总结,都可能留存水印,不等于全文由 AI 撰写中国新闻网。

这项水印机制从 8 月 2 日起在全球 Claude 可用模型落地,目的是遵守欧盟《人工智能法》,同时也引发隐私、版权方面的争议,有业内人士提出它会干扰版权判定,还会带来数字痕迹留存问题。(来源:IT 之家)

张雪机车获红杉中国投资,双方将共同挑战世界级产品、世界级赛场

8 月 13 日消息,张雪机车官微晚间宣布获得红杉中国投资,将共同挑战世界级产品、世界级赛场。双方未来将围绕企业治理、人才建设、产业资源和全球化发展展开深度合作,让中国高性能摩托车驶向全球。

官微没有公布此次投资的规模。不过,张雪机车早期投资人高信资本创始合伙人兼董事长曹斌近日在接受访谈时透露,红杉中国这笔投资金额规模为 1.5 亿元,张雪机车投后估值达到 60 亿元。

据此前报道,张雪机车去年营收 6.7 亿元,今年有望达到 20–25 亿元,有望实现 2 倍以上增长。

张雪机车创始人张雪于 7 月 3 日宣布,张雪机车 6 月份产量突破 1 万台。(来源:IT 之家)

OpenAI 推出全新 Mac 端功能,ChatGPT 无需截屏即可完成记忆用户操作

据悉,OpenAI 宣布为 macOS 上的 ChatGPT Work 和 Codex 推出了一项名为「电脑历史(Computer History)」的全新可选功能。该功能面向 Pro、Business 和 Enterprise 用户开放,在获得用户授权后,它能够跨应用和网站追踪用户的日常电脑操作活动,并将其转化为记忆和时间线。

这一功能将极大地提升 ChatGPT 的上下文理解能力。用户无需再重复解释背景信息,只需询问诸如「我昨天在调试什么?」或「那个 PR 我处理到哪了?」等问题,ChatGPT 就能根据历史记录,在 Google Docs、Slack 或浏览器标签页中精准定位相关文件、文档和对话。

值得注意的是,OpenAI 强调该功能在运行过程中不会像微软此前备受争议的 Recall 功能那样持续截取电脑屏幕。OpenAI 的 Dominik Kundel 在发布视频中指出,「电脑历史」功能不依赖屏幕或音频捕捉,而是通过捕捉点击、打字、应用切换等交互事件来更快速、高效地生成记忆。这也有别于 OpenAI 早期使用屏幕截图和 OCR 技术的 Chronicle 研究项目,以及将工作流转化为可复用技能的 Record & Replay 功能。

Dominik Kundel 表示,一旦 AI 代理理解了用户的工作内容和方式,将彻底改变人机交互模式。目前,「电脑历史」功能正陆续向全球范围内的 Pro、Business 和 Enterprise 用户推送。不过,OpenAI 特别指出,欧洲经济区(EEA)、英国和瑞士的用户将在未来几周内才能获得访问权限。(来源:cnBeta)

消息称苹果首款折叠屏手机 iPhone Ultra 产能有限,首批货源优先供应美国市场

8 月 13 日消息,外媒 ChannelNews 援引一位匿名零部件供应商消息,称苹果首款折叠屏手机 iPhone Ultra 有限的首批货源可能会优先供应美国市场,随后再陆续进入包括中国在内的其他主要市场。

事实上,此前就已经有多份消息称 iPhone Ultra 初期产能可能非常有限。如果供应情况确实如此紧张,那么苹果采取美国市场优先、随后逐步扩大销售范围的策略也并非没有可能。

此前消息显示,苹果 iPhone Ultra 配备 7.8 英寸内屏、5.5 英寸外屏,合上时的厚度为 9mm,比 iPhone 17 Pro Max 的 8.75mm 略厚,整机一共配备 4 枚摄像头,其中外屏、内屏各带有一颗前摄,背面则配备两颗后置摄像头。(来源:IT 之家)

大疆发布 8K 全景相机 Osmo 360 II,起售价 3299 元

8 月 13 日,大疆发布全新 8K 全景相机 Osmo 360 II,标准套装售价 3299 元,畅拍套装售价 3999 元。

作为大疆全景影像产品线的最新旗舰,Osmo 360 II 延续一英寸全景影像方形传感器与全景拼接算法积累,面向运动、旅行、日常记录及专业创作等场景,进一步提升画质、暗光表现和拍摄体验,画质达到 8K60fps。新品加入主角跟随、NFC 一碰即连、AI 一键成片等功能,并配备可更换防刮镜片、105GB 内置存储及多种生态配件。在后期流程上,Osmo 360 II 可通过 DJI Mimo、DJI Studio 及 DaVinci Resolve 插件,覆盖从快速成片到专业剪辑的不同需求。(来源:极客公园)

传音推出 TECNO Pova 8 Pro 手机:灵感来自星际飞船,配个性化点阵背屏

8 月 13 日消息,据外媒 GSMarena 晚间报道,传音旗下品牌 TECNO 正式发布了此前已经多次曝光的 Pova 8 Pro。

TECNO Pova 8 Pro 搭载天玑 7400 Ultimate 芯片,最高提供 12GB 内存和 512GB 存储空间,并额外配备 P1 图形芯片提升游戏表现。通过游戏插帧,部分游戏可以实现 144 帧运行。其中 RPG 游戏最高支持 90 帧,FPS 和 MOBA 游戏最高支持 144 帧。

TECNO Pova 8 Pro 搭载基于 Android 16 的 HiOS 16 系统,支持两次大版本更新与三年安全补丁,内置 AI 助手 Ella,拥有 AI 生产力与摄影功能。正面是 6.78 英寸 144Hz AMOLED 高规格屏幕,支持湿手、油手操作;背部采用星际飞船风格设计,相机模组集成可自定义内容的 Mini LED 点阵背屏。

影像上该机后置 5000 万带光学防抖的 LYTIA 700C 主摄+800 万超广角,前置 1300 万像素。配备 6500 毫安时电池与 45 瓦充电,支持旁路充电、10 瓦反向充电。同时配备大尺寸 VC 散热、NFC、红外、立体声双扬等,拥有多档高等级防护,设有自定义快捷键,还附赠三年 256GB 免费云存储。

标准版提供三种配色与三种存储版本,TECNO 还推出托尼洛·兰博基尼限量版,仅外观配色设计不同,硬件存储配置和标准版一致。(来源:IT 之家)

三星首款 Galaxy 头戴耳机曝光,预计 2027 年初正面挑战苹果 AirPods Max

8 月 13 日消息,三星正在研发其首款 Galaxy 品牌头戴式无线耳机,内部代号为「Galaxy H1」。这款产品将直接对标苹果 AirPods Max,预计于 2027 年初正式发布。

目前三星 Galaxy Wearable 应用中已经加入了关于这款产品的代码,还包含图标轮廓。其外形采用宽头梁设计,风格类似苹果 AirPods Max,而耳罩部分则相对更厚,类似索尼 WH-1000XM6 的设计语言。图标展示了白、灰、黑三种配色,耳罩衬垫则有灰色与绿色可选。

功能方面,尽管具体硬件规格尚未确认,但 SamMobile 预测 Galaxy H1 将支持蓝牙 6.0 连接、三星无缝超高音质(SSC UHQ)音频编解码器、自适应主动降噪(ANC)、环境音模式、AI 助手集成以及自动切换(Auto Switch)功能,并有望提供远超 Galaxy Buds 系列的续航能力。

三星目前拥有 JBL、AKG 和 Harman Kardon 等多个音频品牌,但 Galaxy H1 将是三星首次以 Galaxy 品牌推出头戴式耳机产品。(来源:IT 之家 )

发布 14 年后,手游《糖果传奇》年营收仍接近 10 亿美元

由瑞典视频游戏开发商及发行商 King 于 2012 年推出的《糖果传奇》,在 2025 财年中,尽管开发商 King 近年来并未披露详细的利润和收入明细,但该公司曾报告称其在 2023 年的总收入已突破 200 亿美元。

同年,该公司还宣称,包括原版应用分析平台 Business of Apps 的数据编辑大卫·柯里(David Curry)通过研究发现,在 2025 年,原版游戏大约拥有为 8150 万的月活跃用户,并且在 Android 和 iOS 平台上被下载了超过 1.9 亿次。在 2014 年的 IPO(首次公开募股)文件中,King 曾声称该游戏在 2013 年 12 月的全球日活跃用户数曾达到 9300 万。如果柯里的估算准确,这表明在过去的 12 年里,该游戏的庞大用户基础并未经历大规模的衰退。

多伦多大学媒体与平台研究教授、视频游戏研究员大卫·尼伯格(David Nieborg)则认为,这款游戏广受欢迎也与其「非特定地点、非性别化、去种族化」的特性密不可分,这使得它能够跨越地理、语言、文化和社会的种种界限,吸引全球各地的玩家。(来源:cnBeta)

Continue ReadingDeepSeek Harness 公测,对标 Claude Cowork ;长鑫科技市值超越腾讯;OpenAI 年化营收有望翻番达 400 亿美元

实测正式版 DeepSeek V4 Pro,补齐 Agent 能力|AI 上新

作者|桦林舞王

编辑|靖宇

 

没有预告,没有倒计时,甚至连更新日志都没来得及写好。DeepSeek V4 Pro 的正式版,就这么悄悄的来了。

8 月 13 日凌晨,DeepSeek 官网悄悄刷新了 API 文档。模型名还是那个 deepseek-v4-pro,但 fingerprint 已经变成了 fp_v4pro_20260812。打开社区一看,消息已经炸开—— V4 Pro 正式版,来了。

从 4 月 24 日预览版上线算起,整整 111 天。

这期间 Kimi K3 高调发布抢走了开源头条,V4 Flash 正式版先行一步在 7 月 31 日上线,API 涨价的预告更是悬在所有开发者头顶。

所有人都在问同一个问题:Pro 的正式版到底什么时候来?

答案是一个周三的深夜。

01

架构没变,能力暴涨

先说硬参数。V4 Pro 正式版的模型架构和预览版完全一致——1.6T 总参数、49B 激活参数的 MoE 结构,支持 1M 上下文、384K 最大输出。 变的是后训练,而且变化大到像换了个模型。

最夸张的数字来自 Agent 相关评测。DeepSWE(DeepSeek 自家的软件工程基准)从预览版的 12.8 飙到 62.7,涨了将近 50 分。Cybergym 从 52.7 到 83.3,Terminal Bench 从 72.1 到 87.9,DSBench-Hard 翻了一倍多达到 67.2。

这些测试项有一个共同特点——它们都涉及长链路的代码修改、环境操作和工具调用。 恰好是预览版最容易翻车的地方。

DeepSeek V4 Pro 正式版 Agent 能力大幅增强|图片来源:DeepSeek

从 V4 Flash 正式版的更新日志可以推断,这轮升级的核心就是面向代码 Agent 场景的大规模后训练。Flash 版已经用同样的方法把 Agent 能力做到了「基准测试远超 V4-Pro-Preview」的程度,Pro 版只是补上了同一课。

 

价格方面,每百万 token 输入 3 元、输出 6 元,和预览版持平。

虽然 8 月 6 日 DeepSeek 已经预告「计划近期整体上调 API 定价,预计涨幅较大」,但目前 0813 版本还没动。窗口期能撑多久不好说,想薅的趁早。

02

天花板和脾气

跑分好看只是门票,真正有意义的是拿真实任务去试。

极客公园用 V4 Pro 正式版跑了三个不同方向的测试,试图回答一个问题—— 这个模型在「一次性生成完整可运行代码」这件事上,到底到什么水平了?

第一个任务是 Boids 群体涌现模拟。 要求在 Canvas 上实现 200 个三角形 boid 的群体行为,带分离/对齐/凝聚三个可调参数、彩色轨迹、点击生成捕食者、glassmorphism 风格控制面板。这是一个涉及物理模拟、实时渲染和 UI 设计的综合任务。

V4 Pro 用了大约 170 秒,生成了 761 行完整 HTML。打开浏览器,200 个彩色三角形在黑色背景上游动、聚散、避障,拖动滑块可以实时改变群体行为模式。效果流畅,代码一次运行通过。

第二个任务故意模糊——用中文告诉它「我想要一个好看的番茄钟工作面板」, 只给了「能计时、能记录、有白噪音、中文界面、要有质感」这几个方向,其余让模型自行决定。

V4 Pro 交回来 1223 行代码,除了基础的 25/5 分钟计时功能,它自己加了任务标签、专注统计图表、快捷键支持、甚至用 Web Audio API 从零合成了几种白噪音。

对模糊需求的「产品化补全」能力,确实比预览版有明显进步。

第三个任务是寻路算法可视化, 要求实现 BFS、DFS、A* 三种算法的逐步动画、可交互的网格画墙、迷宫自动生成。这个任务的代码量最大,也是翻车最多的地方——但翻车的方式本身就很有意思。

开着默认的 thinking 模式,V4 Pro 用了 16384 个 token 的输出配额,其中 13394 个花在了「思考」上。留给实际代码的不到 3000 个 token,直接截断,HTML 写到一半就断了。

关掉 thinking 模式重跑,54 秒就输出了完整的 715 行代码,寻路动画、迷宫生成、暗色主题一应俱全。

这不是一个 bug,而是 V4 Pro 正式版的一个真实特征——thinking 模式在复杂代码生成场景下,推理 token 可能占到输出的 80% 以上,反而挤压了实际内容的空间。

对于需要大段代码输出的任务,开发者可能需要主动关闭 thinking,或者大幅提高 max_tokens 来兜底。

03

大鲸鱼的位置

经过 API 实测之后,坦率地说,V4 Pro 0813 不是一张「全面碾压」的成绩单。

HLE 不使用工具时 42.7 分,落后 Claude Opus 4.8 的 49.8 和 Fable 5 的 53.3。NL2Repo 以 61.5 落后 Opus 4.8 的 69.7。有 Kimi K3 在前,它在部分测试上也存在轻微差距。

纯知识推理和最复杂的软件工程任务,V4 Pro 还没有坐上头把交椅。

但 DeepSeek 从来不是靠「最强」赢的。它靠的是那条所有人都背得出来的定律——比我强的没我便宜,比我便宜的没我强。

每百万 token 输入 3 元的价格,大约是 Fable 5 的十分之一、Kimi K3 的三分之一。

在 Agent 能力从「几乎不可用」暴涨到,「能和头部闭源模型正面对打」之后,这条定律的杀伤力比预览版时期大了一个量级。

更值得关注的是藏在 V4 Flash 正式版更新日志里的一行小字——评测使用了「DeepSeek Harness 极简模式(即将发布)」作为 Agent 框架。结合前两天注册的「DeepSeek Harness 团队」公众号和此前的招聘信息, DeepSeek 正在准备把模型和 Agent 运行框架打包推出。

如果说过去大家的竞争还停留在「谁的模型更聪明」这个维度,那 Harness 的出现意味着竞争正式进入下一阶段—— 不是比谁的大脑更好,而是比谁能把大脑、手脚和工具箱组装成一个真正能替人干活的系统。

V4 Pro 正式版补齐了大脑这一环。接下来,就看那个「即将发布」还要等多久了。

*头图来源:AI 生成

本文为极客公园原创文章,转载请联系极客君微信 geekparkGO

Continue Reading实测正式版 DeepSeek V4 Pro,补齐 Agent 能力|AI 上新