银行理财市场分析(2026年二季度)

(本文作者为 Barrons巴伦,钛媒体经授权发布)

 一、理财市场规模

(一)理财产品存续规模

2026年上半年,全国共有100家银行机构和32家理财公司累计新发理财产品1.82万只,累计募集资金39.21万亿元。截至2026年6月末,全国共有153家银行机构和32家理财公司有存续的理财产品,共存续产品5.12万只,同比增加22.49%;存续规模33.66万亿元,同比增加9.75%。

1

(二)按机构类型规模占比

分机构类型来看,截至2026年6月末,银行机构存续产品1.21万只,存续规模2.48万亿元,同比减少22.26%;理财公司存续产品3.91万只,存续规模31.18万亿元,同比增加13.46%,占全市场的比例达到92.63%。

1

二、理财产品特征

(一)按投资类型

截至2026年6月末,固定收益类产品存续规模为32.48万亿元,占全部理财产品存续规模的比例达96.49%,较去年同期减少0.71个百分点;混合类产品存续规模为1.07万亿元,占比为3.18%,较去年同期增加0.67个百分点;权益类产品和商品及金融衍生品类产品的存续规模相对较小,分别为0.09万亿元和0.02万亿元。

1

(二)按运作模式

截至2026年6月末,开放式理财产品存续规模为26.17万亿元,占全部理财产品存续规模的77.75%,较去年同期减少3.18个百分点;封闭式理财产品存续规模为7.49万亿元,占全部理财产品存续规模的22.25%。

1

三、理财资产配置

(一)理财产品资产配置

截至2026年6月末,理财产品资产配置以固收类为主,主要投向债券、现金及银行存款、同业存单、拆放同业及债券买入返售、公募基金,分别占总投资资产的41.6%、28.1%、8.6%、5.9%、7.0%。

1

(二)理财资产配置占比环比变动

截至2026年6月末,理财行业积极响应国家政策号召,充分发挥资金优化配置功能,通过多种途径实现资金与实体经济融资需求对接。截至2026年6月末,银行理财产品通过投资债券、非标准化债权、未上市股权等资产,支持实体经济资金规模约21万亿元。

为助力我国碳达峰、碳中和目标实现,2026年上半年,理财市场累计发行ESG主题理财产品128只,截至2026年6月末ESG主题理财产品存续余额超3100亿元。此外,理财行业不断推出特色产品,2026年6月末存续专精特新、乡村振兴、大湾区、绿色低碳等主题理财产品达200只,存续规模超1000亿元。

1

四、总结

2026年上半年,银行理财行业平稳健康发展,有效支持实体经济发展和人民群众财富保值增值。截至2026年6月末,全市场共存续产品5.12万只,存续规模33.66万亿元,理财公司理财产品存续规模占全市场的比例达到92.63%,占据绝对主导地位。产品结构上,固定收益类产品存续规模占比达96.49%。

在服务实体经济与创造收益方面,理财产品支持实体经济资金规模约21万亿元,2026年上半年理财产品累计为投资者创造收益3052亿元。同时,理财有效拓展了投资者队伍,持有理财产品的投资者数量达1.51亿个,较年初增长5.59%。未来,理财公司将继续稳健前行,不断打通代销渠道,在守护居民财富与服务实体经济中实现更大价值。

更多对全球市场、跨国公司和中国经济的深度分析与独家洞察,欢迎访问 Barron’s巴伦中文网官方网站

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

Continue Reading银行理财市场分析(2026年二季度)

DeepSeek-V4-Pro正式版实测:山不在高,有“梁”则灵

(本文作者为 光子星球,钛媒体经授权发布)

文 | 光子星球

DeepSWE 12.8到62.7,约4.9倍。这是DeepSeek官方给出的V4-Pro正式版(版本号0813)软件工程智能体能力提升幅度。

8月12日晚,这个模型悄然出现在DeepSeek的API文档里,没有发布会,也没有官宣推文。

价格方面,DeepSeek V4 Pro是走量的高端档,价格明显高于V4-Flash。按每1M token计算,缓存命中输入0.025元,缓存未命中输入3元,输出6元。相比之下,V4-Flash分别为0.02元、1元和2元。输出token从2元涨到6元,正好是三倍。输入未命中从1元涨到3元,也是三倍。

“梁圣”就是“梁圣”,一如既往地不走寻常路,连涨价预告都一并写得清清楚楚:“计划近期整体上调DeepSeek API服务定价,预计涨幅较大”。

于是,我们花了一宿,用社区最新的一批复杂测试手法,看看它的涨价底气到底从何而来。

结论先放在这里,这次升级绝对过硬,前端审美发生质变,Agent能力稳稳得很踏实。不过,也有让我们暂时无解的卡bug问题,比如鹈鹕骑自行车翻车了,生成了两个挂在天上的弯月。

一个悄悄上线的新版本

V4-Pro不是新模型,是转正。今年4月24日,DeepSeek发布V4系列,Pro版当时还是Preview状态。三个多月后,正式版才来,命名也直白,直接用日期0813。

这次转正,参数上做了几件实打实的事。上下文支持1M上下文长度,输出上限拉到384K Token,支持thinking和non-thinking双模式,其中默认开启思考模式状态。接口同时兼容OpenAI和Anthropic两套格式,接入Claude Code这类Agent框架可以直接换base_url。

官方的叙事,换了一个词

比参数更重要的是官方换了个说法,不再强调「更会答题」,而是强调「更会把一件事干完」。有博主把官方数据翻译成人话:DeepSWE从12.8提到62.7,测的不是「会不会写一段代码」,而是「能不能像工程师一样持续干活」。

九项Agent与代码基准全线大涨。Terminal Bench 2.1打到87.9(终端操作),Cybergym提升至83.3(网络安全),NL2Repo涨到61.5(自然语言转代码仓库),DeepSWE增长到62.7(软件工程),而相对应的Preview版本分别提升15.8、30.6、23.0、49.9。

社区也存在质疑声,有开发者对比后认为0813仍略逊于Luna MX,也有人指出它约一半基准还落后Kimi K3。官方至今没有发布完整的benchmark报告,这也意味着所有声称都要靠第三方验证。

这就是我们做这次实测的原因,不转述官方数字,自己跑。

考题换代,从鹈鹕到指环王

在动手之前,有个背景必须交代,圈里的测试手法正在换代。8月2日,入职Anthropic的Karpathy发了一条长推,说我们该告别「鹈鹕骑自行车」这类测试了。

他给Opus 5塞了《指环王》第一段,配100万token的预算(约10美元),要求生成三个JS渲染版本。Opus 5跑了约2小时,写出5500行代码,用Three.js搭出一个「有点上世纪国产3D动画味」的霍比屯,穿模、漂浮不少。

随后有网友拿DeepSeek V4 Flash复现,结果画面人物全员漂浮,穿帮明显。

所以我们给0813设计的测试,全部避开了基础能力,用的都是这类最新、最复杂的手法。方式上,我们没有走网页聊天界面,而是把DeepSeek接入Claude Code的Anthropic兼容接口,让它在真实的Agent环境里干活。一共7项,按难度递进,从鹈鹕这种旧基准,到指环王3D世界这种新基准,最后到连续三轮的长周期工程任务。

第一道题,它就翻车了

先说坏消息,DeepSeek-V4-Pro上来就翻了车。

第一道题是我们的老朋友,即旧基准下的「鹈鹕骑自行车难题」,SVG生成,让鹈鹕骑上车、动起来。尽管这是Karpathy点名要「退休」的考题,但正因为人人测过,拿来当对照组最合适。

0813的表现是这样的,鹈鹕的脚踩在踏板上,但踏板不在自行车上。车架结构怎么看都不科学,这样的设计,鹈鹕的屁股不会冒火吗?

我们怀疑是推理强度太高导致过度思考,把强度从max降到high又测了一轮。结果依旧,鹈鹕形状是怪的,天上的云依旧是反向的。

有意思的是,之前测Kimi K3也出现过类似情况。难道前端能力超过某个界限之后,反而会在这种简单题上翻车?样本还太少,不好下结论。但第一道题就给我们提了个醒,测试全程不能只看高光。

60种风格,一张墙

第二道题直接翻盘,让0813在一个HTML文件里生成一张Bento卡片墙,60种设计风格,每张卡片必须用该风格最典型的视觉语言,不能只换颜色。

结果出乎意料地完整,60种风格全部实现,严格执行了不规则拼贴的要求,风格之间的差异非常明显,一次通过,没有任何敷衍的「换色卡」,以后vibe coding项目再也不用担心风格单调了。

这道题真正见功力的是它对「设计语法」的理解,玻璃拟态和粗野主义在视觉上几乎没有任何共同点,能把它们都抓准并排在一张墙上,说明模型对风格语料的积累是实打实的,而非死记硬背下几种配色方案。

把一段文字变成一部动画

第三道题是前端动画叙事,给0813一段描写「老水手夜晚等船」的文字,要求它做成自动播放、循环的动画页面,同时镜头要随时间推进,情绪要靠配色和节奏传达。

它交出了一部完整的叙事,画风、节奏、镜头推进都把握得很好,从镇子远景推到码头,再推到灯塔,自动循环流畅,文字以精致排版叠加在画面上随场景出现。

唯一的问题出在月亮,绘制明显出错。能力这么强的模型,却在简单的月亮上掉链子,和第一道题的鹈鹕简直如出一辙。我们暂时找不到它犯错的规律,只能把它记下来,等样本多了再说。

这次,配色终于不像AI了

第四道题是Three.js 3D打砖块游戏,我们给出的要求是游戏机制闭环,要能玩到比出胜负,还要兼顾UI和游戏手感。

测试下来,游戏完整可玩,碰撞准确没有穿模,丢分、结算逻辑正常,一次通过。但让我们印象最深的不是机制,是配色,配色不再是之前一眼AI的感觉。

这句话值得展开,过去大半年,AI生成的前端有个通病,蓝紫渐变、玻璃拟态、圆角卡片,一眼假。0813这次交出来的配色、碰撞音效和操作反馈,都已经进入顶级模型的层次,怪不得会宣布要涨价,这样的表现即便涨价也是极具性价比的选择。

让AI搭一个中土世界

第五道题是这次的主角,Karpathy的新基准,给0813《指环王》第一章的开头,让它用Three.js把霍比屯的111岁生日宴会搭成一个可运行的3D世界。

和Karpathy给Opus 5完整段落不同,我们只给了一个开头,这样能在短时间内拿到结果。0813的表现是,洞屋、宴会长桌、宾客、烟火要素齐全,没有漂浮、没有穿模,运镜从俯瞰霍比屯推近到比尔博,之后是单调的左右晃动。

单从这一个场景看,0813和Opus 5不相上下。需要注意的是,这不是说两个模型整体能力相当,因为单场景、单段落,样本仍然有限。但至少说明,在「读懂文学、搭出一个世界」这条新赛道上,国产模型没有掉队。我们会在后续的对比测试里给完整段落,再下最终的结论。

1.5小时,一座浮岛

第六道题是压轴大戏,我们用与GPT-5.6、Kimi K3、V4-Flash-0731完全相同的Prompt,让0813做一个React Three Fiber的3D浮岛创意作品集网站,滚动驱动相机、四章节叙事、物件交互、Bloom后处理、移动端降级,全部要求到位。

这道题它花了1.5小时,是全场最久。最后半小时,它一直在自己测试项目能不能顺利启动,直到确认没有问题才交付,交付结果首轮0 bug运行。

转场、运镜、交互、移动端适配都做得极好。唯一缺点是初始界面过曝,一进页面先被亮光晃到。

历史成绩摆在这里,GPT-5.6 Sol功能完整度最高,但点击物件时把背景虚化了;Kimi K3观感和完成度是此前5个模型里最好的;V4-Flash-0731岛会自转、草是动态的,但运镜明显不如前两者。

0813这次,是在V4-Flash的基础上把运镜、转场、交互全部补上了。性能逼近Fable 5确实没有信口开河,0813是有真材实料的。

它能连续干完一件事吗

最后一道题回到官方最狠的宣称,DeepSWE风格的长周期工程。我们让0813从零搭一个记账本全栈应用,连续做三轮迭代,记账核心功能、月度分类统计、预算提醒。每轮都要改多份文件、补测试、跑测试、跑不过自己修。

三轮全部完成,关键是过程,它不是一轮写完假装三轮,而是每一轮都真实跑测试,不通过就自己修bug,直到通过才进入下一轮。全程没有让我们介入纠错,唯一的小插曲是每新建一个文件它都会申请一次权限。

这种踏实的做事风格真是暖暖的很贴心,模型能力再强,能稳稳接住用户的需求才是王道,0813在这方面做得很出色。

一个可能被低估的版本

把7项测试放回桌面上看,0813的画像比官方基准更立体。

前端审美是这次最大的质变,从打砖块的配色到浮岛的运镜,它已经告别了「AI前端一眼假」的阶段,站进了顶级模型的行列。创意类任务全线高分,指环王场景零漂浮零穿模,和Opus 5单场景不相上下。长周期工程扎实,测试闭环、自修bug,是「能连续干活」的样子。

问题也存在,鹈鹕和月亮两处低级失误,都发生在它能力很强的领域,强如K3也犯过类似的错误,这个暂时解释不了。

有意思的是,Grok 4.6几乎和0813同一时间发布,一个顶级闭源、一个顶级开源,都是超高性价比的定价路线。这场对决,可能比官方benchmark更能说明问题,我们已经在筹备两个模型的同题对比测试。

至于「涨价了还值不值」,以这次的表现,即便涨价,它依然极具性价比。不差钱的DeepSeek也正在告别价格战,AI大模型集体转向高性能、高价值路线已经成为趋势。免费午餐的窗口,正在关闭。

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

Continue ReadingDeepSeek-V4-Pro正式版实测:山不在高,有“梁”则灵

单项致胜:五星股票型基金产品深度参考(2026年二季度)

(本文作者为 Barrons巴伦,钛媒体经授权发布)

一、济安金信的公募基金分类

根据我国2015年修正的《证券投资基金法》的规定,我国的公募基金全部是契约型基金。遵守各种法律法规的规定和基金契约的约束是基金运作的两个刚性约束,济安评级将基金分为货币型、纯债型、一级债、二级债、股票型、混合型、封闭式、指数型、QDII、基金中基金(FOF)和REITs基金十一种类型。

济安金信公募基金分类及定义如下:

1

本文专注于股票型基金中单项能力突出的基金产品,股票型基金的分类标准是投资股票资产占基金资产的比例不低于80%、不采用指数跟踪方式进行投资的基金。股票型基金是投资者的长期理财工具,适合具有高风险承受能力的投资者,主要配置权益类资产,重视基金管理团队的选股能力,基金管理团队坚持价值投资的理念、分享国民经济和资本市场的成长是股票型基金的价值所在。 

二、股票型基金评价体系

股票型基金将从盈利能力、抗风险能力、选股择时能力三个方面评价。在评价业绩盈利能力时,引入詹森指数,补充超额收益,弥补简单的绝对收益在管理人能力方面的不足,衡量股票型基金经理是否能够通过主动投资管理,追求超越大盘的业绩表现。为了引导价值投资,这里引入了衡量选股择时能力的评价指标。具体指标如下:

1

基于上述基金综合评价体系,我们聚焦2026年第二季度获评五星股票型基金中单项能力优秀的产品,具体标准为“单项能力五星且综合评级五星”的双五星产品,通过梳理其评价标准、季度表现变化和具体产品评级,为投资者提供该类优质产品的核心参考。

(1)盈利能力五星股票型基金

盈利能力五星股票型基金以 “收益领先” 为核心标签,评价核心围绕阶段绝对收益实现能力和詹森指数验证的超额收益获取能力,以此判断基金的收益创造并非依赖市场行情,而是基金经理主动管理能力的结果。

从数量分布看,2026年二季度共有45只盈利能力五星股票型基金,占本次综合五星股票型基金总数50只的90%,说明二季度绝大多数综合五星基金的核心竞争力均来自于优异的盈利表现。但这类产品普遍存在收益较高、短板明显的问题:45只产品中仅8只同时实现抗风险能力五星,且无一产品同时实现选股能力五星,全部产品均存在风控或选股维度的不足,意味着这类基金的高收益往往伴随一定的波动或个股选择的局限性,更适配能接受市场波动、核心追求短期高收益的激进型投资者,产品名单如下:

1

1

(2)抗风险能力五星股票型基金

抗风险能力五星股票型基金的关键在于 “稳”,评价核心围绕 “少亏”(亏损频率)和 “亏得少”(平均亏损幅度)两大维度,考核基金在市场调整阶段的下行风险控制能力,即使在行情震荡时也能保持净值的相对稳定。

数量上,2026年二季度共有11只抗风险能力五星股票型基金,占综合五星股票型基金总数的22%,整体标的依然相对稀缺,体现了股票型基金在追求高收益的同时实现优秀风控的难度大幅提升。从能力配套来看,这类基金的盈利表现整体极佳:11只产品中有8只同时实现盈利能力五星,占比近72.7%,说明优质的风控能力往往能与稳定的盈利能力相辅相成;但这类产品同样面临 “风控强、选股弱” 的问题,11只产品中无一实现选股能力五星,反映出二季度风控能力优异的基金在个股精选层面仍有较大提升空间。这类产品更适合风险偏好适中、追求 “稳健增值” 而非高波动收益的稳健型投资者,产品名单如下:

1

(3)选股能力五星股票型基金

选股能力五星股票型基金考验的是基金经理 “选对股、选优股” 的核心能力,评价核心围绕持仓标的的估值合理性(P/E)、资产安全性(P/B)和盈利持续性(ROE),考核基金经理在个股挖掘、标的筛选上的专业能力,即所投股票既具备估值优势,又能实现稳定的盈利增长。

数量上,2026年二季度没有选股能力五星股票型基金,在综合五星股票型基金总数中占比为0%。标的极度稀缺,这说明在二季度的市场环境下,基金经理通过个股精选实现选股能力五星评级的难度极大,无一产品能在估值、资产安全和盈利持续性上同时做到极致。由于缺乏入围产品,这也反映出当前行情下兼顾估值优势与盈利高爆发的纯自下而上选股策略面临着严苛的挑战。

更多对全球市场、跨国公司和中国经济的深度分析与独家洞察,欢迎访问 Barron’s巴伦中文网官方网站

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

Continue Reading单项致胜:五星股票型基金产品深度参考(2026年二季度)

浙江上市公司价值重估:制造业与数字科技抬升上限,产业链分化加剧

(本文作者为 Barrons巴伦,钛媒体经授权发布)

从本次650家上市公司样本看,浙江资本市场呈现出鲜明的产业纵深:机械设备99家,是样本数量最多的行业;基础化工68家、汽车60家、医药生物54家、电力设备48家,构成制造业主体;轻工制造、电子、计算机、纺织服饰和家用电器等行业则进一步丰富产业层次。

高评级企业也分布在不同赛道。德业股份、伟明环保、公牛集团、恒生电子获得AAA评级;同花顺、世纪华通、海康威视、珀莱雅、东方电缆、浙江鼎力、虹软科技、横店东磁、巨星科技、拓普集团等进入AA区间。头部企业并非集中于单一行业,而是横跨电力设备、环保、轻工制造、计算机、传媒、美容护理、机械设备和汽车等多个板块。

区域分布同样具有集中度。杭州共有212家样本,宁波113家,两地合计325家,正好占浙江样本的一半;两地共有79家企业进入A及以上区间,占全省136家高评级企业的58.1%。这种“制造业纵深+数字科技+消费品牌+区域集聚”的结构,使浙江ESG-V评级既具备较高的头部上限,也呈现出传统制造、科技硬件和部分周期行业内部差异。

近日,济安金信发布浙江上市公司ESG-V评级结果。与传统ESG评价主要关注环境、社会和治理责任不同,ESG-V评级在环境(E)、社会(S)、督导机制(G)之外,引入“价值实现”(V)维度,将企业责任履行、治理能力、盈利质量、风险控制和资本回报纳入同一评价框架。

换言之,ESG-V评级并不只是评价企业“是否履责”,也进一步观察企业能否把责任治理转化为长期价值。对于浙江这样一个制造业样本庞大、行业分布多元、民营和市场化企业占主体的省份而言,这一框架能够更清晰地识别:哪些企业已经把产业能力、经营效率与治理机制转化为稳定价值,哪些企业仍面临环境、安全、合规、资本效率或价值兑现压力。

在数据方法上,济安金信ESG-V评级充分结合公开披露、财务数据、监管处罚、舆情信息和行业特征等多源信息,并引入卫星遥感数据与AI解译能力。对于电子制造、基础化工、电力设备、钢铁建材、环保和交通运输等高ESG敏感行业,评级体系可结合高分系列、Sentinel、VIIRS等卫星遥感数据,对大气排放、水体污染、固废堆场、碳排放与能耗强度、生态保护和土地利用合规性等指标进行辅助识别,并与环评公示、行政处罚、年报披露等信息交叉校验。

从本次浙江650家样本看,综合ESG-V评级呈现出“头部多元、中间层厚、尾部仍有压力”的结构。AAA企业4家,AA企业30家,A企业102家,A及以上企业合计136家,占比约20.9%;BBB、BB、B三级企业共422家,占比约64.9%;CCC及以下企业92家,占比约14.2%。

这一结构说明,浙江上市公司高评级企业已经形成跨行业分布,但绝大多数企业仍集中在中间评级区间。评级上限由电力设备、环保、计算机和消费制造共同抬升,机械设备、汽车等制造行业形成较厚的高评级梯队;与此同时,基础化工、电子、医药生物以及部分传统制造行业仍存在较明显的评级下沉。

四个AAA、三十个AA:制造、数字科技与消费共同抬升上限

本次评级中,德业股份、伟明环保、公牛集团、恒生电子4家企业获得AAA评级,分别来自电力设备、环保、轻工制造和计算机行业。另有30家企业获得AA评级,其中包括同花顺、世纪华通、海康威视、珀莱雅、东方电缆、浙江鼎力、虹软科技、横店东磁、巨星科技、拓普集团等。

四家AAA企业分属四个不同申万一级行业,说明浙江评级上限并不依赖某一个单一产业集群。电力设备和环保体现绿色产业链的价值兑现,计算机代表软件与数字服务能力,轻工制造则说明消费制造企业同样可以通过产品责任、渠道能力、经营质量和资本回报形成较强价值闭环。

值得注意的是,浙江高评级企业数量虽然达到136家,但相对于650家的庞大样本,A及以上占比仍为20.9%。产业规模、制造能力、品牌优势和技术投入能够帮助企业进入竞争前列,但要进一步进入AA乃至AAA区间,仍需要环境责任、社会责任、督导机制和价值实现之间形成更稳定的相互验证。

机械设备与汽车:制造纵深最厚,高评级梯队也最完整

机械设备是浙江样本数量最多的行业,共有99家企业,其中A及以上21家,CCC及以下9家。浙江鼎力、巨星科技、杭叉集团、宏华数科进入AA区间,长盛轴承、杰克科技、海天精工、柯力传感、绿田机械、咸亨国际、福斯达、思进智能等进入A区间。

从申万二级行业看,浙江机械设备样本覆盖通用设备52家、专用设备29家、自动化设备11家,并延伸至工程机械和轨交设备。较厚的产业纵深为高评级企业提供了多点支撑,但设备企业的ESG-V表现仍取决于产品质量、安全责任、研发转化、供应链管理、应收与库存控制以及资本开支能否最终形成稳定回报。

汽车行业共有60家样本,其中56家属于汽车零部件,A及以上企业23家,占比约38.3%,CCC及以下仅4家。拓普集团、涛涛车业、双环传动、新坐标、春风动力、爱柯迪进入AA区间,华纬科技、合兴股份、银轮股份、浙江荣泰、浙江仙通等进入A区间。与机械设备相比,汽车板块的高评级密度更高,体现出浙江汽车零部件企业在细分制造、客户协同和价值实现方面形成了较强梯队。

数字科技:计算机头部突出,电子硬件分化更明显

计算机行业共有31家样本,其中A及以上13家,占比约41.9%,是浙江高评级密度较高的行业之一;CCC及以下6家。恒生电子获得AAA,同花顺、海康威视、虹软科技、迪普科技进入AA区间,萤石网络、理工能科、广立微、和仁科技、大华股份、慧博云通、税友股份等进入A区间。

传媒行业共有17家样本,其中世纪华通、华策影视、顺网科技进入AA区间,浙版传媒、浙数文化、完美世界进入A区间;通信行业9家样本中,长芯博创进入AA区间,A及以上2家。软件、IT服务、游戏、出版、数字媒体与通信设备等不同业务形态共同构成浙江数字产业的上市公司样本。

电子行业共有32家样本,其中A及以上仅4家,CCC及以下12家,是尾部企业占比较高的板块之一。永新光学、长川科技进入AA区间,蓝特光学、水晶光电进入A区间。浙江电子样本主要分布在半导体、光学光电子、消费电子和电子化学品等方向,技术迭代、研发效率、客户结构、库存和资本投入回报,都会进一步拉开企业之间的ESG-V评级差距。

电力设备与环保:绿色产业链抬升评级上限

电力设备行业共有48家样本,其中A及以上11家,CCC及以下6家。德业股份获得AAA,东方电缆、横店东磁进入AA区间,炬华科技、日月股份、微光股份、西子洁能、天能股份、正泰电器、运达股份、海兴电力等进入A区间。样本覆盖电网设备、光伏设备、电池、电机、风电设备等多个方向。

环保行业共有17家样本,其中A及以上5家、CCC及以下仅1家。伟明环保获得AAA,旺能环境、浙富控股、国泰环保、盈峰环境进入A区间。相较部分重制造行业,环保板块样本数量不大,但头部评级和尾部稳定性相对突出。

绿色产业并不意味着天然获得高评级。对于电力设备企业,扩产节奏、供应链环境责任、原材料波动和资本开支纪律会直接影响长期价值;对于环保企业,项目运营质量、环境绩效、合规记录和现金回收同样重要。ESG-V评价关注的并不是“绿色标签”本身,而是企业能否把产业方向转化为可持续、可验证的经营价值。

消费制造与商贸:品牌、产品责任与渠道能力提供稳定支撑

轻工制造共有40家样本,公牛集团获得AAA,顾家家居、源飞宠物、嘉益股份、西大门进入A区间;家用电器25家,其中三花智控进入AA,苏泊尔、老板电器、盾安环境、热威股份、奥普科技进入A区间;纺织服饰30家,其中航民股份进入AA,新澳股份、森马服饰、报喜鸟、百隆东方、伟星股份进入A区间。

商贸零售行业虽然只有9家样本,却有5家进入A及以上区间,且没有企业落入CCC及以下。小商品城进入AA,壹网壹创、杭州解百、三江购物、浙江东日进入A区间。美容护理行业4家样本中,珀莱雅进入AA。消费与商贸企业的高评级更多依赖产品责任、品牌信任、渠道运营、客户体验和资金周转之间形成稳定闭环。

与重资产制造相比,品牌和渠道型企业面临的环境压力结构有所不同,但并不意味着ESG要求更低。产品质量、消费者权益、供应链责任、数据与平台治理、库存管理以及资本回报,都会影响责任表现能否转化为长期价值。

基础化工与医药生物:样本厚度较大,高评级密度仍有提升空间

基础化工共有68家样本,是浙江第二大行业样本,其中A及以上6家、CCC及以下13家。三美股份进入AA,浙农股份、新和成、巨化股份、闰土股份、华峰化学进入A区间。医药生物共有54家样本,其中A及以上6家、CCC及以下10家,华东医药进入AA,我武生物、佐力药业、海森药业、安杰思、奥锐特进入A区间。

从结构看,基础化工样本主要分布在化学制品、塑料、化学纤维、农化制品、橡胶和化学原料;医药生物则覆盖化学制药、医疗器械、医疗服务、中药和医药商业。化工企业需要同时面对能耗、排放、安全生产、原材料周期和资本开支约束;医药企业则需要应对研发合规、产品安全、医疗服务质量、商业化能力等多重检验。两个行业样本数量均较大,但A及以上占比分别约8.8%和11.1%,说明从产业规模走向责任价值领先仍有较大提升空间。

央国企与非央国企:市场化企业构成主体,央国企尾部占比更低

浙江650家样本中,央国企90家,其中20家进入A及以上区间,占比约22.2%;非央国企560家,其中116家进入A及以上区间,占比约20.7%。两类企业高评级占比差距不大,说明浙江ESG-V头部企业更多体现为跨所有制分布。

非央国企数量占据绝对主体,德业股份、伟明环保、公牛集团、恒生电子、同花顺、珀莱雅、东方电缆、浙江鼎力、巨星科技、拓普集团等构成浙江市场化企业的高评级代表。央国企中,海康威视、小商品城、物产环能进入AA区间,财通证券、宁波港、浙版传媒、巨化股份、浙数文化、宁波银行、杭州银行、运达股份等进入A区间。

需要看到的是,两类企业在尾部结构上的差异更明显。90家央国企中仅6家处于CCC及以下,占比约6.7%;560家非央国企中有86家处于尾部,占比约15.4%。所有制能够影响治理基础、资源条件和风险缓冲,但并不能替代经营质量和价值实现;对于庞大的市场化制造样本而言,如何把市场活力进一步转化为治理稳定性和长期资本回报,是提升整体评级的重要方向。

尾部样本:化工、电子、医药与部分制造行业压力更集中

在评级尾部,浙江CCC企业62家、CC企业25家、C企业5家,共92家,占全部样本的14.2%,本次样本中没有D级企业。尾部企业主要集中在基础化工、电子、医药生物、机械设备、轻工制造、电力设备、计算机、纺织服饰和家用电器等行业。

其中,基础化工有13家、电子12家、医药生物10家、机械设备9家处于CCC及以下;轻工制造、电力设备和计算机各有6家。不同产业的压力来源并不相同:化工更需要处理环境、安全和周期约束,电子与计算机需要应对技术迭代和研发兑现,医药需要平衡研发、合规与商业化,机械和电力设备则需要控制扩产、库存、应收和资本开支。

ESG-V评级的意义,正是把这些不同风险最终统一到一个判断上:企业能否让责任治理、经营能力和资本回报形成可持续闭环,而不是只依赖产业标签、品牌知名度、技术概念或阶段性景气。

信息披露:高评级密度更高,但披露不是保证

浙江650家样本中,298家披露ESG相关信息,352家未披露。披露企业中有87家进入A及以上区间,占比约29.2%;未披露企业中有49家进入A及以上区间,占比约13.9%。披露组的高评级占比超过未披露组两倍。

与此同时,披露企业中仍有26家处于CCC及以下,占比约8.7%;未披露企业中有66家处于尾部,占比约18.8%。这一结构说明,信息披露与较高评级之间呈现出明显的伴随关系,但ESG报告本身并不能替代真实治理。真正决定评级的,仍是披露内容能否被经营表现、合规记录、财务数据和外部信息持续验证。

从产业集群走向责任价值集群

整体来看,浙江上市公司ESG-V评级呈现出鲜明的多元产业特征:机械设备与汽车构成制造纵深,计算机与传媒抬升数字科技上限,电力设备与环保形成绿色产业支撑,轻工、家电、纺织与商贸体现消费和品牌力量;基础化工、医药生物和电子则展现出更明显的内部层级差异。

浙江的优势在于上市公司样本数量庞大、行业分布广、制造业链条厚、高评级企业跨赛道分布;挑战则在于高评级企业仍只占约五分之一,化工、电子、医药及部分制造行业仍存在尾部压力。杭州和宁波合计占全省样本一半,并贡献58.1%的A及以上企业,也显示出高评级资源进一步向核心城市集聚。

对投资者而言,这份评级不只是一张责任评价表,也是一张观察浙江产业升级和上市公司长期竞争力的结构图。真正能够长期处于高位的企业,不只是规模更大、技术更先进或品牌更知名,更要让产品责任、环境管理、供应链治理、经营质量和资本回报相互验证。

从产业集群走向责任价值集群,浙江资本市场下一阶段需要回答的,不只是哪些企业拥有产能、技术和渠道,而是哪些企业能够把这些产业能力转化为可持续、可验证、可兑现的长期价值。

浙江上市公司ESG-V评级排名前100

1

1

1

更多对全球市场、跨国公司和中国经济的深度分析与独家洞察,欢迎访问 Barron’s巴伦中文网官方网站

更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App

Continue Reading浙江上市公司价值重估:制造业与数字科技抬升上限,产业链分化加剧

Deepseek V4 Pro 正式版 API 上线,百万 Token 仅 6 元;腾讯计划近期发布 HY4 大模型;曝 iPhone18 至少涨价 2000 元起 | 极客早知道

DeepSeek V4 Pro 正式版 API 更新上线,多项测试性能接近 Fable 5

8 月 13 日消息,DeepSeek V4 Pro 正式版正式发布,已更新至 API,调用模型名不变。

新版本增强了 Agent 能力,支持 Responses API 和 Codex 接入。

从官方群放出的评测对比表可以看到,DeepSeek V4 Pro 正式版(DeepSeek-V4-Pro-0813)在多项测试中接近 Fable 5 水平,相比之前的预览版能力大幅提升。

定价如下:

  • 百万 tokens 输入(缓存命中):0.025 元
  • 百万 tokens 输入(缓存未命中):3 元
  • 百万 tokens 输出:6 元

(来源:IT 之家)

腾讯发布 2026 年 Q2 财报,第二季度营收 2048 亿元,计划近期发布 Hy4

腾讯控股发布 2026 年第二季度财报。财报显示,腾讯第二季度营收 2,047.9 亿元人民币,预估 2,028.4 亿元人民币;第二季度销售费用 118.7 亿元人民币,预估 119.6 亿元人民币;第二季度增值服务业务收入 984.1 亿元人民币。

腾讯表示,混元 Hy3 完成从 preview 到正式版的快速迭代,上线一周调用量较上一代模型增长超 68 倍,更大参数规模的 Hy4 也计划近期发布;WorkBuddy 及 CodeBuddy 持续领跑国内 AI 原生办公智能体赛道,易观数据显示 WorkBuddy6 月 PC 端访问量已突破 2000 万次;微信 AI 助手「小微」灰测有序放量中。

二季度,腾讯游戏收入同比增长 11%,其中本土游戏收入增长 17%,国际游戏收入按固定汇率计算增长 4%;营销服务收入同比增长 22%;金融科技及企业服务收入同比增长 9%,云服务受惠于 AI 增量贡献,国际业务拓展和通用云服务需求增长。(来源:新浪科技)

曝小红书打造 AI 导购功能,官方暂无回应

有消息称,小红书在打造全新的「AI 导购」功能,依托对话交互模式,在问答场景中直接推送商品卡片、挂载下单跳转链接。

对此消息,新浪科技向小红书官方进行求证,截至发稿暂无回应。

本月初,新浪科技独家获悉,小红书正全面提速 AI 战略,布局 AI 社交产品、AI 社区互动工具等方向,从后台技术应用转向前台自研、产品化与生态化全面竞速。在招聘平台检索发现,小红书近日密集招募 AI 应用研发人才,且部分岗位薪资给到了 30-60K/16 薪,最高年薪可达 96 万元,足见其加码 AI 方向的决心。

今年 5 月,小红书发布内部信,宣布新一轮组织升级,其中核心变化就包括,成立 AI 一级部门 Dots 和企业智能部,从产品技术和组织两方面加大对 AI 的投入。(来源:新浪科技)

SpaceXAI 推出 GrokBot,对标 Anthropic 与 OpenAI

据华尔街见闻报道,马斯克旗下 SpaceXAI 正式入局 AI 代理市场,推出可像真实同事一样处理工作的产品 Grok Bot。8 月 11 日,SpaceXAI 发布 AI 代理产品 Grok Bot,目前处于早期测试阶段。这是马斯克旗下 AI 业务追赶 Anthropic 和 OpenAI 的最新举措,也是 SpaceXAI 与 Cursor 深度合作的阶段性成果。

马斯克随即在 X 平台表示:「我们将在修复早期测试的基本问题、并于本周晚些时候发布 Grok 4.6 之后,扩大 Grok Bot 的测试规模。」Grok Bot 的核心定位是「永远在线的 AI 队友」。与市面上多数 AI 工具不同,Grok Bot 拥有独立的云端计算机。它可以直接登录用户现有的工具和应用——包括没有 API 接口的平台——像真人一样操作,任务完成后才返回汇报。

SpaceXAI 官网描述其能力:Bot 拥有自己的电脑。它们登录你已经在用的工具,跨应用、收件箱等场景工作。它们从头到尾完成任务,只在需要你审批时才来找你。用户可以像发消息给同事一样给 Bot 分配任务,Bot 会记住对话、学习用户的工作习惯,并随时间变得更精准。(来源:36 氪)

自变量打破美国 Figure AI 物流分拣记录,用 30% 成本反超 45% 效率

8 月 12 日,自变量机器人完成物流分拣公开直播,跑出 1816 件 / 小时的分拣效率,较 Figure AI 此前公开的 1248 件 / 小时提升 45% 以上。不仅如此,自变量使用的是双机械臂搭配标准夹爪,而非 Figure AI 的人形机器人+五指灵巧手,成本大幅降低 70%,具备产业部署的经济价值。

在直播中,自变量处理的是复杂随机的纸箱、软袋、异形件等包裹,而非 Figure AI 使用的标准件。凭借自研的端到端世界统一模型 WALL-B,机器人能够理解物理规律,根据包裹属性自主调整分拣策略,实现效率最优的作业。这展示了一条产业路径:不堆叠昂贵硬件,而是凭借更聪明的具身大脑,能够实现规模化、可复制的产业落地。

(来源:极客公园)

米哈游 AI 陪伴游戏上线不到 30 天关服

米哈游发布公告,旗下 Steam 抢先体验 AI 陪伴产品《BSide:Olivia Lin》(林离)停止线上运营。

公告显示,8 月 27 日产品将上线离线版本,并关闭写信、上传 MIDI 等依赖在线服务的功能;8 月 31 日 15 时,《林离》将从 Steam 商店下架,服务器正式关闭。

据悉,该款游戏 7 月 13 日开启抢先体验,线上生命周期不足一个月。此前,米哈游联合创始人蔡浩宇旗下 Anuttacon 的 AI 陪伴产品 AnuNeko(AI 猫娘),也已经宣布永久关停。(来源:新浪科技)

马斯克最新 SpaceX 讲话,称必须赢得 AI 竞争

埃隆·马斯克预测,未来 AI 为 SpaceX 带来的收入将超过公司其他所有业务。当地时间周二,SpaceX 在社交平台 X 上发布了一段长约 30 分钟的全员会议录像。SpaceX CEO 埃隆·马斯克在会议上表示,AI 已经成为「SpaceX 未来极其重要的一部分」。

马斯克在讲话中说:「我们的 AI 营收可能——不,不是可能,而是确定——大概会在 9 月,也就是下个月,超过 SpaceX 其他所有业务的营收总和。」他随后补充道:「而到了第四季度,AI 营收将大幅超过 SpaceX 其他所有业务的营收总和。」随后,马斯克谈到了 SpaceX 旗下大语言模型系列 Grok 的训练计划。

他说:「我们将利用 SpaceX 所有信息的总和来训练 Grok。所以从某种意义上说,它将接受你们的训练。」马斯克表示,SpaceX 员工将成为「AI 的父母」,而 AI 将继承他们的思想、理念和信念。马斯克称,「我们在 AI 硬件和 AI 软件上必须赢。这或许是最重要的信息。我认为这实际上是我今天想要传达的最重要信息,那就是我们必须取得 AI 的胜利,因为未来压倒性地会是关于 AI 和机器人。」(来源:36 氪)

曝 iPhone18 系列至少涨价几千元

目前行业供应链已经传出明确动向,随着全球存储芯片价格持续暴涨,苹果确定要对即将发布的 iPhone 18 系列进行终端售价上调。

从目前供应链流出的定价信息来看,iPhone 18 系列的起售价至少要比上代产品高出 2000 元,涨价幅度创下近年 iPhone 系列新高,而成本端的暴涨也逼得苹果不得不通过各种调整供应链策略的手段,来平衡整机利润空间,避免盈利能力出现明显下滑。

在刚刚过去的 2026 年第二季度,苹果直接把 iPhone OLED 显示面板的平均库存保有周期,从此前常规的四周拉长到了六周,核心目的就是通过扩大整体采购规模、拉长备货周期,压低单块屏幕的采购成本,把全系列机型的生产总成本稳定在可控区间内。

针对定位高端顶配的 iPhone 18 Pro 和 iPhone 18 Pro Max 两款机型,苹果已经向面板供应商提议,将两款顶配机型所使用的高端 OLED 面板采购价格直接下调至 70 美元,约合人民币 475 元,进一步压缩核心零部件的采购开支。

苹果这一系列反常的提前锁价、加大备货量的操作,本质上就是想借超大批量订单带来的规模效应压低所有核心零部件的采购单价,尽可能对冲存储涨价带来的成本上浮压力,平抑涨价给终端售价和产品利润带去的双重负面影响。(来源:快科技)

全球首款机器人手机:荣耀 Robot Phone 官宣,搭载行业最小全钛云台架构

8 月 12 日消息,在今晚的荣耀 Robot Phone 全球新品发布会上,全球首款机器人手机—— 荣耀 Robot Phone 正式亮相。

荣耀 Robot Phone 开创性地打造钛合金灵巧云台,将 4DoF 机械臂装入方寸机身,拥有行业最小全钛云台架构、行业最轻钛合金云台电机、行业最快钛合金云台电机、行业最强盾构钢翻转电机。

荣耀手机官方表示,荣耀 Robot Phone 是一场极其勇敢的尝试,或许不尽完美,却代表着荣耀敢于打破常规,探索 AI 终端未来的决心。(来源:IT 之家)

3999 元影石 X6 正式发布:1/1.1 英寸大底传感器 + AI 三芯架构,支持 8K 50 帧全景视频

8 月 12 日消息,影石今日正式发布新一代超旗舰全景相机 X6,标准套装 3999 元起,旅拍套装和全能套装分别为 4299 元、4499 元,首批只有黑色可选。

作为影石深耕全景影像十年的标杆之作,X6 在画质、形态与 AI 体验上全面进阶,搭载索尼定制方形大底传感器与 4nm AI 三芯架构,支持 8K 50 帧全景视频和 1.2 亿像素全景照片。

X6 搭载影石与索尼联合定制的两颗 1/1.1 英寸方形大底传感器,相比上一代 X5 其传感器有效利用面积增加 33%,单像素进光量提升 300%,显著改善弱光、逆光及高对比度场景下的成像表现。X6 拥有 14.5 档动态范围,在全档位支持 10-bit 色深,并成为首款支持机内原生杜比视界的全景相机。(来源:IT 之家)

Spotify 将为 AI 虚拟歌手标注标签,并将其移出算法与编辑推荐

在线音乐流媒体巨头 Spotify 近日宣布,将针对平台上的人工智能生成歌手推出一项名为「AI Persona」(AI 虚拟形象)的全新标识。该标签旨在向广大听众明确提示,该艺术家的公众身份可能由 AI 生成,「并不代表真实的个人」。这一新标签计划于今年 9 月中旬正式在平台上线上线显示。

根据 Spotify 发布的政策,除艺术家主动自我申报外,平台也将对相关账号进行审核,针对公开展示名称与头像呈现「超逼真 AI 生成特征」的艺术家档案主动添加该标签,以扶持那些致力于建立音乐事业的真实音乐人。凡被归类为「AI Persona」的账号,其创作的内容默认将被排除在 Spotify 的编辑推荐及算法推荐机制之外,仅保留对已关注粉丝的推送。

该标签届时将呈现在歌手主页的顶部横幅、个人简介、搜索结果以及歌单单条曲目行中,用户点击标签即可查看该标识是来源于歌手自发声明还是由平台判定。对此有异议的艺术家将享有申诉机制,且未来数月内平台还将上线针对普通用户的 AI 账号举报功能。Spotify 方面强调,该标识侧重于艺术家的「公众形象」而非「音乐制作方式」,同时承诺将持续优化对 AI 内容的管理,坚决打击垃圾内容与低劣作品,保障音乐生态的健康发展。(来源:cnBeta)

Continue ReadingDeepseek V4 Pro 正式版 API 上线,百万 Token 仅 6 元;腾讯计划近期发布 HY4 大模型;曝 iPhone18 至少涨价 2000 元起 | 极客早知道

实测 GenOffice Alpha 版:补上办公工作流最后一环|AI 上新

作者|lfei

编辑|靖宇

 

8 月 3 日, Genspark 创始人&CEO 景鲲在 AGI Playground 2026 大会上发布了 GenOffice 。这是一款 AI 深度集成的本地 Office 客户端,其亮点在于打通了从 AI 生成到工作交付间的链路:通过 GenOffice 打造的软件工程框架,模型得以 直接操作 Office 文件最复杂的底层格式,将生成内容转化为可编辑、可交付的 Word 和 PPT 成品。

Genspark 推出这样一款产品并不令人意外。

在 Genspark 的产品体系 AI WorkSpace 6.0 中,AI 办公套件是核心价值模块;Genspark 还上架了 Microsoft Office 插件 ,让用户能在本地的微软 Office 软件里,直接调用 Genspark 的 AI 能力。在文档的转换层上,Genspark 已经积累了足够的经验。

让人意外的是 Genspark 推出 GenOffice 的方式:开源、免费,Alpha 版即日推出,后续交给用户、团队和 AI Agent 共建迭代。

据 Genspark 介绍,产品的 Alpha 版只由 一名工程师用一周时间完成,消耗约 1 万美元的 AI Token。这款用最 AI-Native 的方式开发出的产品,也将用最 AI-Native 的方式迭代——毕竟对于一款 Office 产品而言,用户的真实工作流也是最具价值的养料。

笔者此前从未接触过 Genspark 生态,但 GenOffice 直接调整文件格式的产品能力,让我产生了极大的兴趣。怀着好奇,笔者充值了 Genspark 基础套餐,开始了本次测试。

01

平替本地 Office?

在宣发中,GenOffice 被锚定为平替级的免费本地 Office:既不同于订阅制的 Microsoft 365,也不同于「免费+会员+广告」的 WPS。这个定位看似简单,实则门槛极高:处理一份看似简单的 Word 文档,其底层涉及复杂的几何计算与字体排版算法,背后涉及跨越数十年的代码积累。更要命的是,用户对办公软件的错误容忍度近乎为零。深厚的技术积淀、苛刻的用户需求,成为了传统 Office 厂商最深厚的壁垒。

不过,AI 赋予了 Genspark 挑战的机会。

仅仅一人一周的 VibeCoding,就让 GenOffice 拥有了可以实现基本编辑功能的产品原型。而且自发布以来,GenOffice 近乎以小时计更新迭代。许多在测试初期出现的使用问题,在最新版本已经消失。进步的速度确实惊人,但至少目前,稳定性、兼容性仍是它绕不开的短板。

笔者准备了几份结构复杂的 Word 文档,从编辑、排版到格式调整逐一实测。过程中问题接踵而至:文本时常莫名串行,甚至出现过全文英文字母全部变成竖条排列的诡异现象;在其他软件中显示正常的表格,导入 GenOffice 后也会出现额外的错位与空白;而在带表格的文档里,使用字号调节按钮批量调整时,界面会反复触发重排渲染,直接卡顿到难以操作。此外还有不少细碎的缺陷,暂不在此穷举。

 

 

GenOffice 在 Word 排版上出现了不少问题|图片来源:极客公园

 

PPT 端的兼容性同样不容乐观。一些包含复杂图形排列的 PPT 文件,在 GenOffice 中打开后会出现严重的错版错位,页面元素脱离原有的位置关系。

 

可以看出,GenOffice 还不完全是一款成熟、可替代传统 Office 软件的办公工具。

虽然目前 Genoffice 在 Word 排版和格式上仍有瑕疵,不过,笔者并不怀疑 GenOffice 团队快速的迭代能力,假以时日,它的基础能力确实有机会无限逼近传统 Office 产品。就现阶段而言,它更像是一款「AI+办公」的新形态尝试。

02

AI 排版上大分

尽管身为 Office 软件的基础能力尚有缺陷,但它作为原生 AI 工具,解决文档排版问题的能力依然值得期待。

本轮测试,我选择了一个对文档格式最为敏感的场景:论文排版。我找到一份期刊上的论文 PDF 文件,复制全文粘贴到 Word 文件中。20000 字的论文全文,没有分段、没有标注,毫无头绪地堆在一起。在这种极端场景下,我尝试让 GenOffice 从零重建论文格式。

连接上 Genspark 的 AI 能力,GenOffice 经过了数分钟的读取、分析、处理,成功识别标题、摘要等文档结构,还去除了原 PDF 复制时错杂进来的重复页眉、页码等噪声,成功完成了 2 万字的初步排版。令我惊喜的是,原文档中散乱的、原本以表格形式呈现的文字,在没有任何提示的情况下,被 GenOffice 以表格形式忠实地还原。

这意味着,GenOffice 不是按照机械规则排版的转换器,而是一款能活用模型能力,在理解的基础上编排内容格式的 AI 应用。

论文PDF

 

复制得到的杂乱测试文档

 

GenOffice排版复现文档

 

我进一步要求 GenOffice 优化格式:我将在网上复制的论文格式要求发送给 GenOffice,这次它仅用了 30 秒,就将全文格式整理完毕。经过仔细审查,生成的 Word 文档没有丢失原论文任何内容,格式完全按照要求,并将角标脚注等内容还原到了正确的位置。

在后续,我要求 GenOffice 精准调整参考文献部分的格式,它也完美完成了任务。

总结而言,GenOffice 目前展现出来的格式批量编辑能力已经足够实用。只要用户能整理好格式需求,GenOffice 就能 调动模型强大的泛化能力,连接自身扎实的转换层工具 ,将内容转换为可交付级的文档,补上 AI 办公工作流的最后一环。

03

PPT 生成靠模版

在测试 PPT 环节,笔者将自己最近研究项目的一部分交给了 GenOffice:

我将 2026 年上半年在 Kickstarter 上表现较好的「本地 AI」硬件项目的基本信息发送给 GenOffice,要求它利用 Genspark 生态的信息搜索能力,整合各个项目的细节,编排「本地 AI」赛道硬件产品的综述 PPT。

结果如下:

 

 

 

首先,它有效利用了 Genspark 的信息收集能力,查找到的信息覆盖了产品的主要卖点。但在内容组织方面,模型没有把资料归纳成清晰的叙事表达,只是简单地设计了众筹成绩、产品卖点、编辑评论等板块,再将信息直接填入页面,导致内容极度碎片化。

其次,在逐页生成的过程中,它很难保持统一的视觉风格,每张幻灯片的字体、间距、对齐方式都会有轻微差异。尽管它生成的的确是可编辑的 PPT 文件,但挨个调整版式的工作量,已经足以令人心累。

最后,它的视觉风格不够自然,仍是典型的 AI 幻灯片风格。

一个可能的解释是:驱动 GenOffice 框架完成排版,对模型而言仍是一项高负担任务。单次任务从零生成时,模型需要同时处理内容组织与版式编排,难以兼顾内容创作与审美设计能力。

如果「一站式生成」的效果不理想,那么为它加上模板约束,并且单次生成只专注于一个工作步骤呢?

首先,我找到了一份 HTML 格式的 PPT 模板,要求 GenOffice 将其 1:1 复刻为 pptx 格式。结果如下:

原模板

 

复刻效果

 

GenOffice 的转换层能力忠实还原了原模板的视觉风格,打破了 Html 代码与可编辑的 PPT 文件间的界限。接着,我将另一个 Agent 生成的详细产品分析文案内容输入给 GenOffice,要求它根据已有模板生成完整 PPT 文件。

这一次,专注于排版任务的 GenOffice 给出了结构清晰、风格明确的成果。

 

 

 

通过测试我们发现,我们仍不能把 GenOffice 当成一个全栈 PPT 设计师。当处于「一句话生成」的场景中时,由于工作流缺少全局样式约束、内容规划与页面生成互相挤占,结果便是风格漂移、内容散乱。

而随后的 HTML 模板测试给出了另一面的答案——GenOffice 的转换层效率已经相当值得信赖。当页面结构与视觉规范被提前固定后,它的设计与排版表现得到了明显提升。

两轮测试后,我们得出了让 GenOffice 高质量产出的关键: 多加限制,各司其职。

用户仍需要负责提供结构与规范,把控内容生产,再让转换层负责格式落地——明确分工,固定流程,GenOffice 才能交出接近成品的答卷。

04

开源的意义

几轮测试下来,GenOffice 的能力边界有了较清晰的轮廓:它作为 Office 软件的基础能力仍有相当大的提升空间;但作为 AI 生成到可交付成品的转换层工具,它的能力又已足够扎实:论文格式一键整理、HTML 模板 1:1 还原……只要搭配合适的工作流,它已经能给出接近成品的答卷。

但是,产出答卷的代价……有些贵。

GenOffice 的 AI 能力调用的是 Genspark 自有的 AI 生态,按积分计费。 完成以上所有测试,我消耗了 22911 积分,价格近 60 美元。对于个人用户,这样的工作消费有些难以承受

此时,开源精神的价值展露无遗。

尽管 Genspark 没有在软件内部预留外部 API 接口,但在从源码构建 GenOffice 后,我通过 Coding Agent 找到了项目中放置 API 接口的文件,并成功接入了当前最实用廉价的模型:DeepSeek V4 Flash 正式版。

用同一批任务复测:

deepseek排版效果

 

deepseek排版效果

 

作为一套专攻文档格式的 Harness,GenOffice 与 DeepSeek V4 Flash 的协作表现良好。在论文排版、基础格式调整等文本任务上,其表现与官方接口相当;但在涉及 PPT 制作、视觉还原的复杂任务上则明显逊色——这与 DeepSeek V4 缺少多模态能力的短板吻合。但最直观的差异体现在账单上: 跑完全部任务,DeepSeek V4 Flash 仅仅花费了不到 5 元人民币

当然,这不是在贬低 Genspark 的订阅价值,Genspark 卖的本就不是 Token,是 SecondBrain 记忆层、Super Agent、AI Slides/Sheets/Docs 共同构成的一体化工作空间,是「All in One 上下文」的生态沉淀。

更何况,对 Genspark 的主要服务的 7000 多家企业而言,数据沉淀、团队协作、合规与售后保障,每一项都有着难以割舍的价值。

GenOffice 开源版把模型的选择权交还到用户手里,Genspark 生态则依靠订阅收入生存,这两件事看似一舍一得,实则互为表里——正如景鲲在 AGI Playground 2026 舞台对谈中坦言的那样,他认为未来模型会逐渐变成商品化的基础设施,闭源与开源也终将走向融合。把重要的产品工具完全开源,短期是放弃收入,长期却是加速产品的成长,并为 Genspark 的整体生态铺路。

把能力开放给所有人,然后相信价值终会回流——这或许就是 AI 精神最朴素的样子,也是这家信奉「向死而生」的公司的忠实写照。

*头图来源: GenOffice

本文为极客公园原创文章,转载请联系极客君微信 geekparkGO

 

Continue Reading实测 GenOffice Alpha 版:补上办公工作流最后一环|AI 上新