2026 年 9 月 2 日腾讯在深圳发布 WorkBuddy 开放平台,首期开放 Skill / Expert / Connector 三类能力,个人开发者也能实名后发布。我平时在信用分析工作里攒了一套"做事方法"——把图片表格转 Excel、半年度财务趋势看板、企业预警通舆情下载、企查查 UBO 识别——正好适合封装成 Skill 共享。
两周内我上架并审核通过了 4 个技能,其中 UBO 识别已有 43 次安装、40 次调用、39 个活跃用户。但这个过程里,有三件事和我最初的想象完全不一样。
技能 | 领域 | 解决的问题 | 状态 |
|---|---|---|---|
图片表格转 Excel(切图读图) | 财务/审计 | 截图/长图/扫描件表格 → 格式化 Excel | 已发布 |
半年度财务趋势看板 | 金融 | Wind 合并口径财务数据 → 单页 HTML 看板 | 已发布 |
企业预警通舆情下载 | 固收/风控 | 非标融资周报附件批量下载 + 长图转 Excel | 已发布 |
受益所有人 UBO 识别 | 合规/反洗钱 | 对齐官方《受益人报告》的 KYC 合规档案 | 已发布(数据最好) |
我审核通过后兴冲冲去找积分,点开左侧"积分"模块,发现它要我创建 Client ID / Client Secret 去调"积分兑换 API",还提示"个人开发者无法创建积分应用,需企业认证"。
真相:那个"积分"是给企业开发者把自己的应用接入 WorkBuddy 积分体系用的能力,和"上传技能奖励"毫无关系。个人用不了是正常的,不是你漏了什么。
网上不少攻略说"技能市场上传,普通模板审核通过 2000 积分、垂直优质 5000–10000"。我信了,结果:
结论:这个奖励要么活动已结束、要么从未正式上线、要么仅限特定活动期。官方文档从头到尾没提过它。别像我一样为了积分去重传,白费功夫。
开放平台刚上线,官方口径是"支付能力和分发通路正在加速建设"。也就是说,哪怕你的技能有安装量、有调用,分成收益目前也不会到账。
但为什么还值得早进场?官方明确"生态收益分配逻辑是先让生态伙伴赚到钱",早期贡献者会优先获得回报。所以现阶段的动作应该是:把技能质量做高、把安装量做上去、把席位占住,等结算通路打通时你已经在头部。我那个 UBO 识别的 43 装就是这种"早期卡位"资产。
这是我踩过最深的坑,也是这篇最想分享的干货。
用 PaddleOCR 跑长图时,引擎会报 Resized image size (743x10781) exceeds max_side_limit of 4000,然后把图缩到 4000 以内。一缩放,原本对齐的表格列直接错乱,OCR 跑通了结果也不可用。这是放弃 OCR 的根本原因。
我的环境是 Python 3.13 + paddlepaddle 3.3.1 + paddleocr 3.7.0。跑 PP-DocLayout / PP-OCRv5 系列会直接崩:
这是 onednn(PIR)后端不支持该模型属性的硬 bug。我试过:
FLAGS_use_onednn=0 / FLAGS_use_mkldnn=0 —— 无效blocklists.py 的 MKLDNN_BLOCKLIST / NEWIR_BLOCKLIST —— 无效而且 PyPI 上 paddlepaddle 最新就是 3.3.1,没有更高版本可升。加上模型缓存全套约 1GB、首次下载慢,ROI 极低。
思路是:按原分辨率把长图切成小片 → 用多模态模型逐片读图 → 人工/AI 誊录成结构化数据 → 写 Excel。列对应关系由"人眼/多模态"理解,天然不会错位。
切片脚本(重叠防断行、2x 放大提升识别率):
写表脚本(深色表头、冻结首两行、金额列右对齐):
誊录纪律:先读第一片确认表头结构,后续片沿用;重叠区按序号去重;空单元格留空;数字保留原文(如 29,448.92)写表时再转数值;行数对照图片末行序号校验。
这套方法在财报截图、公告长图、扫描件上全部稳定可用,零 OCR 依赖、出错只影响单片可重读,比折腾 OCR 省心太多。
#WorkBuddy#,且发文账号要和客户端登录账号一致)。如果你也在做 WorkBuddy 技能,欢迎在开放平台搜我的 4 个技能交流;关于 UBO 识别或表格转 Excel 的具体实现,也可以在评论区聊。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。