首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >#WorkBuddy# 我从 0 到 4 个技能上架开放平台:3 个真实踩坑 + 一个让我彻底放弃 OCR 的惨痛教训

#WorkBuddy# 我从 0 到 4 个技能上架开放平台:3 个真实踩坑 + 一个让我彻底放弃 OCR 的惨痛教训

原创
作者头像
用户12774422
发布2026-09-20 10:23:03
发布2026-09-20 10:23:03
1170
举报
文章被收录于专栏:WorkBuddy 实战WorkBuddy 实战

一、背景:我为什么盯上开放平台

2026 年 9 月 2 日腾讯在深圳发布 WorkBuddy 开放平台,首期开放 Skill / Expert / Connector 三类能力,个人开发者也能实名后发布。我平时在信用分析工作里攒了一套"做事方法"——把图片表格转 Excel、半年度财务趋势看板、企业预警通舆情下载、企查查 UBO 识别——正好适合封装成 Skill 共享。

两周内我上架并审核通过了 4 个技能,其中 UBO 识别已有 43 次安装、40 次调用、39 个活跃用户。但这个过程里,有三件事和我最初的想象完全不一样。

二、我上架的 4 个技能

技能

领域

解决的问题

状态

图片表格转 Excel(切图读图)

财务/审计

截图/长图/扫描件表格 → 格式化 Excel

已发布

半年度财务趋势看板

金融

Wind 合并口径财务数据 → 单页 HTML 看板

已发布

企业预警通舆情下载

固收/风控

非标融资周报附件批量下载 + 长图转 Excel

已发布

受益所有人 UBO 识别

合规/反洗钱

对齐官方《受益人报告》的 KYC 合规档案

已发布(数据最好)

三、踩坑一:开放平台里的"积分"页,根本不是领奖入口

我审核通过后兴冲冲去找积分,点开左侧"积分"模块,发现它要我创建 Client ID / Client Secret 去调"积分兑换 API",还提示"个人开发者无法创建积分应用,需企业认证"。

真相:那个"积分"是给企业开发者把自己的应用接入 WorkBuddy 积分体系用的能力,和"上传技能奖励"毫无关系。个人用不了是正常的,不是你漏了什么。

四、踩坑二:"上传审核通过得 2000 积分"当前没兑现

网上不少攻略说"技能市场上传,普通模板审核通过 2000 积分、垂直优质 5000–10000"。我信了,结果:

  • 我的 4 个技能已经出现在客户端技能市场(证明开放平台和客户端是同一后端,等于早就"上传并审核通过");
  • 客户端的 Buddy 加油站 / 任务中心里,根本没有"上传技能得积分"的条目

结论:这个奖励要么活动已结束、要么从未正式上线、要么仅限特定活动期。官方文档从头到尾没提过它。别像我一样为了积分去重传,白费功夫。

五、踩坑三:开发者分成结算还在建,现在的核心是"占位"

开放平台刚上线,官方口径是"支付能力和分发通路正在加速建设"。也就是说,哪怕你的技能有安装量、有调用,分成收益目前也不会到账

但为什么还值得早进场?官方明确"生态收益分配逻辑是先让生态伙伴赚到钱",早期贡献者会优先获得回报。所以现阶段的动作应该是:把技能质量做高、把安装量做上去、把席位占住,等结算通路打通时你已经在头部。我那个 UBO 识别的 43 装就是这种"早期卡位"资产。

六、重头戏:图片表格转 Excel,我为什么彻底放弃 OCR

这是我踩过最深的坑,也是这篇最想分享的干货。

6.1 超长图被强制缩放,表格列全错位

用 PaddleOCR 跑长图时,引擎会报 Resized image size (743x10781) exceeds max_side_limit of 4000,然后把图缩到 4000 以内。一缩放,原本对齐的表格列直接错乱,OCR 跑通了结果也不可用。这是放弃 OCR 的根本原因。

6.2 paddlepaddle 3.3.1 的崩溃 bug,无解

我的环境是 Python 3.13 + paddlepaddle 3.3.1 + paddleocr 3.7.0。跑 PP-DocLayout / PP-OCRv5 系列会直接崩:

这是 onednn(PIR)后端不支持该模型属性的硬 bug。我试过:

  • FLAGS_use_onednn=0 / FLAGS_use_mkldnn=0 —— 无效
  • blocklists.pyMKLDNN_BLOCKLIST / NEWIR_BLOCKLIST —— 无效
  • 唯一有效解是 import paddleocr 前 monkey-patch 关掉 PIR:

而且 PyPI 上 paddlepaddle 最新就是 3.3.1,没有更高版本可升。加上模型缓存全套约 1GB、首次下载慢,ROI 极低。

6.3 正确姿势:切图 + 读图誊录(无 OCR 依赖)

思路是:按原分辨率把长图切成小片 → 用多模态模型逐片读图 → 人工/AI 誊录成结构化数据 → 写 Excel。列对应关系由"人眼/多模态"理解,天然不会错位。

切片脚本(重叠防断行、2x 放大提升识别率):

写表脚本(深色表头、冻结首两行、金额列右对齐):

誊录纪律:先读第一片确认表头结构,后续片沿用;重叠区按序号去重;空单元格留空;数字保留原文(如 29,448.92)写表时再转数值;行数对照图片末行序号校验。

这套方法在财报截图、公告长图、扫描件上全部稳定可用,零 OCR 依赖、出错只影响单片可重读,比折腾 OCR 省心太多。

七、总结建议

  1. 别为"上传得积分"返工——该奖励当前不兑现,以你客户端任务中心实际出现的条目为准。
  2. 开放平台现在拼的是占位和安装量,把技能质量做高、等分成结算上线。
  3. 表格类图片任务,优先切图读图,别碰 OCR 引擎,尤其是长图和 paddlepaddle 3.3.1。
  4. 想拿社区积分,可以像我这样把真实踩坑写成带完整代码的教程投稿(标题带 #WorkBuddy#,且发文账号要和客户端登录账号一致)。

如果你也在做 WorkBuddy 技能,欢迎在开放平台搜我的 4 个技能交流;关于 UBO 识别或表格转 Excel 的具体实现,也可以在评论区聊。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 一、背景:我为什么盯上开放平台
  • 二、我上架的 4 个技能
  • 三、踩坑一:开放平台里的"积分"页,根本不是领奖入口
  • 四、踩坑二:"上传审核通过得 2000 积分"当前没兑现
  • 五、踩坑三:开发者分成结算还在建,现在的核心是"占位"
  • 六、重头戏:图片表格转 Excel,我为什么彻底放弃 OCR
    • 6.1 超长图被强制缩放,表格列全错位
    • 6.2 paddlepaddle 3.3.1 的崩溃 bug,无解
    • 6.3 正确姿势:切图 + 读图誊录(无 OCR 依赖)
  • 七、总结建议
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档