
我拍花草拍了几十年,照片一大堆,杂乱放着,从没认真归过。去年起,我把这桩爱好也交给了搭子,做成了一个小小的植物观察程序。今天讲讲它怎么搭的,以及为什么"AI 补全"必须打上标记——这件事,我吃过亏才立下规矩。
先说工作日记,三关是怎么过的。
头一关是"这是哪棵"。手机里拍了张花,得先认出来。我没只信一个识别,而是排了一组:大众识别、专门的植物识别、PlantNet、iNaturalist,再加本地小模型和离线库,几个结果叠在一起,置信度过 85 才敢信,70 到 85 只作参考。遇到拿不准的,再丢给一个多模态模型辅助看一眼。同一张图,多渠道交叉,比只信一个稳当。

第二关是"归到哪株"。拍花草最怕今天拍这棵、明天拍那棵,最后谁是谁分不清。我让程序按"同株"归并:地点、形态、时序对上了,就归到同一株的连续笔记里。一株植物,从花到果,慢慢长成一篇连续的观察,而不是一堆散图。
第三关是"补图"。有些生长阶段我漏拍了,想补全,就让 AI 按已有样子生成一张示意。但这里有个死规矩:AI 补的图,必须带「AI 示意」角标,绝不和实拍混排。读者得一眼分清哪是真拍、哪是补的。我们第一版做"桂花",几屏画面里实拍和示意分开摆,每张示意都标得清清楚楚。

最后,程序导成能打印的文档格式,发给年纪大些的朋友,他们爱拿在手里翻,不习惯盯屏幕。整套做成单文件、零依赖的网页,手机电脑平板都能开。还顺手同步成一个对外聊草木的智能体,专门讲本地草木和原创花语。
再说动手做,五页结构加识别矩阵。
页面就五块:封面、拍识归株、单株连续笔记、收纳旧照(含 AI 补全)、我的档案。识别用多 API 矩阵,阈值卡严,别图省事只信一个;归株靠时序和地点,同一株才合并;AI 补全必标角标,这是信任的底线;导出留 WPS 兼容格式,给不爱屏读的人留一条路。
最后说一点体会。
爱好变成作品,靠的是把"随手拍"变成"连续记"。AI 帮的是认、是归、是补,但哪张是真、哪张是补,这根线得自己攥着——一旦混了,读者信你一次,下次就不信了。
收尾一句:补的图也是劳动,但劳动归劳动,真假得分明。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。