首页
学习
活动
专区
圈层
工具
发布

#算法

ConfBench:大模型的「我很有把握」,到底能不能信?

用户8729876

💡 一句话总结:ConfBench 用受控退化造出一份「低精度区」基准,首次系统测出 VLM 在文档提取时自报的置信度能不能信,还给了 ECARB 这个能直接算...

000

RAG BM25 算法和重排,微调以外的手段

掘金安东尼

微调能够提高模型的专门性,但也面临问题:数据需求大、计算资源要求高、隐私与安全问题,RAG 通过将 LLM 与外部知识库结合,在生成答案时检索相关信息,避免微调...

800

【阅读笔记】彩色转黑白Real-time Contrast Preserving Decolorization

AomanHao

传统固定权重灰度化方法在等亮度异色区域极易丢失视觉信息。Contrast Preserving Decolorization 算法通过最小化邻域像素灰度差值与原...

3210

SwanTale:字节把声音克隆和「自然语言导演」塞进了同一个模型

用户8729876

💡 一句话带走:字节 2026 年 8 月的技术报告 SwanTale 用一套统一框架(SwanVAE 连续 latent + Flow-matching Tr...

9710

5年测试开发面试为什么开始考算法?从测试平台到AI质量工程看技术能力变化

霍格沃兹-测试开发学社

霍格沃兹测试开发学社,隶属于测吧(北京)科技有限公司,是一个专注软件测试、自动化测试、人工智能测试与测试开发的技术交流社区,并参与高校测试实训、火焰杯赛事及工程...

11710

为什么调一个文档抽取 pipeline 要花几周?IDP AutoOpt 让 agent 来替你

用户8729876

💡 一句话带走:AWS 的 IDP AutoOpt 派一个跑在闭环里的 LLM agent(评分 → 逐字段诊断错误 → 改配置 → 重评),把一整条文档处理流...

9310

大模型测试为什么离不开哈希表?从Token统计、数据去重到LLM评测

霍格沃兹-测试开发学社

随着ChatGPT、Claude、通义千问、豆包等大模型应用快速落地,软件测试领域正在出现一个新的方向:

9910

接口自动化框架为什么需要链表思想?从测试任务调度看链表应用

霍格沃兹-测试开发学社

霍格沃兹测试开发学社,隶属于测吧(北京)科技有限公司,是一个专注软件测试、自动化测试、人工智能测试与测试开发的技术交流社区,并参与高校测试实训、火焰杯赛事及工程...

11200

做文档解析的人该看看 Infinity-Parser2:一个模型把版面、表格、公式、图表全端了

用户8729876

💡 一句话带走:Infinity-Parser2 把"可控数据合成 + 多任务联合强化学习"拧成一个端到端文档解析大模型,开源 500 万双语数据和两个模型,给...

10910

云上密钥管理中的BYOK与封装加密技术解析

安当加密-焱垚

云上密钥管理中的BYOK与封装加密技术解析 摘要:企业将密钥管理迁移到云环境时,核心问题不是"云厂商能不能加密",而是"根密钥由谁掌控"。BYOK(Bring...

8510

鸟类识别MCP服务器开发实战:让Cursor、Claude一键调用AI识别能力

快瞳科技

本文旨在通过详细的步骤和易懂的讲解,实现一个能识别全球鸟类品种的MCP服务器的搭建和使用,跟着指南操作,你也能轻松理解MCP的概念及实战应用。

8810

为什么AI时代,测试工程师必须补齐算法能力?

霍格沃兹-测试开发学社

一份 SKILL.md,配上脚本、工具声明和领域知识,就能让 Agent 获得一项相对完整的能力:代码审查、依赖升级、数据分析、发布计划、故障排查、测试执行……

8510

AI Agent测试中的DFS和BFS:测试工程师为什么需要理解搜索算法?

霍格沃兹-测试开发学社

11100

阅读笔记:ExtractBench: A Benchmark for Schema-Guided Enterprise Document Extraction

用户8729876

代码:https://github.com/run-llama/ExtractBench

7000
领券