首页
学习
活动
专区
圈层
工具
发布

#模型

HAI会更新预装模型么?

AI模型可以直接部署在云服务器上面,费用如何?

生产级 Harness 最不该省掉的是哪一层?

技术方舟

科大讯飞 | 资深架构师 (已认证)

江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
如果预算只够认真做一层,我会优先补检查点与失败接管这一层。原因是:线上“模型变强但成功率不动”,往往不是推理能力不够,而是失败后无法收敛与恢复(超时、工具副作用、状态丢失导致反复重试)。有了检查点与可恢复状态,Agent 才能在预算耗尽、工具失败、异常注入时降级退出、回滚或续跑;这直接提升稳定性与可用性。权限清单与评测隔离也重要,但它们通常是“优化与治理”,而检查点/失败接管是“生存底座”。... 展开详请

AI大模型如何赋能智能座舱?它在语音识别、个性化服务、健康管理等方面有哪些具体应用?

健康有益自研、完成国家网信办算法备案的HealthHope健康垂类大模型,深度赋能HealthAuto智慧健康座舱。区别于通用大模型,该大模型沉淀千万级权威健康数据与循证医学标准,搭建四维动态知识网络,在多领域实现落地应用。 1)语音识别交互层面:打造随车健康顾问,支持语音、文字双模式健康问答,完成指标解读、慢病咨询、应急健康指导,适配车内嘈杂的行车环境,拓展车机语音的健康服务能力。 2)个性化服务层面:结合用户健康档案、行车过程采集的健康数据,推送定制化健康课程、起居打卡任务;依托人车家生态,根据车内健康状态生成居家干预任务,联动家居设备模式,实现千人千面的跨场景服务。 3)健康管理层面:对摄像头、雷达、可穿戴设备、体检报告等多源异构健康数据做融合解析;输出健康评分、健康风险预测、异常指标解析;生成膳食营养、运动、就医建议等个性化方案;针对晕厥、路怒、晕车等高风险场景分级研判,输出科学合规、可追溯的健康评估结果。 同时该大模型底座具备良好设备兼容能力,可以对接各类车载终端,适配不同车型快速落地。... 展开详请

语言世界模型能替代真实环境训练 Agent 吗?

workbuddy使用DSAPI无法发送图片的问题?

紫风十五年服务端架构专家,用高可用承载亿级流量,用高性能支撑毫秒级响应。为业务增长提供坚实的技术底座。
DeepSeek V4 系列本身不支持多模态,纯文本模型没法处理图片输入,这是模型能力限制不是 API 配置问题。用 DSAPI 接入时,图片消息会被模型直接忽略或报错。解决办法两条路:要么换支持多模态的模型(比如 GPT-4o、Claude 3.5 Sonnet),要么在应用层做图片预处理——OCR 提取文字再传给 DeepSeek,图片中的图表数据可以先用视觉模型转成结构化描述再喂进去。实际项目里建议做个路由层,文本走 DeepSeek 省钱,涉及图片自动切换到多模态模型。... 展开详请

deepseek为什么和其他家的大模型价格差异这么大?

技术方舟

科大讯飞 | 资深架构师 (已认证)

江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验

1、DeepSeek 的卡足够承担当前用户的使用。

2、平台高可用能力强

企业内部知识库对接大模型难不难?

技术方舟

科大讯飞 | 资深架构师 (已认证)

江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
优先利用其原生知识库与权限体系,再补充大模型能力。 优先私有化/专有云部署,模型、向量库、文件解析和日志都纳入内网治理。 先使用成熟 RAG 平台或云服务,避免从零开发全部组件。 再考虑自研编排层,将知识问答接入审批、工单、CRM、OA 等业务流程。... 展开详请

大模型幻觉问题目前有好的解决办法吗?

技术方舟

科大讯飞 | 资深架构师 (已认证)

江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验

幻觉不能被“治愈”,但可以通过“检索证据、权限与数据治理、规则校验、拒答、人工审核”降到业务可接受范围。对于企业知识库,目标应是可追溯、可验证、可拒答,而不是要求模型永远不犯错。

本地部署大模型性价比高不高?

技术方舟

科大讯飞 | 资深架构师 (已认证)

江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验

本地部署不是天然更便宜,而是“用得多、数据敏感、能力可接受、团队能运维”时更有性价比。

若仍处于试点阶段,建议先使用云端或托管服务验证业务价值;调用量稳定后,再依据真实 Token 消耗和安全要求决定是否迁移到本地或采用混合部署。

万亿参数模型开放权重后,中小团队该怎么用起来?

workbuddy 提示模型资源超出限量什么问题?

朗州浪子AI辅助独立开发。YzzPadView项目作者(PS5 DualSense 蓝牙协议解析, Windows 置顶指示器)
这个提示通常有几种常见原因: 1. 短时间内上传了过多图片(最常见) 如果用的是混元 Hy3 等视觉模型,每张图片会被编码成大量 token。连续传几张图 + 多轮对话,token 消耗会暴涨,触发限额。 2. 单次调用工具次数过多 比如一次请求里同时触发了搜索+读文件+生成等多步操作,累积资源占用超限。 3. 对话上下文过长 长对话没有及时开新会话,历史消息占用的 token 越滚越大。 建议: 图片分批传,别一口气全塞进去 长对话适时开新会话 同一张图不要重复上传 工具调用多的任务拆成小步骤执行 以上是基于实际使用经验的总结,供参考。... 展开详请

AI Agent 的下一轮竞争会从模型能力转向执行成本吗?

在token plan方式的自定义模型使用中无法路由自动切换模型问题,哪些人遇到过?是否有解决成功的,这个公司的工程师解决不了这个问题!

签到活动问题?

Qclaw bug反馈--看起来是渲染的问题?

普通开发者有必要学习大模型微调吗?

langgraph-js官方示例引用的package真有bug?

WorkBuddy挂了?选大模型问了问题没反应

日常通用写作,选哪个大模型性价比最高?

领券