首页
学习
活动
专区
圈层
工具
发布

#LLM

在 LLM 上接 Web Search 和 Web Fetch,让 AI 长出"实时联网"的能力

用户12550040

所以,"让大模型联网"已经从锦上添花变成了生产级 LLM 应用的标配。但联网不是塞一个 URL 就完事,而是一条由 Web Search、Web Fetch、L...

1100

在 LLM 上接 Web Search 和 Web Fetch,让 AI 长出"实时联网"的能力

用户12550040

所以,"让大模型联网"已经从锦上添花变成了生产级 LLM 应用的标配。但联网不是塞一个 URL 就完事,而是一条由 Web Search、Web Fetch、L...

1100

Grok 4.6:追平 GPT-5.6 Sol 的半价旗舰,但别只看跑分

用户8729876

💡 一句话总结:Grok 4.6 在智能指数上追平了 GPT-5.6 Sol(都 61 分),token 价格只有一半——但真正让人意外的是它的回合效率(完成 ...

1800

DeepSeek V4-Pro 转正:号称追平 Claude Fable 5,但跑分只有一家在说

用户8729876

💡 一句话总结:DeepSeek V4-Pro 旗舰模型今天正式 GA,Agent 能力据报暴涨(DeepSWE 从 12.8 飙到 62.7),价格比 Cla...

4400

openclaw源码解读——入门与破局:3 仓库目录结构全景图:src、packages、skills、extensions 各自负责什么

用户7408547

很多初读 OpenClaw 源码的开发者,面对庞大的代码仓库往往会迷失方向。OpenClaw 的设计非常工业化,它并没有把系统拆成复杂的微服务,而是采用了一种 ...

3300

openclaw源码解读——入门与破局:2 OpenClaw项目定位与设计哲学:为什么它值得读

用户7408547

在逐行拆解代码之前,我们必须先回答一个问题:OpenClaw到底想解决什么问题?它为什么选择这样的架构? 理解设计哲学,是读懂源码的「第一把钥匙」。

2300

openclaw源码解读——入门与破局:1. 100篇死磕OpenClaw源码:一份写给技术人的“苦修”路线图与专家养成指南

用户7408547

Computing is pop culture...Pop culture holds a disdain for history. Pop culture ...

6610

从"聊天机器人"到"数字员工":如何用Code is Agent重新定义AI智能体

天青色等烟雨111

2026年,AI智能体(Agent)赛道已经卷到了令人窒息的程度。打开任何一个技术社区,你都能看到"多Agent协作""MCP协议""工具调用"这些词被反复提及...

5310

跨越"评估盲区":AI系统可观测性、LLMOps全链路追踪与业务价值归因实战

用户12583401

2026年8月,企业AI应用已从"试点探索"迈向"规模化运营",但随之而来的"效果黑箱"与"成本失控"正成为C-Level高管叫停AI项目的头号杀手。Gartn...

4800

LEEHPC 集群中部署 Open-WebUI + Ollama 大模型推理服务的完整记录

用户5615538

一句话总结: 在 LEEHPC 集群 GPU 节点部署 Ollama + Open-WebUI,通过管理节点 Nginx 反向代理实现多用户统一入口访问大模型,...

7410

大模型参数存储格式揭秘:BF不是男朋友

蛋先生DX

腾讯 | 前端研发 (已认证)

温馨提示:另有配套视频版,附带图解演示,观感不同,欢迎到各大视频平台搜索【蛋先生说识】

8210

部署更安全的 AI 智能体的四种方法

NVIDIA AI

Developer | 开发 (已认证)

知识工作者正越来越多地将 AI 智能体集成到其工作流中。作为“数字同事”的智能体具有明显的优势。例如,他们可以查看错误报告、实施和测试修复程序、推送补丁程序,以...

10220

【第二部分:大模型应用开发基础】8.Structured Output——让模型输出可被程序可靠处理的数据

夫子

上一篇介绍了 Function Calling:让大模型能够根据用户目标选择工具、生成参数,并调用数据库、业务 API 或其他程序能力。

12310

为什么企业部署本地大模型后,仍然需要云端模型?

taohui

不少企业接入大模型走到一定规模后,都会做同一个决定:把 DeepSeek、Qwen、GLM 这类开源模型部署到自己的 GPU 集群上。理由很直接——数据不出内网...

8400

大模型推理服务化:从 Embedding 到 LLM 的 K8s 部署全流程

gavin1024

摘要: 大模型推理是 AI 应用提供服务的最终环节,通常表现为大规模、高并发、请求突发性强的在线服务。腾讯云容器服务 TKE 围绕模型推理场景提供推理加速框架 ...

14910

Prompt-Region Grounding:为什么把题目画进图片,多模态大模型就集体"不会做题"了

用户8729876

💡 一句话总结:把题目从文本挪进图片,主流多模态大模型几乎全军覆没(24 个组合全掉分,平均 17.8 分),而它们常常能正确"读"出题目却不照它作答——这篇论...

9610

智能体工作流引擎设计:LangGraph与状态机在企业生产中的应用

网渡科技

随着大语言模型(LLM)能力快速演进,企业级 AI 应用正在从简单的“问答机器人”进入“智能体(Agent)协同执行”阶段。生产环境中的 Agent 不再只是调...

13510
领券