首页
学习
活动
专区
圈层
工具
发布

#gpu

绿电赋能算力,算电协同重构能源新生态

文慧的科技江湖8676

核心载体:微电网、零碳园区、虚拟电厂、绿电管理平台业务本质:管住电的「发、储、配、售、调、消」

10400

企业GPU监控实战:从手动排查到统一算力运维

运维行者

随着人工智能、大模型训练、视频渲染和高性能计算(HPC)的快速发展,GPU 已逐渐成为企业 IT 基础设施中最重要的计算资源之一。从 AI 模型训练到数据分析,...

10910

CUDA 护城河崩了 !Claude独自跑通AMD新GPU

Amusi

一句话,一个周末,Claude直接把自家最前沿的模型跑在了一台全新的AMD MI355X机架上!

25710

多模型推理GPU利用率优化:队列感知路由与动态批处理实战指南

聚搜云-JuSouYun

部署多种模型共享 GPU 集群时,运维团队常看到的不是算力不足,而是算力浪费——一部分 GPU 持续跑在 80% 以上利用率,另一部分却在 30%-50% 之间...

11210

ollama v0.32.4 发布:Laguna 登陆 Apple GPU,Qwen3 MoE 解码修复与 Agent 技能权限全面升级

福大大架构师每日一题

ollama v0.32.4 已正式发布。本次版本围绕 Apple GPU 推理支持、投机解码草稿模型量化、Qwen3 MoE 解码兼容性和性能优化,以及 Ag...

7810

1.2 训练算力:GPU集群利用率

华夏之光永存

痛点:​ 训练集群 MFU(Model FLOPs Utilization)约 45%-55%,低于头部厂商(65%+)。

11110

WAIC 2026观察:数据库正在被AI“重写”——从GPU原生数据库到可信数据库大会的三个信号

这个DBA有点耶

7月的上海,WAIC 2026世界人工智能大会办了整整一周。展览面积首次突破10万平方米,1100多家企业带来3000多项展品。作为一个野生DBA,逛了一圈下来...

15310

2026 AI算力集群存储实战:从RAID底层原理到NVMe数据流全解析:从底层原理到企业级实战的终极指南

jack.yang

在人工智能、大数据分析与云计算主导的今天,算力(GPU/TPU)往往占据了技术讨论的聚光灯。然而,如果没有高效、可靠且高性能的存储子系统作为支撑,再强大的算力也...

13620

3360亿晶体管!英伟达Rubin GPU细节首曝:智能体AI性能提升10倍

芯智讯

7月22日消息,在GTC 2026正式发布之后,英伟达(NVIDIA)近日首次完整公开了Rubin AI GPU架构的技术细节。作为下一代AI数据中心平台的核心...

15110

Sim4Life V9.6 的 GAF 算法:用格林函数把 NEURON 压到千分之一算力,临床 SCS 规划终于跑得动了

深圳浦实

深圳浦实信息技术有限公司 | 销售经理 (已认证)

Sim4Life V9.6 于 2026 年 6 月 4 日正式发布。新版本攻克了神经刺激建模领域长期存在的计算瓶颈,同时完成平台整体优化,大幅提升工作流运行速...

300

全场景落地+生态扩容,沐曦秀出国产GPU平台竞争力

芯智讯

7月17日,2026世界人工智能大会于上海盛大开幕。国产GPU领军企业沐曦股份(688802.SH)此次在世博展馆和张江展馆设立两大展区。从芯片板卡、服务器的集...

24510

天数智芯天垓300发布,性能超越Hopper GPU

芯智讯

2026年7月19日至20日,2026世界人工智能大会(WAIC 2026)在上海召开。国产GPU厂商天数智芯在此次大会上,正式发布新一代通用GPU旗舰产品天垓...

14510

太炸裂了!好起来了?Claude Code 限额翻倍,马斯克助攻把 GPU 送上门

OpenNiuma

深夜爆更,Anthropic 联手 SpaceX 放出重磅炸弹。Claude Code 的五小时使用限额直接翻倍,峰值时段限制一并取消,API 速率大幅拉升。原...

11010

中国LineShine超算强势登顶!AI与超算领域,GPU不再是刚需?

GPUS Lady

长久以来,在大众认知中,高性能计算、人工智能训练与推理的核心算力担当都是GPU。无论是顶尖超算集群,还是大模型训练服务器,搭载大量GPU芯片几乎成为行业标配,G...

15010

18-长尾rollout为什么agentRL容易让GPU空转

anzhsoft

上一篇把工具、sandbox 和环境反馈接回了训练信号。本文继续看这个设计的代价:一旦 rollout 不再是单轮补全,而是长 prompt、长 respons...

9700

基于 Kubernetes 与分布式 GPU 集群的 AI 推理平台架构设计

网渡科技

随着大语言模型(LLM)、多模态模型以及 AI Agent 应用的快速发展,企业对于模型部署、推理服务、资源调度和基础设施管理提出了更高要求。传统单机部署方式在...

12400

Windows 10 下 AMD RX580 调用 Ollama GPU 加速教程

王瑞MVP

在 Windows 10 系统中,使用 AMD 经典老卡 RX580 运行 Ollama 大模型,无需复杂的 ROCm 或 CUDA 配置,借助 Ollama ...

20300
领券