卓普云
#GPU

#GPU

汇总 GPU 云服务器、H100、H200、B300、MI300X 选型,以及大模型训练、微调和 AI 推理部署文章。

5 篇文章
最近更新:2026/4/8

全部文章

拒绝 GPU 集群资源浪费:教你打造自动化降本的 AI 运维 Agent
精选
教程

拒绝 GPU 集群资源浪费:教你打造自动化降本的 AI 运维 Agent

实战演示如何打造 AI 运维 Agent,利用 DCGM 指标实现 GPU 自动审计与降本,开启 Agentic Ops 新范式。

2026年4月8日
2026 算力旗舰:NVIDIA B300 vs H200 深度对比,DeepSeek R1/V3 成本与推理性能实测解析
精选
教程

2026 算力旗舰:NVIDIA B300 vs H200 深度对比,DeepSeek R1/V3 成本与推理性能实测解析

解析NVIDIA B300与H200 GPU的参数差异、推理性能及运行DeepSeek模型时的表现,帮助企业选择适合的大模型算力方案。

2026年3月12日
GPU对比:MI350X、MI325X、MI300X、H200、H100
教程

GPU对比:MI350X、MI325X、MI300X、H200、H100

五大旗舰 GPU 终极对决:NVIDIA H100/H200 与 AMD MI300X/MI325X/MI350X,谁才是你的性价比之王?

2026年3月3日
vLLM 推理 GPU 资源配置完全指南——从显存计算到量化与硬件选型
教程

vLLM 推理 GPU 资源配置完全指南——从显存计算到量化与硬件选型

本文系统解析 vLLM 推理运行机制,深入讲清 Prefill 与 Decode 差异、KV Cache 显存增长逻辑及并行开销,结合主流 GPU 架构,对不同模型规模下的显存与性能选型给出清晰参考。

2026年1月23日
DigitalOcean 赋能 Character.ai:推理吞吐量翻倍,成本直降 50%
精选
新闻

DigitalOcean 赋能 Character.ai:推理吞吐量翻倍,成本直降 50%

DigitalOcean与AMD合作,通过优化推理云平台使Character.ai的推理吞吐量翻倍,延迟不变的同时令牌成本降低50%。

2026年1月15日

相关标签