卓普云
#AI

#AI

汇总 AI 推理、大模型 API、RAG、模型部署和生成式 AI 应用文章,覆盖云端开发、性能优化与基础设施选型。

66 篇文章
最近更新:2026/5/14

全部文章

AI 成本太高怎么办?用推理路由自动分配 Claude、Qwen、DeepSeek
精选
教程

AI 成本太高怎么办?用推理路由自动分配 Claude、Qwen、DeepSeek

别再让简单问题消耗昂贵算力,用推理路由为每次请求找到最合适的模型。

2026年5月14日
如何在无服务器推理上运行 Hermes Agent?
精选
教程

如何在无服务器推理上运行 Hermes Agent?

用 DigitalOcean 无服务器推理与推理路由,为 Hermes Agent 搭建单一端点、多模型智能调度,降本增效。

2026年5月13日
AI 推理产品省钱指南:如何通过基建优化降低 80% 推理成本?
教程

AI 推理产品省钱指南:如何通过基建优化降低 80% 推理成本?

你用了多少大模型并不重要。你的基础设施才是核心。

2026年5月13日
AI 推理引擎四大模式:无服务推理、专用推理、批量推理与智能路由,怎么选?
精选
教程

AI 推理引擎四大模式:无服务推理、专用推理、批量推理与智能路由,怎么选?

对比 Serverless、Dedicated、Batch 和 Inference Router 四种AI推理服务,帮你从AI开发的第一天起就做出明智的选择。

2026年5月11日
如何选择 AI 基础设施:传统云 (AWS) vs. AI 聚合聚合 (Together AI) vs. AI 原生云 (DigitalOcean)
教程

如何选择 AI 基础设施:传统云 (AWS) vs. AI 聚合聚合 (Together AI) vs. AI 原生云 (DigitalOcean)

传统云架构已无法满足AI业务的发展需求;新兴的AI聚合平台又存在基础设施方面的不足;AI原生云正成为越来越多AI团队的选择。

2026年5月9日
AI 正在变成智能体,传统云不够用了:DigitalOcean 的新解法
精选
产品更新

AI 正在变成智能体,传统云不够用了:DigitalOcean 的新解法

智能体爆发,传统云失效,AI原生云成为新基础设施

2026年5月6日
比AWS还快!DeepSeek 推理接近 4 倍提速,这家 AI 推理云是怎么做到的?
教程

比AWS还快!DeepSeek 推理接近 4 倍提速,这家 AI 推理云是怎么做到的?

在 DigitalOcean 推理云上,DeepSeek V3.2 等模型实现接近4倍提速,输出速度达230 token/s,解析其背后的工程优化与架构设计。

2026年4月30日
DigitalOcean 打造 AI 原生云,帮助 AI 应用大幅降低成本与运维复杂度
精选
产品更新

DigitalOcean 打造 AI 原生云,帮助 AI 应用大幅降低成本与运维复杂度

DigitalOcean 推出 AI 原生云,整合推理、数据与模型,简化技术栈,降低成本与复杂度,助力 AI 应用快速规模化落地。

2026年4月29日
DigitalOcean 助力 ACE Studio:推理延迟降40%,训练效率翻倍
精选
新闻

DigitalOcean 助力 ACE Studio:推理延迟降40%,训练效率翻倍

基于 DigitalOcean 与 AMD GPU,ACE Studio 将推理延迟降低40%、训练周期缩短一半,实现更高效稳定的音乐生成体验。

2026年4月28日
Claude Code 官方插件 +VS Code ,稳定接入的配置指南
精选
教程

Claude Code 官方插件 +VS Code ,稳定接入的配置指南

VS Code + Claude Code 官方插件 + DO 国内直连,免翻墙不封号,直接使用Claude Opus 4.7。

2026年4月22日
快速体验 NVIDIA NemoClaw:10 分钟上手指南
精选
教程

快速体验 NVIDIA NemoClaw:10 分钟上手指南

10分钟在DigitalOcean Droplet上部署NemoClaw,安全运行OpenClaw。

2026年4月9日
拒绝 GPU 集群资源浪费:教你打造自动化降本的 AI 运维 Agent
精选
教程

拒绝 GPU 集群资源浪费:教你打造自动化降本的 AI 运维 Agent

实战演示如何打造 AI 运维 Agent,利用 DCGM 指标实现 GPU 自动审计与降本,开启 Agentic Ops 新范式。

2026年4月8日
AI 开发的最大成本,不是 GPU,而是“胶水代码”
教程

AI 开发的最大成本,不是 GPU,而是“胶水代码”

AI成本不在算力,在跨云胶水代码与人力开销

2026年4月7日
DigitalOcean 收购 Katanemo Labs:迎接 Agent 时代,重塑基础设施
产品更新

DigitalOcean 收购 Katanemo Labs:迎接 Agent 时代,重塑基础设施

DigitalOcean收购Katanemo Labs,解决AI从原型到生产的落地难题。

2026年4月3日
什么是推理即服务(Inference-as-a-Service)?
教程

什么是推理即服务(Inference-as-a-Service)?

无需自建和管理AI基础设施,即可通过API快速、可扩展且低成本地将预训练模型集成到应用中

2026年4月1日
当所有人都在讨论 AI 工具时,我们已经用 AI 跑通了一家公司
精选
新闻

当所有人都在讨论 AI 工具时,我们已经用 AI 跑通了一家公司

AI在演进,人与公司也在随之进化。

2026年3月31日
OpenClaw 多智能体部署:弹性扩展、零运维
产品更新

OpenClaw 多智能体部署:弹性扩展、零运维

当 AI 助手开始“常驻运行”,真正的难题才刚刚出现——你准备好了吗?

2026年3月27日
教程:让OpenClaw一次接入Claude、Qwen、DeepSeek 多个模型
教程

教程:让OpenClaw一次接入Claude、Qwen、DeepSeek 多个模型

不论是本地龙虾还是云端龙虾,都可以轻松接入多个模型。

2026年3月27日
高性能、低成本推理新标准:NVIDIA Dynamo 1.0 现已上线 DigitalOcean 推理云平台
精选
产品更新

高性能、低成本推理新标准:NVIDIA Dynamo 1.0 现已上线 DigitalOcean 推理云平台

NVIDIA Dynamo 1.0 现已面向 DigitalOcean 客户开放,提供 7 倍推理性能提升,大幅降低企业级 AI 推理成本。

2026年3月23日
DigitalOcean 亮相 NVIDIA GTC 2026:为智能体时代打造 AI 工厂
精选
新闻

DigitalOcean 亮相 NVIDIA GTC 2026:为智能体时代打造 AI 工厂

DigitalOcean 与 NVIDIA 联合发布 AI 工厂:NVIDIA 使用 DO 基础设施搭建 build.nvidia.com,开发者可无缝完成从模型原型到生产部署。

2026年3月20日

相关标签