#AI
汇总 AI 推理、大模型 API、RAG、模型部署和生成式 AI 应用文章,覆盖云端开发、性能优化与基础设施选型。
全部文章
如何在无服务器推理上运行 Hermes Agent?
用 DigitalOcean 无服务器推理与推理路由,为 Hermes Agent 搭建单一端点、多模型智能调度,降本增效。
AI 推理引擎四大模式:无服务推理、专用推理、批量推理与智能路由,怎么选?
对比 Serverless、Dedicated、Batch 和 Inference Router 四种AI推理服务,帮你从AI开发的第一天起就做出明智的选择。
如何选择 AI 基础设施:传统云 (AWS) vs. AI 聚合聚合 (Together AI) vs. AI 原生云 (DigitalOcean)
传统云架构已无法满足AI业务的发展需求;新兴的AI聚合平台又存在基础设施方面的不足;AI原生云正成为越来越多AI团队的选择。
比AWS还快!DeepSeek 推理接近 4 倍提速,这家 AI 推理云是怎么做到的?
在 DigitalOcean 推理云上,DeepSeek V3.2 等模型实现接近4倍提速,输出速度达230 token/s,解析其背后的工程优化与架构设计。
DigitalOcean 打造 AI 原生云,帮助 AI 应用大幅降低成本与运维复杂度
DigitalOcean 推出 AI 原生云,整合推理、数据与模型,简化技术栈,降低成本与复杂度,助力 AI 应用快速规模化落地。
DigitalOcean 助力 ACE Studio:推理延迟降40%,训练效率翻倍
基于 DigitalOcean 与 AMD GPU,ACE Studio 将推理延迟降低40%、训练周期缩短一半,实现更高效稳定的音乐生成体验。
Claude Code 官方插件 +VS Code ,稳定接入的配置指南
VS Code + Claude Code 官方插件 + DO 国内直连,免翻墙不封号,直接使用Claude Opus 4.7。
拒绝 GPU 集群资源浪费:教你打造自动化降本的 AI 运维 Agent
实战演示如何打造 AI 运维 Agent,利用 DCGM 指标实现 GPU 自动审计与降本,开启 Agentic Ops 新范式。
DigitalOcean 收购 Katanemo Labs:迎接 Agent 时代,重塑基础设施
DigitalOcean收购Katanemo Labs,解决AI从原型到生产的落地难题。
高性能、低成本推理新标准:NVIDIA Dynamo 1.0 现已上线 DigitalOcean 推理云平台
NVIDIA Dynamo 1.0 现已面向 DigitalOcean 客户开放,提供 7 倍推理性能提升,大幅降低企业级 AI 推理成本。
DigitalOcean 亮相 NVIDIA GTC 2026:为智能体时代打造 AI 工厂
DigitalOcean 与 NVIDIA 联合发布 AI 工厂:NVIDIA 使用 DO 基础设施搭建 build.nvidia.com,开发者可无缝完成从模型原型到生产部署。
















