新闻
关注 DigitalOcean、海外云服务、GPU 基础设施、生成式 AI、模型推理和开发者云市场的重要新闻、趋势与案例。
精选文章

推理成本最高降40%+!卓普云科技丁可拆解Agent落地五层技术栈
卓普云科技丁可在全球AI出海大会上分享AI Agent五层技术栈及推理服务选型实践。他提出以推理路由、缓存感知路由和模型合成三管齐下,实现推理成本最高降低40%以上,并以GLM+Kimi组合以48%成本超越单模型质量,为AI出海企业提供从原型到规模化的清晰路径。
全部文章
推理成本最高降40%+!卓普云科技丁可拆解Agent落地五层技术栈
卓普云科技丁可在全球AI出海大会上分享AI Agent五层技术栈及推理服务选型实践。他提出以推理路由、缓存感知路由和模型合成三管齐下,实现推理成本最高降低40%以上,并以GLM+Kimi组合以48%成本超越单模型质量,为AI出海企业提供从原型到规模化的清晰路径。
延迟降低 55%,9 台服务器撑起整套 AI 业务:这家公司怎么做到的?
AI-nhancement用DigitalOcean构建可治理AI架构,通过推理路由器统一调度Anthropic、OpenAI等模型,将延迟降低2.2倍。创始人仅凭自学,在Droplet上快速部署Mia个人AI伴侣与Anvil编程Agent,实现低成本、高可靠的多模型路由与混合云部署。
多款模型最高直降 50%:DigitalOcean 无服务器推理大降价
DigitalOcean Serverless Inference 下调 7 款主流模型价格,覆盖 DeepSeek、Qwen、GLM、Llama、Nemotron 和 MiMo,最高降幅达到 50%。
RadixArk 在 DigitalOcean 上实现 DeepSeek V4 吞吐量提升 10 倍
每 GPU 每秒 3.5K+ token,吞吐量提升 10 倍:RadixArk 在 DigitalOcean 上的 DeepSeek V4 高性能实践
Laravel 开发者已在 DigitalOcean 上开通超过 10 万台服务器
Laravel 依托 DigitalOcean 基础设施,通过 Forge 和 VPS 为开发者提供快速部署,已开通超 10 万台服务器,并持续深化 AI 工具与托管服务集成。
AI 创新先锋 Probably 携手 DigitalOcean 打造“本地优先”可验证智能体架构
依托 DigitalOcean AI 原生云,Probably 实现基础设施成本直降 25% 与天半极速上线,筑牢企业级数据隐私防线
两周部署144个Agent,LawVo 借助 DigitalOcean 扩展 AI 驱动的法律服务
两周部署144个AI法律智能体,计划扩展至数千个覆盖全美50州。LawVo如何用DigitalOcean快速构建一站式法律服务平台?
承载 1.8 亿次互动:Hippocratic AI 联合 DigitalOcean 升级下一代 AI 原生推理架构
Hippocratic AI 基于 DO 的 AI 原生云与 NVIDIA 最新硬件,实现两倍推理吞吐量,以顶级算力守护医疗安全。
DigitalOcean 助力 ACE Studio:推理延迟降40%,训练效率翻倍
基于 DigitalOcean 与 AMD GPU,ACE Studio 将推理延迟降低40%、训练周期缩短一半,实现更高效稳定的音乐生成体验。
DigitalOcean 助力 Bright Data 构建高稳定数据平台
依托 DigitalOcean 的高带宽与稳定云基础设施,Bright Data 实现全球数据采集能力提升与业务规模化增长,持续优化平台性能与效率
DigitalOcean 亮相 NVIDIA GTC 2026:为智能体时代打造 AI 工厂
DigitalOcean 与 NVIDIA 联合发布 AI 工厂:NVIDIA 使用 DO 基础设施搭建 build.nvidia.com,开发者可无缝完成从模型原型到生产部署。
DigitalOcean 基于 NVIDIA GPU 如何为 Workato 降低 67% AI 推理成本
一文详解如何针对 Workato 的长上下文、高并发工作负载,实现了每 GPU 吞吐量提升 67%、端到端延迟降低 79%、首 Token 时间(TTFT)降低 77%,同时使用的 GPU 数量减少了一半,推理成本降低了 67%。











