#AI
汇总 AI 推理、大模型 API、RAG、模型部署和生成式 AI 应用文章,覆盖云端开发、性能优化与基础设施选型。
全部文章
OpenCode AI编程实践:利用推理路由低成本开发游戏
本文通过OpenCode与推理路由无服务器大模型API编程实战,不仅成功落地游戏,更把成本直降93%,详解大模型选型避坑指南。
大模型 API 性能选型避坑指南:除了每秒 Token 数,项目上线更看重哪些指标?
大模型选型别只看每秒Token数。本文详解项目落地真正致命的8个性能指标(如TTFT稳定性、尾部延迟、有用答案成本、输出保真度等),助你摆脱跑分欺骗,精准匹配真实业务场景。
用 OpenAI SDK 接入 DigitalOcean无服务器推理:一键调用 Claude、GPT 等多种模型
只需修改一行代码,就能用 OpenAI SDK 调用 Claude、GPT-4o 等十余种模型,无需管理基础设施。
基于知识库 + MCP 构建零基础设施 RAG 智能体
本文介绍如何利用 DigitalOcean 原生服务(Knowledge Bases、MCP、Spaces)零基础设施构建 RAG 代理,实现文档检索与答案生成。
如何快速对比不同模型表现?从大模型评测指标到选型实战指南
本文拆解了大模型对比的硬指标与参数潜规则,并实战演示如何利用云端 Playground 实现零代码并排双盲测试与无缝平替部署。
AI Agent 的服务端工具(Server-Side Tools):架构、延迟与选型指南
本文对比了 DigitalOcean 托管的客户端与服务端 MCP 架构,分析了冷启动延迟与可观测性盲区,并给出选型指南。
AI 推理采用本地硬件 + Serverless 混合架构:让敏感数据不出户,算力成本更低
本文用4个维度教你拆解AI架构,靠几行关键代码桥接本地与Serverless,让敏感数据不出户,算力成本降到极致。
砍掉 60% AI 推理成本:深度解构 DigitalOcean 推理路由器的 MoE 门控与智能分流机制
本文介绍DigitalOcean推理路由器,其在基础设施层利用微调的MoE模型,实现高精度、低延迟的智能请求分流,为AI Agent深度降本59%。
AI 创新先锋 Probably 携手 DigitalOcean 打造“本地优先”可验证智能体架构
依托 DigitalOcean AI 原生云,Probably 实现基础设施成本直降 25% 与天半极速上线,筑牢企业级数据隐私防线
百亿参数开源模型托管成本账:从按 Token 计费到单卡 GPU 服务器怎么选?
百亿参数模型如何低成本托管?对比按Token计费与单卡GPU实例,助你实现算力与预算的最优平衡。
微调后的 LLM 如何部署到生产环境?GPU 推理端点的搭建、测试与上线全流程
学会用自有权重搭建私有 GPU 推理端点,从微调、导入到 VPC 内测试和监控,完成模型生产上线全流程。
告别 Token 计费时代:Kimi K2.6 与智能体 AI 的预算新范式
当智能体自行决定调用多少次模型,你的预算模型还停留在聊天时代吗?Kimi K2.6 + 无服务器推理,给出新解法。
两周部署144个Agent,LawVo 借助 DigitalOcean 扩展 AI 驱动的法律服务
两周部署144个AI法律智能体,计划扩展至数千个覆盖全美50州。LawVo如何用DigitalOcean快速构建一站式法律服务平台?
Claude Code 的开源替代方案:用 OpenCode + DigitalOcean 实现模型自由
不想被终端编码助手的供应商锁定?五分钟一键部署 OpenCode,模型随便换,按用量付费。
承载 1.8 亿次互动:Hippocratic AI 联合 DigitalOcean 升级下一代 AI 原生推理架构
Hippocratic AI 基于 DO 的 AI 原生云与 NVIDIA 最新硬件,实现两倍推理吞吐量,以顶级算力守护医疗安全。
狂热的 GPU 背后:为什么苏姿丰的 1200 亿美金预言里,主角是 CPU?
当全网都在为 GPU 疯狂时,苏姿丰却将 CPU 市场预测暴力翻倍。AI 下半场变天,谁在悄悄囤积底层算力?
实战指南:AI调用成本降71%——利用“推理路由”告别大模型胡乱开销
用推理路由器,自动将不同任务匹配最佳模型,代码任务交给claude,文本任务交给deepseek,成本比全用前沿模型降低 71%。















