全部 AI技术 安全技术 IT技术
IT技术

如何使用Python构建一个基础的Discord机器人,支持讲故事、聊天和心理健康

当你看到Discord机器人实际运行时,它们可能看起来异常复杂。机器人可以回复消息、讲故事、记住对话的部分内容,并且全天候保持在线。 当我最初开始研究它们的工作原理时,我原以为这一切背后一定涉及大量复杂的代码。 但实际上,其基本思想相当简单。 从本质上讲,Discord机器人只是一个Python程序

2026/8/15 169
IT技术

2026年LLM推理成本对比:DigitalOcean与Together AI、Fireworks AI、Modal、Nebius、Baseten和OpenRouter

完整推理平台竞品集合对比 因此,下表比较了购买模式,并引导读者访问每个提供商的实际定价页面。 平台 客户如何购买推理服务 最佳比较方法 官方来源 DigitalOcean 按令牌的无服务器推理或按GPU小时计的专用推理。 对于突发流量比较令牌成本,对于持续需求则比较每GPU小时的成功任务。 无服务器

2026/8/15 117
IT技术

如何构建具有每用户OAuth访问权限的AI智能体 [完整手册]

当你的AI智能体服务不止一个人时,每次工具调用都必须回答:这个智能体在代表谁行事?让我们通过构建一个连接Slack和GitHub的AI智能体来学习如何解决这个问题。 一次Slack读取使用该用户的工作区。GitHub issue以该用户的身份在其可访问的仓库中创建。智能体可能做出错误的判断,但绝不能

2026/8/14 209
IT技术

在DigitalOcean上构建生产级RAG助手

当你向一个原始 LLM 询问关于你产品的具体问题时会发生什么?它会回答。快速、流畅,而且经常完全是编造的。这就是本次研讨会的起点——而修复这个问题正是全部意义所在。 8月12日(星期三),我们在 DigitalOcean 的 AI 平台上现场构建了一个真实的客户支持助手。我们称它为 HelpBot,

2026/8/14 161
IT技术

在 DigitalOcean Serverless Inference 上使用 OpenCode:将 DO 托管的模型用作带推理路由器的智能体编码后端

像Claude Opus 4.8这样的前沿模型可以驱动跨语言的智能体编程,从Python到C++再到GDScript;但在生产规模下,它们的每token成本会迅速累积。DigitalOcean的推理路由器(Inference Router)直接解决了这个问题:它将常规任务路由给较小的开源模型,仅在任

2026/8/13 182
IT技术

产品实验中的双重稳健估计:当两个模型在LLM应用中均出错时

你的AI产品在六个月前推出了一个代理模式选择加入功能。你进行了倾向性分析,根据参与度层级和查询置信度进行了调整,并报告了任务完成率干净利落地提升了8个百分点。这个数字进入了季度业务回顾,大家都很满意。 不可避免地,一位严谨的数据科学家会提出一个令人不安的问题。你有多大把握倾向性模型捕获了所有混杂因素

2026/8/13 206
IT技术

为什么你的LLM账单是预期的3倍:生产环境推理系列

从业者关于隐藏推理成本乘数的论述,附带 DigitalOcean Serverless Inference 的实测数据。跨提供商的模式普遍适用。以下DO特有数字来自在 inference.do-ai.run 上记录的API运行,而非营销宣传。 差距是结构性的,而非账单错误 你在生产环境中的LLM账单

2026/8/12 222
IT技术

规模化产品实验:Airbnb、Netflix、Lyft和Uber如何对基于LLM的AI功能进行因果推断

基于LLM的AI功能的因果推断不再是理论问题。Airbnb、Netflix、Lyft和Uber都发布了详细的工程博客文章,精确描述了它们如何衡量产品变更对用户行为的因果影响。 它们提到的技术(双重差分、断点回归、双重稳健估计等)都是标准工具。 有趣的是这些团队如何在规模化生产中落地这些方法:哪些方法

2026/8/12 316
IT技术

AI评估工程:从零开始构建生产级LLM评估平台 [完整手册]

令人印象深刻的演示与值得信赖的系统之间的差距,是用评测来衡量的。 我想从一个正在数百个工程团队中发生的故事开始。 一个团队为法律研究构建了一个RAG应用。他们用40个精心挑选的问题进行测试。答案看起来不错,于是他们向合伙人团队演示。合伙人们印象深刻,他们便将其上线了。 上线三周后,一名律师助理标记了

2026/8/11 208
IT技术

一夜处理百万文档:端到端批量推理

假设你的对象存储中有一百万张支持工单,而明天早上之前你需要将每一张按问题类型分类并总结成一段话。第一时间想到的显然是通过实时聊天补全API逐个发送,但这是错误的方法。按照标准速率限制,仅请求本身就需要超过一天时间,每个token都要付全价,而且在凌晨三点的一次网络故障就可能让你的脚本半途而废。 本文

2026/8/11 236