企业使用AI的真实成本:订阅、API,还是自有机器

一家五十人的中小企业想为团队配备AI助手,会收到三种无法直接比较的报价:每名员工每月的价格、每百万token的价格、一台机器的价格。本文依据2026年10月1日生效的公开价目表,把这三种账单换算成同一个单位。

用三种方式为同一个回答付费

第一种模式是按用户订阅,也称按席位授权。企业为每个获准使用工具的人支付固定金额,无论此人每天用十次还是每月用一次。主流对话式助手的团队版,以及集成在办公套件中的副驾驶类工具,采用的都是这种模式。

第二种模式是通过API按用量付费。API即应用程序接口,让软件可以向供应商的模型发送请求并接收回答。供应商按处理的文本量计费,计量单位是token。这里没有按人头收取的订阅费:账单随用量而变。

第三种模式是自己拥有机器。企业购买一台能运行开放权重语言模型的计算机,所谓开放权重模型,指其参数已公开发布、可以安装在自己环境中的模型。成本变成一笔分几年摊销的投资,外加电费和维护。请求数量不再改变账单,只改变机器的负载。

这三种模式回答的不是同一个问题。订阅买的是开箱即用的服务。API买的是原始算力,需要集成到自己的工具中。机器买的是固定容量,不限调用量,但受其性能所限。要比较它们,必须把每种报价折算成特定用量下的月成本。

token,语言模型的计量单位

token是一段文本片段,通常是词的一部分,模型逐个读取和生成。Anthropic的定价文档给出了一个数量级:在英文中,一个token约为四个字符,大致相当于一个词的四分之三。文档同时说明,具体的计数因语言和内容类型而异。长度相同的法文文本、数字表格或源代码,产生的token数并不相同。

供应商把token分为两类。输入token对应模型接收的全部内容:问题、指令、对话历史、附带文档。输出token对应模型写出的内容。后者明显更贵。在2026年10月1日的价目表上,无论是Anthropic当前的模型,还是OpenAI的gpt-6系列,输出token的价格都是输入token的五倍。

token并不是在不同供应商之间稳定的单位,在同一供应商的不同代模型之间也不稳定。Anthropic表示,从Claude 4.7起,其模型使用新的文本切分器,同样的文本大约多产生30%的token。标价相同的情况下,换模型之后同一项任务的成本可能更高。在两家供应商之间比较每百万token的价格,就像比较每公斤的价格,却不知道两台秤的校准是否一致。

2026年10月1日价目表上的数字

订阅方面,Claude价格页面(2026年10月1日查阅)显示,Team方案的标准席位按月计费为每席位每月25美元,按年承诺为20美元。高级席位按月为125美元,按年为100美元。Enterprise方案由每席位每月20美元的基础费用(按年计费)与按API费率计收的用量费用组成。最后一点值得注意:在这一级别,订阅不再为支出设置上限。

微软于2025年12月1日推出Microsoft 365 Copilot Business,每用户每月21美元,面向不超过300名用户的组织,需年度承诺。该授权是在现有Microsoft 365 Business订阅之上的叠加,而非替代。面向大型企业的方案标价为每用户每月30美元。

API方面,OpenAI的定价页面(同一日期查阅)列出其最新一代模型:从gpt-6-luna(每百万输入token 0.10美元,输出0.50美元),到gpt-6-astra(10美元和50美元),中间有gpt-6.1-sol(2美元和10美元)。在Anthropic,Claude Haiku 4.5为输入1美元、输出5美元,Claude Sonnet 5.5为2美元和10美元,Claude Opus 5.5为4美元和20美元。仅在gpt-6这一代之内,价差就达到一百倍。

有两种机制可以降低这些价格。批处理接受延迟响应,在两家供应商处都能使账单减半。对重复指令使用缓存,则以输入价格的一小部分计收重复读取:Anthropic大多数模型为基础价格的10%。以上金额均以美元计,不含税,供应商也注明价格可能调整。

账单如何随用量变化

我们做一个刻意简化的假设。五十名员工,每人每个工作日发出三十次请求,每月二十一个工作日,共31 500次请求。每次请求携带3 000个输入token,包含一条指令、少量历史记录和一份简短文档,并产生600个输出token的回答。当月合计为9 450万个输入token和1 890万个输出token。

使用Claude Sonnet 5.5,这一用量的成本是输入189美元、输出189美元,合计每月378美元。使用Claude Opus 5.5,是其两倍:756美元。使用gpt-6-astra,是1 890美元。使用gpt-6-luna,是18.90美元。作为对照,五十个按月计费的Claude Team席位为1 250美元,五十个Copilot Business授权为1 050美元,这还不包括它们所依附的Microsoft 365授权。

这个计算表明,对于适度而稳定的使用,中等规模模型的API可能比订阅更便宜。但它没有说明全部问题。仅有API既没有界面,也没有账号管理,更没有与企业文档的连接:这些都要自己建设或另行购买。而且每次请求3 000个token的假设并不牢靠。

Anthropic的文档估计,一个普通网页约为2 500个token,一篇500千字节的PDF研究论文约为125 000个token。如果助手在一次对话的十轮交流中每轮都重新读取该文档,就会消耗125万个输入token,在Claude Sonnet 5.5上单次分析即为2.50美元。启用缓存后,同一次对话可降至约0.54美元,前提是各轮交流在缓存过期之前衔接进行。智能体,也就是通过连续多次调用模型来完成一项任务的程序,会放大这一现象:每一步都会重新发送累积的上下文。在API上,账单取决于用户数量的程度,小于取决于让模型重新读取的文本量。

价目表上看不到的成本

第一项隐性成本是集成。把模型接入邮件系统、共享文件夹、管理软件或客户数据库,需要开发时间、测试和持续维护。这笔成本不出现在任何价格页面上,完全取决于每家企业自己的信息系统。

第二项成本取决于处理发生的位置。对于2026年3月5日起发布的模型,OpenAI对区域处理端点加收10%的附加费,这类端点保证数据留在某个地理区域内。当客户要求仅在美国境内处理时,Anthropic适用1.1的系数。选择数据在哪里处理,有明确的价格。

第三项是模型的更新换代。OpenAI的模型退役页面显示,GPT-4.5 preview于2025年4月14日宣布停用,并在三个月后的2025年7月14日停止运行。每次替换都需要验证指令、输出格式和回答质量是否依然成立。这项重新验证的工作每一代都会重来。

第四项是价格的不稳定,涨跌皆有可能。Anthropic曾宣布Claude Sonnet 5的发布价格为2美元和10美元,有效期至2026年8月31日,9月1日起上调至3美元和15美元。上调最终被取消,发布价格成为标准价格。结果对客户有利,但决定权不在他们手中。建立在API价目表之上的预算,始终取决于供应商的决定。

第五项涉及退出。为更换服务商而取回自己的数据、对话历史和配置,长期以来是收费的。欧盟数据条例自2025年9月12日起适用,在2027年1月12日之前允许收取以实际成本为限的切换费用,此后则予以禁止,包括数据退出费用。它并未解决技术依赖问题:为特定模型编写并调校的指令,换到另一个模型上并不总能不经修改直接使用。

拥有机器:购置价格、折旧与电费

为了分析一个真实案例,我们以NVIDIA DGX Spark为例,这是一台为运行语言模型而设计的紧凑型计算机,配备128 GB统一内存。它是公开的参考样例,并非推荐。据一家跟踪其价格的欧洲经销商称,它于2025年10月以3 999美元发布,随后NVIDIA在2026年2月以全球内存短缺为由将价格上调700美元。2026年9月,据一家欧洲经销商(pi3g)的报价,在欧洲销售的版本起价约为5 038欧元(不含税)。硬件同样会遇到买方无法掌控的涨价,但买方只在购买时承受一次。

在法国,计算机硬件通常按三年直线法折旧,即每年摊销价值的三分之一。不含税价低于500欧元的设备可以直接计入费用。按三十六个月摊销,5 038欧元约合每月140欧元。

电费由功率计算得出。NVIDIA的文档注明这台机器配有240瓦外置电源。如果它始终以该最大功率运行,这会高估实际情况,因为空闲时功耗会下降,那么每年将耗电2 102千瓦时。按专业蓝色电价基础选项,自2026年8月1日起,根据能源监管委员会2026年7月15日的决议,为每千瓦时0.1624欧元(不含增值税,含消费税),年电费上限约为341欧元,即每月28欧元。

因此,这台机器的月拥有成本上限约为168欧元,尚未计入维护、更新、备份以及负责人员的时间。作为回报,请求数量不会改变账单。限制在别处:一台机器能同时处理的请求数量有限,模型越大越少,而且它所能运行的开放权重模型,并非在所有任务上都能达到最大的商业模型的水平。只有用企业的真实任务进行试用,才能得出结论。

一种稳妥的比较思路

比较以三十六个月为期,即硬件的折旧年限,并区分货币:API和订阅以美元计费,在欧洲购买的电力和硬件以欧元计费。按某一天的汇率换算,会在三年的跨度上造成虚假的精确。

第一步是测量。在一个小组中用API做几周的试点,可以得到每次请求的真实token数,供应商的控制台会显示这个数字。这一测量胜过任何假设,包括本文的假设。

第二步是区分不同的使用方式。偶尔使用的用户在API上花费很少,在订阅上花费很多。高频用户,或需要重复读取大量文档的自动化处理,则会反转这一比例。当用量大而稳定,或当一部分数据不得离开企业时,自有机器就变得有意义,无论替代方案的价格如何。

第三步是在入场时就核算退出。如果十八个月后要更换供应商、模型或价格表,要花多少钱?以我们的例子中的数字,月成本上限约为168欧元的机器,对比的是:使用中等模型每月378美元的API,或使用最小模型不到20美元的API。这个计算并不指出普遍的赢家。结果取决于用量、数据性质和所要求的质量,这三个参数只有企业自己知道。

价目表没有说明的事

这三种经济模式并不互相排斥。许多组织将三者结合:办公场景使用订阅,少数需要超大模型的临时处理使用API,稳定的用量和不得离开场所的数据使用自有算力。重要的是,对每一条数据流,都知道它花多少钱,以及由谁来定价。

这就是HOMN采用的思路:本地处理的固定成本事先已知,云端的使用逐条数据流决定,并衡量其成本。本文数字截至2026年10月1日;来源中引用的价格页面可用于更新这些数字。

什么是token,相当于多少个词?

token是模型读取或写出的一段文本,通常是词的一部分。Anthropic估计,在英文中一个token约为四个字符,即四分之三个词。具体计数因语言、内容和模型的文本切分器而异。

API比按用户订阅便宜吗?

对于适度使用,通常是的:在我们假设的50名员工情形下,中等模型的API每月378美元,而订阅超过1 000美元。但API不提供界面和集成,处理长文档和使用智能体时账单上涨很快。

本地AI机器的电费是多少?

取决于其功率。配备240瓦电源的机器,在持续满负荷运行时每年最多耗电2 102千瓦时,按自2026年8月1日起生效的专业蓝色电价基础选项,约合341欧元。

AI服务器应按几年折旧?

在法国,计算机硬件通常按三年直线法折旧。不含税价低于500欧元的设备可以直接计入费用。您的会计师会确认适合您情况的年限。