起始问题r-knowledge-20260908-p027

能否评价每花一元钱,大模型完成了多少同等质量的有效工作?

有没有什么研究或者实验,是评价不同大模型完成任务的效率的?比如我们购买了某个厂商的会员,按照同样任务的完成效果,是否能算出每一块钱能完成的工作有多少?

人工智能评测方法成本效率

这一版的回答 1

回答 01社区回答2026-09-08

_本次整理(2026-09-08),非原对话逐字回答。_

_本次整理(2026-09-08),非原对话逐字回答。_ 可以评价,但必须先定义什么算“同等质量的有效工作”,再比较完成这些工作付出的成本。研究中已有成本与质量权衡、模型级联等方法;例如 FrugalGPT 在指定数据集上学习模型调用策略以降低成本,但这种结果不能直接换算成任意会员套餐的每元产出。[FrugalGPT…

生成上下文未知0 个追问阅读全文 →

关联内容 0

建议关联 ↗

关联连接不同内容,不改变原来的追问路径。社区关联表达提交者的判断,不代表平台核实。

还没有收录的关联。你可以提出一条连接及其理由。