谷歌发布 Gemini API 新定价策略,推理服务按需计费
谷歌近期对其 Gemini API 的计费结构进行了更新,旨在更好地满足用户的推理使用需求。这次更新带来了多种新的服务档位,包括标准、弹性、优先、批量和缓存版。用户可以根据自身的实际需求选择最合适的档位。
首先,标准档位提供了基础的推理服务,用户可以根据自己的使用情况进行选择。弹性档位则是一个创新的选择,它利用非高峰时段的闲置算力资源,为用户提供了标准价格的五折优惠。这个档位的目标延迟在 1 至 15 分钟之间,但并不保证固定的延迟时间,适合那些对时间要求不太严格的应用场景。
批量档位同样为用户提供了标准费率的五折优惠,适合需要处理大量数据的用户,延迟时间最长可达 24 小时。此档位特别适用于大规模的数据处理场景,用户在进行大量信息查询时可以大大节省成本。
在缓存档位方面,计费将依据缓存的词元数量与存储时长进行,特别适合需要频繁调用复杂指令的对话机器人、长视频分析或大规模文档集的查询。这个档位使得用户能够有效管理存储和计算资源,提高系统的运行效率。
优先档位的定价则比标准价格高出 75% 至 100%,但能够在毫秒到秒级内控制延迟。这一档位非常适合那些需要实时响应的应用,如客服聊天机器人、实时欺诈检测和关键业务智能助手等场景。谷歌建议有需求的用户选择优先档位,以确保他们的应用程序在响应速度和效率上的最佳表现。
划重点:
(来源:小熊科技)免责声明:本文内容来源于第三方或整理自互联网,本站仅提供展示,不拥有所有权,不代表本站观点立场,也不构成任何其他建议,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容,不承担相关法律责任。如发现本站文章、图片等内容有涉及版权/违法违规或其他不适合的内容, 请及时联系我们进行处理。
