1、比如大佬们,下面图里说的这种codex限额额度价钱是,把缓存打折后的价格吗?感觉没那么多用量啊。
2.、假如输出和输出一共50k token(用户实际看到的内容+模型内部思考过程),对话轮次12轮(每次4k token),实际处理的token是340k token,那么大家说得平时自己用了多少m token是,相当于是这里的50k token,还是340k token啊?
- 图中的这种是包含缓存输入的
- 340k,因为每一轮对话都会带上之前的内容,之前的内容就属于命中缓存的部分
当然是算上滚动对话和缓存的,因为计费就是这么计的
