GPT-6 luna VS Deepseek 4.1 flash
原帖总结如下:
https://x.com/ArtificialAnlys/status/2102462962758033624?s=20
普通 API 调用:Luna 更划算。
现在 Luna 的输入、输出单价甚至已经低于 DeepSeek V4.1 Flash 的最低空闲时段价格。
大量重复上下文 / Cache:DeepSeek 更划算。
例如 Agent 每次都带很长的固定代码、论文资料、系统提示词,DeepSeek 的缓存价格优势很明显。
能力:DeepSeek 4.1 Flash 略强,但差距不大。
独立测试大约是 39 vs 37,不是一个明显跨档次的差距。
速度:DeepSeek 更快。
如果特别看重大量并发、快速生成,DeepSeek 有优势。
但是 DeepSeek 有一个明显优势:缓存
DeepSeek 的缓存命中价格大约只有 Luna 的:30%~60%
如果你的应用反复发送大量相同的上下文,那么 DeepSeek 可能依然更省。DeepSeek 官方也明确说明,其上下文缓存默认启用,重复前缀可以计入缓存命中。
还有一个非常重要的例外:超长上下文
这是我之前回答中没有强调的地方。
GPT-6 Luna 如果一次请求的输入超过 272K tokens,整个请求会进入长上下文定价:
OpenAI 官方明确规定,超过 272K 输入 tokens 后,输入/cache 变为 2 倍,输出变为 1.5 倍。
这时候与 DeepSeek 空闲价比较:
Luna $0.20 输入 vs DeepSeek $0.15
Luna $0.75 输出 vs DeepSeek $0.60
于是DeepSeek 反而更便宜。
一句话版
常规上下文:GPT-6 Luna 更便宜。
大量 Cache 命中:DeepSeek V4.1 Flash 更便宜。
超长上下文(Luna >272K 输入):DeepSeek 空闲期通常也更便宜。
via: https://www.nodeseek.com/post-943880-1
原帖总结如下:
https://x.com/ArtificialAnlys/status/2102462962758033624?s=20
普通 API 调用:Luna 更划算。
现在 Luna 的输入、输出单价甚至已经低于 DeepSeek V4.1 Flash 的最低空闲时段价格。
大量重复上下文 / Cache:DeepSeek 更划算。
例如 Agent 每次都带很长的固定代码、论文资料、系统提示词,DeepSeek 的缓存价格优势很明显。
能力:DeepSeek 4.1 Flash 略强,但差距不大。
独立测试大约是 39 vs 37,不是一个明显跨档次的差距。
速度:DeepSeek 更快。
如果特别看重大量并发、快速生成,DeepSeek 有优势。
但是 DeepSeek 有一个明显优势:缓存
DeepSeek 的缓存命中价格大约只有 Luna 的:30%~60%
如果你的应用反复发送大量相同的上下文,那么 DeepSeek 可能依然更省。DeepSeek 官方也明确说明,其上下文缓存默认启用,重复前缀可以计入缓存命中。
还有一个非常重要的例外:超长上下文
这是我之前回答中没有强调的地方。
GPT-6 Luna 如果一次请求的输入超过 272K tokens,整个请求会进入长上下文定价:
OpenAI 官方明确规定,超过 272K 输入 tokens 后,输入/cache 变为 2 倍,输出变为 1.5 倍。
这时候与 DeepSeek 空闲价比较:
Luna $0.20 输入 vs DeepSeek $0.15
Luna $0.75 输出 vs DeepSeek $0.60
于是DeepSeek 反而更便宜。
一句话版
常规上下文:GPT-6 Luna 更便宜。
大量 Cache 命中:DeepSeek V4.1 Flash 更便宜。
超长上下文(Luna >272K 输入):DeepSeek 空闲期通常也更便宜。
via: https://www.nodeseek.com/post-943880-1