行业多源确认
推友展望2026年底出现1000 tokens/秒的Flash级模型
精选理由
有人放话2026年底该有每秒1000 tokens的Flash级模型了,还点名催OpenAI,评论区估计要吵起来。
一位用户在X上发帖预测,到2026年底应该会出现推理速度达到1000 tokens/秒的Flash级模型,并喊话OpenAI加快追赶。该推文将速度标杆对准了以快著称的Flash系列模型。帖中未引用具体基准数据,属于个人观点性质的速度预期讨论。
原文 · Teortaxes
I think in late 2026 we deserve Flash models that go at 1000 t/s OpenAI, git gud already