行业多源确认

推友展望2026年底出现1000 tokens/秒的Flash级模型

精选理由

有人放话2026年底该有每秒1000 tokens的Flash级模型了,还点名催OpenAI,评论区估计要吵起来。

一位用户在X上发帖预测,到2026年底应该会出现推理速度达到1000 tokens/秒的Flash级模型,并喊话OpenAI加快追赶。该推文将速度标杆对准了以快著称的Flash系列模型。帖中未引用具体基准数据,属于个人观点性质的速度预期讨论。

原文 · Teortaxes

I think in late 2026 we deserve Flash models that go at 1000 t/s OpenAI, git gud already