事件专题 ·多源确认

OpenAI推出Ultrafast实现每秒300tokens

OpenAI宣布推出Ultrafast,可实现每秒300tokens的处理速度。根据SemiAnalysis分析,该服务运行在NVIDIA GPU上。OpenAI采用低批量大小策略,优先处理单个请求的速度。这与OpenAI和Cerebras专门针对超低延迟推理的合作形成对比。

当前结论

OpenAI用NVIDIA GPU实现了每秒300tokens的Ultrafast,和Cerebras的低延迟合作形成有趣对比。

11 个信源83° AI 热度最后更新 2026/9/30 12:35:46

证据链

11 个信源
相关来源 3Clement Delangue
查看原文
相关来源 9Vaibhav Srivastav
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。