6月19日
18:37
18:37官方账号Together AI@togethercompute
精选
Together AI分享了优化GLM 5.1推理性能的三项关键改进。他们重写了索引器的topk内核。接着融合了索引器内核以减少内存和启动开销。同时消除了限制预填充吞吐量的CPU开销。这些优化显著提升了GLM 5.1在Together AI平台上的运行效率。

推荐理由:想知道Together AI怎么让GLM 5.1跑得更快?他们分享了三个工程优化点,对部署GLM 5.1有直接帮助。
18:35
18:35官方账号Together AI@togethercompute
Together AI 上线了 Cartesia Sonic 3.5 语音模型,为开发者提供超过150种语音。通过语音查找器,开发者可以试听和比较这些语音,为实时智能体挑选最合适的角色。选定后可直接在 Together AI 平台部署,简化开发流程。

推荐理由:Together AI 集成了 Cartesia Sonic 3.5,有150多种语音可选,做实时语音智能体可以试试这个新库。
18:34
18:34官方账号Together AI@togethercompute
Together AI 部署的 DeepSeek V4 Pro 在 Artificial Analysis 基准测试中同时获得输出速度和延迟两项第一。该成绩通过优化 KV 缓存、前缀复用、内核及端点配置实现。Together AI 公开了其推理系统的具体工程方案,包括缓存策略和内核调优。
事件专题

推荐理由:Together AI 把 DeepSeek V4 Pro 调到了速度与延迟双第一,还公开了优化方法,搞推理部署的值得看看。
6月13日
6月10日
6月6日
03:02
03:02官方账号Together AI@togethercompute
Together AI 宣布推出 Ideogram 4,一款专为设计场景打造的开源图像模型。该模型具备强大的文字渲染能力、布局控制功能,并原生支持 2K 图像生成。AI 原生用户现可通过 Together Serverless Inference 在创意生产工作流中使用 Ideogram 4。这一发布为设计师和开发者提供了更可控、高质量的开源图像生成方案。

推荐理由:做设计或创意生产的团队终于有了开源的高质量图像模型——Ideogram 4 的文字渲染和布局控制解决了 AI 图像生成的常见痛点,建议设计师和 AI 开发者直接上手试试。
6月5日
21:46
21:46官方账号Together AI@togethercompute
Together AI 宣布在其平台上推出两款 NVIDIA Nemotron 模型:Nemotron 3 Ultra 专为高吞吐量的智能体工作负载设计,适合构建编码智能体和深度研究智能体;Nemotron 3.5 ASR 则专注于低延迟的多语言语音识别,适用于实时语音系统。这为 AI 原生开发者提供了在 AI Native Cloud 上构建复杂应用的新选择,降低了部署门槛。
事件专题

推荐理由:做智能体或语音应用的开发者现在有了更专业的模型选择——Nemotron 3 Ultra 适合高并发任务,Nemotron 3.5 ASR 能直接用于多语言实时语音场景,值得在 Together AI 上试试。
6月1日
11:16
11:16官方账号Together AI@togethercompute
精选
MiniMax 的最新模型 M3 已正式上线,并由 Together AI 提供推理基础设施支持。双方将于明天太平洋时间下午6点在 X Spaces 进行深度对话,分享模型和基础设施的细节。这一合作意味着 M3 模型将获得高性能的推理服务,对开发者来说是一个值得关注的进展。
推荐理由:MiniMax M3 上线并由 Together AI 支持推理,意味着模型推理性能有保障,做 AI 应用开发的团队可以直接试用,值得关注。
5月31日
19:35
19:35官方账号Together AI@togethercompute
Together AI 的两位副总裁 Dan Fu 和 Sarung 在 NVIDIA GTC 大会上参加了辣翅挑战,一边吃辣翅一边回答 AI 相关问题。视频展示了他们在辛辣刺激下的真实反应和即兴回答,既有技术讨论也有趣味互动。这个活动以轻松的方式展现了 AI 领域高管的个性和幽默感,同时传递了 Together AI 在 AI 基础设施方面的观点。
事件专题

推荐理由:想看 AI 大佬被辣到冒汗还要聊技术?这个视频把严肃的 GTC 变成了欢乐现场,做 AI 社区运营或喜欢行业趣闻的值得点开,看完会笑出声。
5月21日
5月19日
17:28
17:28官方账号Together AI@togethercompute
78°
Cursor 团队发布了 Composer 2.5,这是一款面向智能体编程的模型,标志着编程助手领域的重要进展。Together AI 作为 AI 原生云服务商,参与了此次合作发布。Composer 2.5 在速度和生成质量上表现突出,正在引领编程智能体的新潮流。
事件专题

推荐理由:编程开发者和 AI 编程工具用户值得关注——Composer 2.5 提升了智能体编程的速度和质量,做自动化代码生成的团队可以直接体验。
5月15日
07:09
07:09官方账号Together AI@togethercompute
Together AI 研究团队将有七篇论文在 MLSys 2026 会议上发表,展示从研究到生产的 AI 原生云平台成果。这些论文涵盖 AI 系统优化、模型部署效率等关键领域,体现了 Together AI 在 AI 基础设施方面的技术积累。MLSys 是机器学习系统领域的顶级会议,入选多篇论文说明其技术实力获得学术界认可。
推荐理由:做 AI 基础设施和模型部署的团队值得关注——Together AI 这七篇论文覆盖了从研究到落地的关键环节,能帮你了解当前 AI 系统优化的前沿方向。
5月12日
21:55
21:55官方账号Together AI@togethercompute
Together AI在X平台发布了一款新的开源工具包,旨在简化AI模型的训练和部署流程。该工具包支持多种主流模型架构,并提供了优化后的分布式训练功能。这一发布有助于降低中小团队使用大模型的门槛,推动AI技术的普及。
推荐理由:对于AI开发者和研究团队,该工具包提供了实用功能,可提升模型开发效率,值得关注其后续更新。
21:55
21:55官方账号Together AI@togethercompute
75°
DeepSeek V4 Pro在Together AI无服务器平台上发布,具备长上下文推理能力和领先的编程性能。该模型通过KV缓存、前缀重用、混合注意力、批处理、内核优化和端点配置等技术实现高效服务。来自@zhyncs42、@realDanFu等人的深入分析揭示了其技术细节。
推荐理由:DeepSeek V4 Pro在长上下文推理和编程任务上的表现达到SOTA,同时其高效服务技术栈的公开分析对AI部署实践有重要参考价值。
21:55
21:55官方账号Together AI@togethercompute
Yutori AI的浏览器代理产品(Scouts、Delegate、Navigator)基于Together AI推理平台运行,实现了相比前沿模型每步2倍的速度提升、4-5倍的推理成本降低,并保持99.9%的可用性与弹性扩展。这展示了在AI代理场景中,推理基础设施对产品性能的关键作用。

推荐理由:该案例说明了在浏览器AI代理这类高频率模型调用的场景下,专用推理基础设施可显著提升性能并降低成本,对AI代理产品落地具有参考价值。
5月11日
22:17
22:17官方账号Together AI@togethercompute
Together AI宣布其AI Native Cloud平台现在支持直接从Hugging Face部署任何模型,无需繁琐设置。用户只需单次会话即可运行模型,大幅降低了从“看起来不错”到“实际运行”的门槛。此举旨在简化AI模型部署流程,提升开发者和企业的实验效率。关键点是平台兼容所有Hugging Face模型,且强调零设置体验。
推荐理由:这代表AI基础设施服务商正进一步降低模型部署门槛,对于需要快速实验和迭代的AI开发团队来说,此举能显著减少从发现模型到生产环境的时间成本,推动更广泛的模型应用。