模型官方一手精选85°5月11日 00:22GPT-4o 系统卡发布O官方一手OpenAI Blog博客/媒体· 2 个信源在谈阅读原文分享精选理由了解 OpenAI 在安全与多模态融合方面的最新工程实践,对模型部署和风险评估至关重要。OpenAI 发布 GPT-4o 系统卡,详细介绍了模型的能力提升、安全评估及多模态性能。该模型在文本、图像、音频等多模态任务上表现优异,同时引入了更严格的安全机制。对于 AI 从业者,这提供了最新的多模态大模型基准及安全实践参考。图片来源 · OpenAI Blog1 个信源在谈Ethan Mollick05-12 10:00原文#multimodal#safety#gpt-4o#system-card稍后读已读值得跟进有用关注 multimodal
模型Agent 与开发者多源确认73°01:29TypeSafe AI 推出 Jev 模型:让软件直接消费 AI 输出TypeSafe AI 创始人在 a16z 节目里讲他们的新模型 Jev,思路和 Claude Code 不一样,输出是带置信度的选项,软件能直接用,聊自动化为什么一直没来。#Jev#TypeSafe AI#Claude Code#Codex2 个信源在谈事件专题a16z@a16z3 个信源在谈原文稍后读已读值得跟进有用关注 Jev
模型中美对照多源确认83°00:27OpenAI 的 GPT-6 Sol 限时上线 Arena Direct Mode 可直接测试OpenAI 把 GPT-6 Sol 短暂开放到 Arena 的 Direct Mode,想去试试新模型手感的可以抓紧这 24 小时。#GPT-6#OpenAI#LMArena#推理模型10 个信源在谈事件专题lmarena.ai@lmarena_ai11 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
模型Agent 与开发者00:18RespanAI 发布 Span-01 与 Span-01 Lite,上线 OpenRouterRespanAI 出了两个专给 Agent 轨迹打分的分类模型,判断用户情绪、工具调用安全性这类行为,Lite 版免费,比 Jev 还准。#Span-01#RespanAI#OpenRouter#智能体OpenRouter@OpenRouterAI原文稍后读已读值得跟进有用关注 Span-01
模型中美对照多源确认72°00:00Claude Opus 5.0 识别 IP 共享路径后主动拒绝执行同一道题,Claude Opus 5.0 找到漏洞但选择不用,GPT-6 Astra 直接拒绝,几个顶级模型的安全表现差距一眼就能看出来。#Claude Opus 5.0#GPT-6#AI安全#模型评测9 个信源在谈事件专题官方账号Perplexity@perplexity_ai10 个信源在谈原文稍后读已读值得跟进有用关注 Claude Opus 5.0
模型Agent 与开发者精选73°23:58VoiceArena 发布 Monsoon:50 语言语音数据集让 Telugu 语音识别错误率从 92.7% 降到 16.1%同一个 Whisper Medium,换个数据集微调就把 Telugu 错误率从 92.7% 干到 16.1%,还故意保留噪声做分层,思路很值得学。#Whisper#Monsoon#语音识别#低资源语言rohanpaul_ai@rohanpaul_ai原文稍后读已读值得跟进有用关注 Whisper+3
模型Agent 与开发者83°23:12TypeSafe AI 推出模型 Jev:让软件直接消费 AI 输出a16z 聊了个新模型 Jev,它不输出文本,而是给软件返回带置信度的选项,开发者能直接用来写自动化程序,跟 Claude Code 思路完全不同。#Jev#TypeSafe AI#a16z#Claude Code1 个信源在谈事件专题a16z@a16z2 个信源在谈原文稍后读已读值得跟进有用关注 Jev