模型多源确认精选5月13日 01:58GPT-4o:OpenAI发布全能多模态模型GPT-4oS官方账号Sam Altman Blog资讯· 7 个信源在谈阅读原文分享精选理由多模态免费模型来了OpenAI推出GPT-4o,该模型支持文本、图像和音频输入输出。GPT-4o在推理速度和成本上优于前代GPT-4 Turbo,并向所有ChatGPT用户免费开放。这一发布标志着多模态AI进入新阶段。6 个信源在谈OpenAI Blog05-11 23:09原文歸藏(guizang.ai)05-12 09:19原文Ethan Mollick05-12 10:00原文AK05-12 13:55原文Andrej Karpathy05-14 05:37原文IT之家05-14 08:13原文#GPT-4o#OpenAI#多模态稍后读已读值得跟进有用关注 GPT-4o
模型中美对照多源确认83°23:17OpenAI 发布 MentalHealthBench,GPT-6 Astra 得分 57.3OpenAI 拉了 80 多位心理医生做了个心理健康对话基准,GPT-6 Astra 考了 57.3 分,GPT-4o 只有 32.1,想看模型心理对话靠谱程度可以关注这套评测。#OpenAI#MentalHealthBench#GPT-6#GPT-4o10 个信源在谈事件专题rohanpaul_ai@rohanpaul_ai11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI
论文Agent 与开发者10:30LLM 能否生成阿拉伯古典 Maqama 文体?首个对照评估研究发布有人认真测了五个大模型能不能写阿拉伯古典韵散体 Maqama,连 GPT-5.4-mini 都在榜上,提示词策略的影响挺有意思。#GPT-4o#GPT-5.4-mini#提示词工程#阿拉伯语aarXiv cs.AI@AbdulRahman A. Morsy, Aya Zirikly原文稍后读已读值得跟进有用关注 GPT-4o
论文Agent 与开发者11:30LLM 解释器审计:GPT-4o 等三大后端为智能体错误行为流畅辩护论文让 GPT-4o、Gemini 当智能体解释器,结果三家全把错误行为解释得头头是道。#GPT-4o#Claude-3-Opus#Gemini#智能体aarXiv cs.AI@Param Raval 等 3 人原文稍后读已读值得跟进有用关注 GPT-4o
模型中美对照多源确认06:46Anthropic 与 OpenAI 合作发布新模型Anthropic 和 OpenAI 联手了,把 Claude 3.5 Sonnet 和 GPT-4o 组合起来,用户能选着用,比单独用哪个都强。#Claude#GPT-4o#推理模型#多模态10 个信源在谈事件专题Gary Marcus@GaryMarcus11 个信源在谈原文稍后读已读值得跟进有用关注 Claude
模型中美对照23:46Pruna AI 发布 P-Video 模型,在视频生成任务上超越 GPT-4oPruna AI 新出的 P-Video 模型,能生成 16 秒的视频,比 GPT-4o 好用。#Pruna AI#P-Video#视频生成#GPT-4oReplicate@replicate原文稍后读已读值得跟进有用关注 Pruna AI
论文中美对照精选13:04研究显示大语言模型推理能力提升心理深度需看评判者是谁朋友间推荐:研究GPT-5和GPT-4o、DeepSeek-R1和V3在心理深度上的表现差异,以及LLM作为评判者的不同结果,挺有意思的。#GPT-5#GPT-4o#DeepSeek-R1#DeepSeek-V3aarXiv: DeepSeek@Ruichen Zheng 等 7 人原文稍后读已读值得跟进有用关注 GPT-5