10:26官方一手arXiv: DeepSeek@Marina Lepp, Joosep Kaimre该研究评估了ChatGPT-5.2、DeepSeek-V3、Gemini 2.5 Flash、Claude Sonnet 4.5和M365 Copilot五个生成式AI系统,使用某大学入门OOP课程的编程测试和考试任务。AI生成的代码按与学生相同的评分标准评判,并与历史学生结果及上一年度发现对比。所有AI系统均获得高于学生平均分的成绩,在较长编程任务上常拿满分,但偶尔产生无法编译的代码,在接口、抽象类和部分继承相关任务上仍表现不佳。与上一年度相比,各系统在多数测评中明显进步,但存在若干重复性错误模式。论文ChatGPT-5.2DeepSeek-V3Gemini 2.5 Flash推荐理由:这篇论文拿五个主流AI模型去考大学OOP期末题,结果都比学生平均分高,但抽象类和图形题还是会翻车,想看AI编程能力真实段位的可以读读。原文稍后读已读值得跟进有用关注 ChatGPT-5.2
00:04官方账号Microsoft Research@MSFTResearch微软研究团队分析了500万次M365 Copilot对话,通过视频和报告展示了员工实际使用AI的方式。Scott Counts在视频中解读了关键发现,涵盖会议总结、文档起草、邮件撰写等高频场景。该分析基于真实工作数据,揭示了AI在提升生产力和协作效率中的具体作用。行业M365 Copilot微软工作场景推荐理由:微软用500万次真实对话告诉你,同事到底在拿AI干什么——不是炫技,全是写邮件、做会议纪要这些日常活。原文稍后读已读值得跟进有用关注 M365 Copilot