全部动态
Manus 团队用 Jev 做了个游戏,它能在 75 秒内帮你宜家选房间,实时操作浏览器加购物车,最后给你渲染图,比普通模型快很多。
Anthropic 的 Claude 6 个月里从只做 1% 的研发任务,变成了主导 26%,现在还参与了 90% 的研发。3 万个 AI Agent 同时干活,这 AI 研发 AI 的速度也太快了。
看 Jev + Mercury 2.5 怎么用超低成本,在 WebMCP 测试里把 49 个任务全做完,比 GPT-6 Astra 便宜 100 多倍。
Jev + WebMCP 组合在 WebMCP 基准测试中 100% 完成任务,成本比 GPT-6 Astra 低 112 倍,比截图式 Astra 低 245 倍,还把 Jev 单独的 25/49 提到 49/49,成本还降 18%。
朋友用YouMind直接用图做PPT,效果超好,指定模板后图像几乎和原图一样,改文字或改图都很快,Gemini 3.8 Flash速度还快。
Anthropic 这个 AI 公司,最近在旧金山建了个能做真实生化实验的实验室,准备用 AI 去搞药物研发,还收购了 Coefficient Bio 公司,目标就是解决传统药企觉得难啃的罕见病问题。
牛津研究团队发表新论文,通过数学论证指出,大模型(LLMs)无法真正“发明”新事物,因为它们本质上是预测下一个词的模型,无法相信现有数据中错误的信息。作者认为,人类能够基于现有数据提出新理论,而大模型则只能反映过去。作者每天使用这些模型,发现新突破通常来自人类判断现有数据错误并做出新理论。
B站搞了个「AI无限竞技场」,让UP主用真实任务测试AI模型,比如给个屎山代码项目让模型PK,或者让不同模型玩狼人杀。比那些刷分、炫技的评测靠谱多了。
朋友用 ChatGPT Pro(GPT 6 Astra)做了个《桃花源记》的朗诵版,把央视李立宏老师的真人朗诵加上了时间戳,挺有意思的。
Cloudflare这个免费工具,3秒就能把你的本地AI服务变成公网可访问的URL,而且特别适合写自动化脚本,比如Stripe的回调可以直接用这个URL,不用再折腾端口映射了。
朋友,Browser Use 和 Jev 这两个团队搞了个超快的开源浏览器 Agent,搜索航班 7 秒搞定,成本才 0.0039 美元,比之前那些慢得多、贵得多的版本强多了。
朋友,有个叫 Jev 的模型很厉害,能同时玩 50 局《地铁跑酷》,成本还不到 1 美分,它和大模型不同,是专门负责高速执行,和 Astra、Fable 互补。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档