AI 金融与商业
AI 眼镜不用联网也能识图问答了,1-bit 量化让 2B 模型塞进眼镜芯片,速度翻倍、功耗还降,端侧玩法的实用参考。
阶跃星辰的 Step-5-Preview 拿来做实测了,三个任务全程少干预:自己改 Bug 的 3D 游戏、五只股票的持仓体检页面、3 分钟部署的网页,都跑通了。
新加坡的 AnyMind 把 Alibaba 的 Qwen 模型接进了自家直播电商平台 AnyLive,做直播带货的可以看看多模型架构怎么落地。
这个叫 PASTABench 的新基准测了 16 个大模型给智能体踩刹车的时机,最好的也只拿到 40.74%,还拆穿了不少小模型靠关键词得分。
李佳琦这种顶流主播都开始被24小时不下班的AI数字人主播抢生意了,文章讲清了直播电商成本和玩法的变化。
有人在 6GB 显存的笔记本上,用土耳其语 109 页报告实测了五款 7B-8B 开源模型,还顺手证明花哨检索方案打不过 TF-IDF,做 RAG 的可以看看。
Wayve 这篇论文教你怎么用不到5%的语言标注训出能开车的VLA,Bench2Drive 上分数还超过全监督基线,做自动驾驶的值得看看方法细节。
论文提出 ARIA 框架,专门解决多个各自合规的 AI 智能体放一起可能产生集体性歧视的问题,还对照了 EU AI Act 的监管要求,做金融合规的值得看看。
OpenAI 头一回公开吐槽苹果:ChatGPT 塞进几亿台 iPhone 也没带来多少订阅,苹果还转头找了谷歌 Gemini,法庭文件里细节不少。
HEMA 用 Bedrock AgentCore 加 MCP 做了个内部助手 HAL,员工查文档不用再开一堆门户,安全走 Entra ID,方案细节写得很全。
量化到 2-bit 后模型做数学题会发疯循环?这篇论文用 on-policy 蒸馏把 MATH-500 保留率从 35% 拉到 70%,做端侧部署的可以看看。
低配显卡党福音:Unsloth 把 Qwen-Image-2.1 量化到 12GB 显存就能本地生图,6GB 显存走 FP8 offloading 也能跑,质量还对标 Nano Banana 2.0。
韶音把 Qwen 塞进了开放式耳机,双击就能问天气、记待办、总结会议,还能翻译,1398 元已经能买了。
Alex Albert 贴了一段 Claude 提示词,能让它用 Blender Python 纯代码重建 1906 年的旧金山街景,每栋楼都标注史料来源,提示词写法很值得抄。
泰国 SCB 10X 聊了个新概念:AI 智能体全天候替你买东西、比价、付款,交易流程整个重写,看看他们怎么想。