歸藏用 typesafeai 的 JEV 模型做了个 3D 场景生成器,输段文案一秒搭出室内场景,光照着色都能自动处理。
全部动态
这是关于如何让AI绘画在普通电脑上流畅运行的技术,作者做了三件事:一是用嵌入翻译器减少模型大小,二是提供了一套优化流程,三是做出了一个能秒级出图的编辑器,和之前需要专业显卡的方案不同。
想了解如何用开源工具优化 AMD XDNA NPU 上大模型的性能,这篇论文用 FlashAttention 做了详细案例,对比了不同设计,还给出了具体优化策略。
Kevin Rose 发的这个 Grok Bot「INDEXX」,能帮你把 Instagram 里的视频变成本地可搜索的 Markdown 维基,比直接用 X 或 TikTok Template 更方便。
两位作者教了700+工程师,他们发现多数团队从搭平台、接LLM judge、看分数开始,这是错的,应该先手动读100条真实trace,找到失败模式,评估器才会长出来。
朋友,Greg Isenberg 说了一个很棒的创业方向,就是把按人头收费的专业服务,变成 AI 做大部分工作,人只负责审核和签字,按结果收费。用软件的成本结构,赚专业服务的钱,这个模式很聪明。
llama_index 团队开源的 DocJev 工具,能帮你快速分类或拆分文档,比 GPT-5.6 快 6 倍,准确率相当,适合处理大量文档。
朋友,这个插件很实用,帮你解决 API 密钥管理的问题,不用每次都手动粘贴,通过命令就能获取,和 Codex Remote 配合使用很方便。
GitHub 的法律团队用 Copilot CLI 开了个新工具,叫 Eyeball,给代码里嵌入了截图,这样律师就能用截图来验证 AI 分析,更放心地用 AI 帮忙干活了。
Cloudflare 的 MCP 服务器设计很巧妙,用 Remote + OAuth 授权,把 2500+ API 变成三个工具,agent 写 JS 查 API 文档再调用,操作起来很方便。
朋友用YouMind直接用图做PPT,效果超好,指定模板后图像几乎和原图一样,改文字或改图都很快,Gemini 3.8 Flash速度还快。
B站搞了个「AI无限竞技场」,让UP主用真实任务测试AI模型,比如给个屎山代码项目让模型PK,或者让不同模型玩狼人杀。比那些刷分、炫技的评测靠谱多了。
老哥 @thorstenball 说,以后写代码的活儿可能没了,因为模型能写900行零错误的代码,而人只能审查系统组合方式。现在写代码的“手艺”会消失,但“构建软件的手艺”更重要,比如理解业务问题。
朋友,LiveOverflow 分析了怎么用一张恶意 HEIF 图片攻击 OpenAI,挺有意思的,可以看看他们是怎么做的。
Datawhale 和 RadixArk 联合发起的开源课程,教你从零手搓 mini-sglang,最后能对照真实 SGLang 源码提 PR,适合想深入了解 LLM 推理引擎的人。
OpenRouter 新出的 Ori Eval 工具,能帮你量化评估不同模型,直接运行命令就能知道哪个模型最适合你的项目,比凭感觉选模型更靠谱。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档