8月15日
06:02
06:02官方账号Simon Willison’s Weblog博客/媒体
精选
Simon Willison的博客有1,856个标签,直接让LLM从中挑选匹配项容易超限。Doug Turnbull提出先让模型自由生成标签,再通过向量嵌入在现有标签库中查找最接近的具体标签。示例提示词展示了如何用家具分类层级结构来引导模型生成形状合理的候选标签。这样既能利用模型对语义的理解,又能保证最终标签来自既定词表。
推荐理由:给老博客补标签别硬分类——先让LLM随便编,再用向量嵌入找最接近的现有标签。Simon Willison分享的这套路,比直接要模型选1856个标签里的一个靠谱。
5月13日
00:33
00:33官方一手Google Developers Blog博客/媒体
70°
Google 宣布 Gemini Embedding 2 正式可用,该模型能将文本、图像、视频、音频和文档映射到统一的语义空间,支持在单一请求中处理交错的多模态输入。它显著提升了智能体 RAG、视觉搜索和内容审核等任务的性能,支持超过 100 种语言,并提供任务特定前缀和 Matryoshka 维度缩减等功能。这使得构建复杂 AI 代理更加高效和精准。
推荐理由:对需要跨模态语义搜索和智能体构建的开发者而言,Gemini Embedding 2 的统一嵌入能力可简化架构并提升检索质量,值得关注其在实际部署中的表现。