23:28LlamaIndex@llama_index精选LlamaIndex 研究了静态嵌入模型在检索任务中的表现。静态嵌入模型提供无与伦比的吞吐量,但相比传统嵌入模型存在准确度损失。研究团队尝试了多种改进方法,包括在每词嵌入上进行原始最大相似度评分、训练小型适配器模型以及改变蒸馏训练目标和教师模型。尽管这些方法未能达到预期效果,但研究深入探讨了静态嵌入模型的工作原理和局限性。AI模型LlamaIndex静态嵌入嵌入模型推荐理由:LlamaIndex 分享了提升静态嵌入模型检索性能的实验,虽然结果不理想,但提供了宝贵经验。原文稍后读已读值得跟进有用关注 LlamaIndex
15:03IT之家(博客/媒体)精选72°英伟达使用 DeepSeek-v4-PRO 1.6T 模型在 Vera Rubin 服务器上测试,每兆瓦吞吐量达到 GB300 的 30 倍,每百万 Token 成本仅为 GB300 NVL72 的 35 分之一,大幅提升智能体运行效率。AI模型DeepSeek-V4-PRO英伟达Vera Rubin5 个信源在谈事件专题推荐理由:英伟达 DeepSeek-V4-PRO 模型在 Vera Rubin 服务器上表现出色,吞吐量大幅提升,值得关注。原文稍后读已读值得跟进有用关注 DeepSeek-V4-PRO
02:49OpenRouter@OpenRouterAIOpenRouter 宣布服务层级成为一等公民,用户可在 /v1/models/endpoints 中查看各层级的具体延迟和吞吐量,以明确费用对应性能。支持使用 openai/flex、xai/priority 等可复制 slug 进行路由,也可沿用原有的 service_tier 参数。这一更新让开发者能更精细地控制 API 调用的成本与速度。AI产品OpenRouter服务层级API路由10 个信源在谈事件专题推荐理由:OpenRouter 这次更新直接告诉你每个服务层级的延迟和吞吐量,选 openai/flex 还是 xai/priority 心里有数了。原文稍后读已读值得跟进有用关注 OpenRouter