#内容审核
共 27 条 · 7 天 2 条 · 30 天 5 条
信息流里打上「内容审核」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月7日
10月6日
Anthropic 将 Claude 威胁性对话上报警方,涉事用户被捕
Anthropic 把 Claude 聊天里威胁警局的对话交给了警方,用户真被抓了。聊 AI 时说的每一句它都可能转给警察,这个案例值得看看。
10月1日
9月24日
9月10日
9月7日
9月4日
8月13日
8月11日
8月5日
7月22日
行业19:49
阿里云AI平台助EaseMate实现99.5%+内容审核准确率,成本降20%阿里云晒出真实客户案例:EaseMate用他们AI服务,内容审核准到99.5%以上,还省了20%成本,做AI平台的人都该看看。
产品15:03
Substack 导入 AI 检测工具 Pangram,可显示内容 AI 生成比例Substack 上了个新工具,能告诉你一篇文章有多少是 AI 写的,防止被“假人”内容忽悠。
IT之家原文
7月19日
7月17日
7月15日
Flo Health 借助 Amazon Bedrock 扩展医疗内容审核(第二部分)
Flo Health 用 Amazon Bedrock 把概念验证做成了能用的医疗审核系统,效率提升明显,值得了解。
7月6日
6月25日
6月12日
论文09:15
Mod-Guide:基于LLM的内容审核系统,提升对少数族裔敏感言论的识别内容审核系统常忽视文化隐性歧视,Mod-Guide通过RAG融入少数群体视角,做AI伦理或内容审核的团队值得关注其方法论。
6月5日
OpenAI 在 Responses API 和 Completions API 中推出内容审核分数
做 AI 内容审核或安全过滤的开发者终于可以少写一个 API 调用——在生成回复的同时拿到审核分数,直接决定是放行还是拦截,建议试试这个集成方案。
5月28日
产品12:50
YouTube 改进 AI 视频标注:位置更显眼,引入自动检测YouTube 这次把 AI 标签放到了更显眼的位置,还加入了自动检测,做视频创作的创作者和平台运营者需要关注——这会影响内容审核流程和观众信任度,建议点开看看具体规则。
IT之家原文
5月26日
5月25日
5月19日
5月11日