尧图网站建设 尧图网络
  • 首页
  • 关于我们
  • 服务项目
  • 案例展示
  • 建站流程
  • 资讯中心
  • 联系我们
首页/资讯中心/详情

OutSafe-Bench: A Benchmark for Multimodal Offensive Content Detection in Large Language Models

OutSafe-Bench: A Benchmark for Multimodal Offensive Content Detection in Large Language Models
📅 发布时间:2026/7/22 2:25:29

文章主要内容与创新点总结

一、主要内容

随着多模态大语言模型(MLLMs)在日常工具和智能代理中广泛应用,其输出不安全内容(如有毒语言、偏见图像、隐私侵犯、有害虚假信息等)的风险引发广泛关注。现有安全基准在模态覆盖、性能评估等方面存在显著局限,无法全面应对内容安全挑战。

为此,研究团队提出OutSafe-Bench——首个面向多模态时代的综合性内容安全评估套件,核心包含三部分:

  1. 多模态双语数据集:涵盖文本、图像、音频、视频四种模态,含18,000条双语(中英)文本提示、4,500张图像、450段音频和450个视频,均按9个关键内容风险类别(隐私与财产、偏见与歧视、犯罪与非法活动、伦理道德、暴力与仇恨、虚假信息与误导、政治敏感、身心健康、版权与知识产权)系统标注,总计23,400条查询。
  2. 多维交叉风险评分(MCRS):通过构建跨风险影响矩阵,量化单一输出中多种风险的共现与相互作用,实现对复杂真实世界安全威胁的精细化评估。
  3. FairScore评估机制:一种可解释的自动化多评审加权聚合框架,动态选择表现最优的模型作为自适应评审团,减轻单一模型判断的偏见,提升评估可靠性。

研究对9个主流MLLMs(Deepseek-v3、Claude-3.7-Sonnet、Doubao-1.5-pro-32k等)进行评估,发现这些模型普遍存在安全漏洞,尤其在图像和视频模态中风险较高,凸显了MLLMs内容安全防护的紧迫性。

相关新闻

  • 杭州正规工商财税代办机构精选,四家合规服务商优势全面解析 - 品牌测评网
  • Codex接入DeepSeek:构建本地AI剪辑助理,提升视频创作效率
  • 【项目编号project19275】|SpringBoot篮球赛购票系统:赛事展示、在线选票与订单支付流程解析

最新新闻

  • 2026年国内高分子材料检测单位哪家好 ,塑料检测、橡胶检测、涂料检测、胶黏剂检测认准五大核心标准避坑省心 - 变量人生001
  • python(序列之字符串)
  • 代码大语言模型时代:程序员如何从代码生产者进化到AI协作者
  • 2026年前海科兴科学园:科创企业的新选择与机遇 - 品牌优选官
  • Hermes Agent记忆系统架构与核心技术解析
  • 游戏音频响度控制:从RMS检测到多音轨混合的完整解决方案

日新闻

  • AI云原生实战05-金融AI上云最难的不是技术,是“不出事“——TCE银行风控架构拆解
  • 2026年GEOSEO优化公司选型深度测评:五大硬核标准严选,这六家重塑搜索增长新格局 - 品牌前沿专家
  • **核验!2026年7月卡地亚香港**售后网点地址及服务电话公告 - 卡地亚服务中心

周新闻

  • SaaS软件行业GEO实践:AI搜索时代的品牌可见性与获客新路径
  • 什么是PCTFE?医药高端包装的“防潮王牌“材料
  • 【JVM调优实战】16-可视化利器-JConsole-VisualVM-JMC

月新闻

  • 2026年6月公司网站搭建最新热门渠道测评:四大低成本/零代码平台对比+避坑
  • 【Linux】Linux arm 编译QT程序,出现expected “}“报错
  • 【MATLAB例程】四基站二维AOA定位与距离辅助增强对比仿真。基于角度观测和测距修正的固定目标平面定位精度分析

关于尧图

  • 公司简介
  • 团队介绍
  • 企业文化
  • 荣誉资质

服务项目

  • 定制开发
  • 电商建站
  • UI 设计
  • 运维服务

快速链接

  • 案例展示
  • 建站流程
  • 常见问题
  • 资讯中心

联系方式

  • 📍北京市朝阳区互联网产业园 A 座 10 层
  • 📞400-888-8888
  • ✉️contact@rkmt.cn
  • 🕐周一至周日 9:00-21:00

© 2024 北京尧图网络科技有限公司 版权所有 | 京 ICP 备 XXXXXXXX 号