ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

网易智企两项大模型安全能力入选金融业人工智能安全工具首批权威目录

网易智企两项大模型安全能力入选金融业人工智能安全工具首批权威目录

近日,国金认证公布金融业人工智能安全工具首批征集名单。“网易智企·易盾大模型安全评测” 入选 AI安全测试类,“网易智企·易盾大模型安全围栏” 入选 AI安全防护类,覆盖大模型应用上线前安全评估与运行中实时防护两大关键环节。

此次入选,体现了网易智企在人工智能安全治理、大模型风险评测、内容安全防护、模型安全防护等方向的技术积累与场景落地能力,也标志着网易智企·易盾面向金融行业 AI 安全建设的综合能力获得权威认可。

01 战略引领,金融 AI 安全进入体系化建设新阶段

当前,人工智能正加速融入金融服务、风险控制、运营管理、客户交互、智能办公等核心场景,成为推动金融数字化转型和服务效率提升的重要力量。与此同时,大模型幻觉、提示词攻击、越权访问、敏感信息泄露、违规内容生成、模型滥用等新型风险也随之显现,对金融机构的安全治理、合规管理和风险防控能力提出更高要求。

国家“十五五”规划明确提出,推动建立人工智能全生命周期风险管理制度,健全覆盖安全监测、风险预警、应急响应的风险防控体系。《关于“人工智能+金融”的实施意见》也提出,要强化应急处置和风险防控,筑牢“人工智能+金融”安全屏障。

在政策、监管与产业需求共同推动下,人工智能安全已从技术选项升级为金融行业智能化发展的基础工程。构建可信、可控、可审计的大模型安全体系,正在成为金融机构推进 AI 应用落地的前置条件和长期能力。

02 双项入选,覆盖大模型安全评测与防护关键链路

此次网易智企·易盾入选的两项能力,分别面向 AI 应用落地前的安全测试与上线后的持续防护,形成覆盖“评测、识别、防护、处置、优化”的大模型安全治理闭环

其中,网易智企·易盾大模型安全评测面向大模型应用上线前、迭代中及运营期的风险识别需求,围绕内容安全指令安全等重点能力域,对模型输出、交互链路和业务场景进行系统化评估,帮助金融机构提前发现潜在安全隐患,提升 AI 应用的可控性、可靠性与合规性。

网易智企·易盾大模型安全围栏则面向大模型应用运行过程中的实时防护需求,覆盖内容安全防护、模型安全防护等场景,提供风险识别、策略拦截、动态处置与持续优化能力,帮助金融机构有效应对提示注入、敏感信息泄露、违规内容生成、恶意诱导等风险,为大模型应用构筑安全边界。

通过“评测+防护”双轮驱动,易盾能够助力金融机构在大模型应用建设过程中实现事前风险识别、事中动态防护、事后审计优化,支撑 AI 应用从“可用”走向“可信”。

结语:深耕安全,打造可信 AI 时代的安全基础设施

作为长期深耕内容安全、业务安全、数据安全与人工智能安全的技术服务商,易盾持续服务互联网、金融、政企、传媒、电商、游戏等多个行业,在复杂业务场景和高强度安全对抗中积累了成熟的技术能力与实践经验。

面对大模型带来的安全治理新命题,易盾将多年内容风控、攻防对抗、风险识别与策略运营能力延伸至 AI 安全领域,围绕大模型生成内容安全、指令攻击防护、模型输出合规、敏感信息保护、应用安全评测等方向持续完善产品体系,助力行业构建面向人工智能时代的安全底座。

此次入选金融业人工智能安全工具首批征集名单,不仅是对易盾 AI 安全技术能力的认可,也体现了其在金融 AI 安全治理场景中的实践价值。

未来,易盾将继续围绕人工智能全生命周期风险管理,深化大模型安全评测、安全防护与合规治理能力建设,助力金融机构在安全、可信、可控的基础上释放人工智能创新价值,为“人工智能+金融”高质量发展筑牢安全屏障。

返回列表