当前位置:首页>排行榜>多模态Agent安全评测与运行时治理同步升温|大模型24小时情报

多模态Agent安全评测与运行时治理同步升温|大模型24小时情报

  • 更新时间 2026-09-29 10:58:03
多模态Agent安全评测与运行时治理同步升温|大模型24小时情报

大模型24小时情报

全球模型、Agent、基础设施与安全信号

今日重点情报

1|Google将实时对话与动态视觉角色结合

Google于9月24日发布Gemini 3.8 Live with Live Avatar,将Gemini 3.8 Live的原生实时语音对话与低延迟流式视频生成结合,并宣布该能力自发布日起进入Gemini Enterprise。Agent能够同时处理视觉和音频输入,再以动态视觉角色作出响应,呈现唇形同步、自然表情和流畅的对话轮次切换。这次更新的重点是实时交互与视觉呈现能力扩展,并非新的通用旗舰模型发布,也不应被理解为Gemini 4。

Google强调接近实时的视觉呈现、精准唇形同步和自然交互,但未公布足以支持跨模型比较的标准化延迟或质量基准,因此目前不能据此判断其性能排名。面向客户服务、远程培训和数字员工等部署场景,安全审视范围需要覆盖摄像头、视频、语音与角色呈现,而不只是文字对话。视觉和语音中的指令注入、深度伪造与身份冒充,以及录音录像留存、生物特征和个人信息处理,均是需要关注的问题;涉及工具执行时,还应考虑二次确认。

观点

实时交互越接近人与人交流,越不能把感官上的可信当作权限依据。企业应按模态区分输入信任边界,将角色呈现、身份验证与工具执行授权分开治理。

来源:Google官方发布页

2|Cisco将安全榜单扩展至图像与音频

Cisco于9月24日更新LLM Security Leaderboard,将评测范围从文本扩展到图像和音频,新增69项多模态评测,其中包括55个图像模型条目和14个音频模型条目。自6月以来,榜单累计新增102项评测,覆盖136个模型,测试涉及提示注入、越狱等攻击。在Cisco的对抗图像攻击测试中,Gemini 3.1 Pro Preview的拒绝率为93.9%,Claude Opus 4.5为93.7%;音频测试中,Gemini 3.1 Pro Preview的拒绝率为90.0%。

这些数字来自Cisco特定测试方法,不能直接视为模型在真实生产环境中的统一安全表现。Cisco同时指出,部分模型在文本与图像、音频上的安全表现存在显著落差,单一文本分数不足以代表多模态Agent的整体风险。浏览器、计算机操作和语音Agent会接触网页、截图、广告、PDF、音频、摄像头输入与工具返回内容,恶意指令可能藏在这些可观察材料中,而不必直接进入系统提示。因此,评测除了检查模型是否拒绝攻击,还需结合实际工具权限,验证攻击能否转化为真实动作。

观点

多模态安全评测不应止于比较拒绝率。企业应把输入载体、模型响应与工具执行连起来测试,区分“读到了恶意指令”和“完成了越权动作”。

来源:Cisco官方研究

3|NeMo Relay原生支持OCI模型调用

据Oracle官方技术博客,NVIDIA NeMo Relay新增OCI Generative AI codec,可识别并规范化Meta、Google、xAI、OpenAI、Nemotron和Cohere等模型调用,同时支持FUNCTION工具调用与流式响应。该运行时能够记录每次模型和工具调用,在进入可观测性管线前执行个人信息脱敏与护栏处理,并追踪单次运行成本。其治理配置位于Agent业务逻辑之外,使调用记录、数据处理和成本追踪不必全部嵌入Agent自身的逻辑之中。

Oracle示例展示了Agent的完整执行轨迹,包括模型交互轮次、工具调用、Token用量和总步骤数。相比只保留最终回答,这类记录能够呈现任务执行过程中的中间调用,并为成本分析和行为审计提供依据。但示例中展示的记录范围,不应被直接等同于已经覆盖凭据使用、数据访问和全部权限决策的完整审计体系。对企业而言,需要进一步关注轨迹记录与实际模型、工具调用之间的对应关系,以及脱敏、护栏和可观测性管线的衔接,而不是仅凭最终回答判断一次运行是否安全。

观点

治理配置移出Agent业务逻辑,是运行时治理独立化的明确信号。其价值不仅在于日志更完整,更在于让安全策略与成本审计围绕执行过程展开。

来源:Oracle官方技术博客

END OF BRIEF

大模型24小时情报|自学回声

随机文章