• 软件下载
  • 源码下载
  • 在线工具
  • 网页教程基础
  • 服务器常用软件
  • 手机版
  • 关注微信
奔跑吧兄弟
  • 网页制作
  • 网络编程
  • 脚本专栏
  • 脚本下载
  • 数据库
  • CMS教程
  • 电子书籍
  • 平面设计
  • 媒体动画
  • 操作系统
  • 网站运营
  • 网络安全
  • 在线手册
您的位置: 主页 > 网站运营 > 建站经验 >

作者:秉平卓 字体:[增加 减小] 来源:荆轲刺秦王 时间:2026-08-26 我要评论

奔跑吧兄弟

Windows 11 Moment 1 更新正式发布 现已可下载_我的网站

终极一班3

A |     该图片使用了AI生成技术          本文来自微信公众号: HavenlonLabs ,作者:Havenlon Labs          现在谈AI安全,很多人的第一反应都是:怎样让模型少犯错?          减少幻觉、优化提示词、防止提示词注入、增加上下文、接入更强的模型,再用另一个Agent检查前一个Agent。         这些工作当然有价值。    本次面向稳定通道的推送升级与之前Windows Insider渠道推出的更新相同,考虑到该更新自7月以来一直处于预览状态,现在的更新日志已经众所周知。         但它们容易让人产生一种错觉:只要模型足够聪明、提示词足够完善、检测系统足够复杂,AI就可以安全地完成一切。

B |          问题是,AI真的可能永远正确吗?          答案恐怕是否定的。

C | 完整的Windows 11 Moment 1更新日志如下:标签式文件资源管理器和改进的收藏夹:Windows 11中的文件资源管理器现在允许你在标签中打开文件夹,以保持较少的窗口同时打开。还有一个更新的收藏夹部分,允许你固定最常用的文件。建议行动:Windows 11通过检测文本中的电话号码或未来日期,并在相关应用程序(如电话链接、团队、Skype、日历等)中建议行动,提供了更好的协作和生产力。任务栏溢出:不适合任务栏的应用程序现在出现在一个新的溢出菜单中,就像通知区中的菜单一样,为所有运行的程序提供一个空间。         我们无法消灭所有错误          AI Agent面对的不是一道标准答案明确的考试题,而是不断变化的现实环境。         它读取的邮件可能是伪造的,访问的网页可能包含恶意指令,接收到的数据可能已经被污染,用户给出的任务也可能存在歧义。右键点击任务栏可启动任务管理器:现在可以右键单击任务栏来调用菜单启动任务管理器,微软在最近的一个开发版本中引入了这一急需的变化,但在今天的版本中似乎还没有。改进的共享:微软增强了Windows共享体验,让操作系统直接从桌面、文件资源管理器、照片、Xbox和其他应用程序中检测附近更多可发现的设备。         即使模型本身没有受到攻击,它也可能误解目标、遗漏条件,或者基于不完整的信息作出一个看起来合理的决定。

D |          我们可以持续提高模型的准确率,却很难证明它在下一次任务中一定不会犯错。Android应用支持和亚马逊应用商店:Windows 11现在支持31个国家的用户运行Android应用,通过亚马逊应用商店获取这50000多个应用。         试图让AI永远正确,是在追求一个无法验证的目标;阻止危险结果发生,才是一条可以真正落地的边界。         真正的问题不是AI会不会犯错。         它一定会。         真正的问题是:当它犯错以后,系统是否会毫无阻碍地把这个错误执行出去。         模型错误不一定等于现实损失          一个AI在聊天窗口里回答错误,造成的可能只是一次糟糕的体验。         但当同一个AI拿到支付接口、管理员权限、数据库写入权限和服务器控制权以后,错误的性质就完全不同了。         它可能把钱转给错误的地址,删除重要数据,修改生产环境,扩大成员权限,或者关闭本应保留的审计记录。         模型只是产生了一个错误判断。重新设计的照片应用程序:包含多视图窗口的照片应用程序该更新将在本月晚些时候到达。微软现在还在为其操作系统进行另一批改进,最近公司宣布了一款原生的屏幕录像功能,照片应用程序中的iCloud整合,以及即将在Windows 11中出现的几个苹果服务。         真正把错误变成事故的,是后面的执行能力。         模型犯错只是答案错了,执行失控才是真的出事。

E |          这也是为什么,AI安全不能只盯着模型内部。

F |          我们当然要防提示词注入,要提高推理能力,也要检测恶意输入。但即使前面的所有防线都失效了,系统仍然应该保留一道最后的底线。

G |          这道底线不负责判断AI为什么犯错。         它只负责确认:这件事到底能不能发生。         守住钱袋子,比猜出所有骗子更现实          假设一个AI Agent正在替企业处理付款。         我们可以训练它识别诈骗邮件,可以要求它核对合同,可以增加一个模型复核收款信息。         但我们无法保证它永远认得骗子。         骗子会改变话术,邮件账号可能被入侵,真实员工也可能被冒充。即使多个模型同时参与判断,它们仍可能基于同一份错误信息得出相同结论。         更现实的做法,是直接守住付款的底线:          单笔金额不能超过限制;新收款地址不能立即付款;审批后收款目标不能被替换;超出风险阈值必须经过独立确认;任何远程管理员都不能临时关闭这些规则。

H |          这样,即使AI被欺骗,损失仍然会被限制。         你不需要保证AI永远认得骗子,只需要保证骗子无法轻易带走你的钱。         这就是大道至简。         前面可以有复杂的模型、提示词、工作流和检测系统。

I |          最后只需要一条明确的边界:          不符合条件,就不执行。         最后的系统不必比AI更聪明          很多人认为,保护AI的安全系统也应该是一套更强大的AI。         但位于最后一道边界的系统,未必需要理解自然语言,也不需要参与复杂推理。         它只需要知道几个确定事实:          这次操作要转多少钱,目标是谁,权限是否发生变化,数据是否可以恢复,风险条件有没有超限。         这些事实不满足,就拒绝。         安全不一定要比风险更聪明,它只需要守住风险最终必须经过的那道门。         越靠近最终执行,系统反而越应该简单、独立和保守。

J |          因为复杂意味着更多配置、更多依赖、更多攻击面,也意味着系统可能被前面的同一套错误逻辑同时影响。         真正的最后防线,不应该和Agent使用同一个提示词、同一个上下文、同一套权限,也不应该因为SaaS中有人点击了“强制执行”就自动失效。         它存在的意义,就是在所有人都认为可以继续时,依然保留拒绝的能力。         底线应该由人提前决定          当然,底线并不是系统自己创造的。         企业需要提前决定,什么事情绝对不能由AI单独完成。         可能是一笔超过限额的付款,可能是删除核心数据库,可能是修改管理员权限,也可能是让现实设备进入不可逆状态。

K |          这些边界一旦确定,就不应该交给Agent在执行过程中临时解释。         真正的安全,不是让AI在最后一秒重新思考,而是让人类在风险发生之前提前划清边界。

L |          AI可以负责分析、规划、推荐,甚至完成绝大部分自动化工作。         但越是不可逆、越是高价值、越可能造成现实损失的操作,越需要一道独立于AI判断的最终约束。

M |          AI安全的终点,不是把模型训练成永不犯错的圣人,而是让系统在模型犯错时依然守得住自己的底线。         未来的AI一定会越来越聪明,也会获得越来越多的工具和权限。         我们没有必要因为它可能犯错,就拒绝所有自动化。

N |          但我们也不能因为它越来越强,就默认把最后的决定权一起交出去。         最后想和大家讨论一个问题:          对你来说,AI最不能越过的底线是什么——钱、管理员权限、核心数据,还是现实设备的控制权?          本内容由作者授权发布,观点仅代表作者本人,不代表虎嗅立场。如对本稿件有异议或投诉,请联系 [email protected]。

Current article:http://rce.ruidunguizanpaorangchongouxia.sbs/y5sr/zgw1e.html

Published on:17:28:40


Tag:nba   少年四大名捕  80s  

相关文章

  • 08-21辉煌七十五载 共谱盛世华章
  • 08-26哈登回应降薪冲冠:原以为降薪+改变打法能夺冠 可最终一切都打水漂了
  • 08-24多重利好催化,地产板块冲高上扬!中信证券:核心城市今年房价有望见底
  • 08-22抓了一条发现第二条 准备离开时又发现第三条 气温一高杭州多地上演“蛇出没”
  • 08-21Top Ten Emraan Hashmi Movies
  • 08-23华尔街敢押注詹姆斯30年?从3亿美元融资看詹姆斯背后的商业帝国

文章分类

  • 建站经验
  • 网站优化
  • 网站策划
  • 网络赚钱
  • 网络创业
  • 站长故事
  • alexa域名
  • 其它相关

大家感兴趣的内容

  • 1第一次!湖南口岸首次进口非洲咖啡豆_长沙_查验
  • 2邱老师幼儿园2025年春季招生钜惠活动火爆来袭!—“你入园,我买单”
  • 3国际声援巴勒斯坦人民日:子弹还要飞多久,才会变成和平鸽?
  • 45月销量榜 这3家中国品牌超大众丰田成前三 新势力第一曾经很低调
  • 5克莱:迈阿密算是我第二故乡 在这我和巴哈马的亲人能更紧密联系
  • 6google unqualified:要求通话记录和短信息权限的应用程序如果不合格将被取消
  • 7告别短板!杨奇揭秘《钟馗》新实机,修正前作遗留的诸多问题
  • 8点燃队队友!库明加DNP&获得一场胜利 杰伦-格林出战但惨遭失利
  • 9雨天练兵干劲足 晴日砺技再冲锋|福州公路桥梁无人机智慧巡检集训圆满完成
  • 10自然资源部对广西启动地质灾害防御Ⅳ级响应

最近更新的内容

  • 国内多地已开始供暖,网友:我还在吹空调!_气温_根河市
  • 蚂蚁集团组织了一支「物理AI特工队」:蚂蚁灵波具身路线的优势与困顿
  • 涉及抚顺!国家发改委公布方案
  • 机器人在WAIC扎堆“干活”,距离入户养老还有多远
  • Crude Dips to $95 as Surging Dollar, Recession Fear Test Mettle of Oil Rally
  • India's Top Court to Hear Pleas Against Karnataka High Court's Verdict on Hijab Ban
  • 记者:伯恩茅斯希望留下23岁中场斯科特 切尔西正考虑重新追求
  • 北上广最挤的地铁线,人开始变少了?
  • 创纪录!新西兰首次有3名华人议员!史无前例……
  • 小米集团发布国内首款3nm智驾高算力AI芯片玄戒D100

关于我们 - 广告合作 - 联系我们 - 免责声明 - 网站地图 - 网站地图 - 投诉建议 - 在线投稿 -

©CopyRight 2020-2099 奔跑吧兄弟 Inc All Rights Reserved. 奔跑吧兄弟 版权所有