郑板桥
龙行龘龘·巳巳如意|2025年上海尚德实验学校教工迎新盛典_我的网站

一 | 恭 贺 新 年 2025年1月13日,上海尚德实验学校沉浸在一片喜庆的节日氛围中,随着尚德大会堂的大门缓缓开启,“龙行龘龘·巳巳如意”2025年教工迎新盛典正式拉开帷幕! 新年贺词 温情传递 蛇年大吉 新 年 快 乐 蛇来运转 尚德教育投资发展有限公司董事长、上海尚德实验学校校长姜晓勇发表了饱含深情的新年贺词。 该图片使用了AI生成技术 本文来自微信公众号: HavenlonLabs ,作者:Havenlon Labs 现在谈AI安全,很多人的第一反应都是:怎样让模型少犯错? 减少幻觉、优化提示词、防止提示词注入、增加上下文、接入更强的模型,再用另一个Agent检查前一个Agent。

二 | 这些工作当然有价值。他深情回顾了过去一年的辉煌成就,展望了尚德未来的宏伟蓝图,并激励全体教职工携手并进,为尚德的明天添砖加瓦。 但它们容易让人产生一种错觉:只要模型足够聪明、提示词足够完善、检测系统足够复杂,AI就可以安全地完成一切。随后,姜校长与各部校长、园长一同走上前台,亲手为每位教职工送上红包,传递着领导们的深切关怀与美好祝愿。 问题是,AI真的可能永远正确吗? 答案恐怕是否定的。 才艺盛宴 璀璨绽放 活动中,各部门的教职工们纷纷登台,各展风采。 我们无法消灭所有错误 AI Agent面对的不是一道标准答案明确的考试题,而是不断变化的现实环境。 它读取的邮件可能是伪造的,访问的网页可能包含恶意指令,接收到的数据可能已经被污染,用户给出的任务也可能存在歧义。 诗 意 盎 然 学校党委与工会选送的诗朗诵《祖国啊》,以其深情的演绎和激昂的语调,赢得了在场师生的热烈掌声。 即使模型本身没有受到攻击,它也可能误解目标、遗漏条件,或者基于不完整的信息作出一个看起来合理的决定。 该节目在2024年浦东新区教工诵读大赛中荣获民办学校组“最美表演奖”,展现了尚德人的文化底蕴与爱国情怀。 我们可以持续提高模型的准确率,却很难证明它在下一次任务中一定不会犯错。 试图让AI永远正确,是在追求一个无法验证的目标;阻止危险结果发生,才是一条可以真正落地的边界。

三 | 动 感 开 场 初中部师生带来的开场舞《五“鼓”丰登》,以欢快的节奏和动感的舞姿,瞬间点燃了现场的热情,预祝尚德在新的一年里五谷丰登、硕果累累。 国 际 风 情 美日高中部的老师们以一首悠扬动听的英文歌曲《Just The Way You Are》,为活动增添了一抹国际化的色彩,展现了尚德人的开放与包容。

四 | 太 极 风 采 工会的《太极“舞”》表演,将中华武术的韵味与风采展现得淋漓尽致,让观众们领略到了太极文化的博大精深。 敦 煌 遗 韵 航小的《吉祥天鼓》节目,融合了敦煌文化的神秘与现代打击乐的激情,展现了中华民族深厚的文化底蕴和艺术魅力。 真正的问题不是AI会不会犯错。 它一定会。

五 | 回 忆 共 鸣 高中部的歌曲《有没有一首歌会让你想起我》,用旋律锁住时光,唤起了大家共同的回忆,让人沉醉其中。

六 | 真正的问题是:当它犯错以后,系统是否会毫无阻碍地把这个错误执行出去。 融 合 创 新 融合部的教师版《APT》,以才华与热情点亮了在尚德的每一个瞬间,将现场气氛推向了高潮。 模型错误不一定等于现实损失 一个AI在聊天窗口里回答错误,造成的可能只是一次糟糕的体验。

七 | 但当同一个AI拿到支付接口、管理员权限、数据库写入权限和服务器控制权以后,错误的性质就完全不同了。 它可能把钱转给错误的地址,删除重要数据,修改生产环境,扩大成员权限,或者关闭本应保留的审计记录。

八 | 欢 乐 无 限 幼儿园带来的《新年就是要HAPPY》,以欢快的节奏和活泼的表演,为活动增添了无尽的欢乐与喜庆。 模型只是产生了一个错误判断。 幸 福 绕 梁 小学部的歌舞《新年幸福绕》,以欢快的旋律和甜美的歌声,传递着新年的祝福与幸福。 真正把错误变成事故的,是后面的执行能力。 灵蛇献瑞 惊喜不断 抽奖环节作为活动的重头戏,让每一位教职工都充满了期待。今年的抽奖依然分为奖品类和现金类,抽奖方式新颖有趣,通过“灵蛇贺岁拍拍拍”、“银蛇献瑞拍拍拍”、“金蛇纳福拍拍拍”和“祥蛇送喜拍拍拍”等环节,让现场气氛高潮迭起。 模型犯错只是答案错了,执行失控才是真的出事。 灵蛇贺岁 银蛇献瑞 金蛇纳福 祥蛇送喜 最终,激动人心的现金大奖抽奖环节揭晓了获奖部门,通过“一蛇转乾坤 巳巳如意”的方式,6个部门的负责人共同揭开了现金大奖的神秘面纱,为活动画上了圆满的句号。 这也是为什么,AI安全不能只盯着模型内部。 我们当然要防提示词注入,要提高推理能力,也要检测恶意输入。 展望未来 共创辉煌 自强不息 新 年 快 乐 接续奋斗 此次迎新盛典不仅展示了尚德教职工们的多才多艺和团结协作精神,更为新的一年注入了新的活力和动力。

九 | 尚德人将继续秉持“自强不息、接续奋斗”的精神,向着更高的目标迈进!在此,我们衷心祝愿上海尚德实验学校在新的一年里蒸蒸日上、再创辉煌!祝愿全体教职工身体健康、工作顺利、家庭幸福!。但即使前面的所有防线都失效了,系统仍然应该保留一道最后的底线。 这道底线不负责判断AI为什么犯错。 它只负责确认:这件事到底能不能发生。 守住钱袋子,比猜出所有骗子更现实 假设一个AI Agent正在替企业处理付款。 我们可以训练它识别诈骗邮件,可以要求它核对合同,可以增加一个模型复核收款信息。 但我们无法保证它永远认得骗子。 骗子会改变话术,邮件账号可能被入侵,真实员工也可能被冒充。即使多个模型同时参与判断,它们仍可能基于同一份错误信息得出相同结论。 更现实的做法,是直接守住付款的底线: 单笔金额不能超过限制;新收款地址不能立即付款;审批后收款目标不能被替换;超出风险阈值必须经过独立确认;任何远程管理员都不能临时关闭这些规则。 这样,即使AI被欺骗,损失仍然会被限制。 你不需要保证AI永远认得骗子,只需要保证骗子无法轻易带走你的钱。 这就是大道至简。 前面可以有复杂的模型、提示词、工作流和检测系统。 最后只需要一条明确的边界: 不符合条件,就不执行。 最后的系统不必比AI更聪明 很多人认为,保护AI的安全系统也应该是一套更强大的AI。 但位于最后一道边界的系统,未必需要理解自然语言,也不需要参与复杂推理。 它只需要知道几个确定事实: 这次操作要转多少钱,目标是谁,权限是否发生变化,数据是否可以恢复,风险条件有没有超限。 这些事实不满足,就拒绝。 安全不一定要比风险更聪明,它只需要守住风险最终必须经过的那道门。 越靠近最终执行,系统反而越应该简单、独立和保守。 因为复杂意味着更多配置、更多依赖、更多攻击面,也意味着系统可能被前面的同一套错误逻辑同时影响。 真正的最后防线,不应该和Agent使用同一个提示词、同一个上下文、同一套权限,也不应该因为SaaS中有人点击了“强制执行”就自动失效。

十 | 它存在的意义,就是在所有人都认为可以继续时,依然保留拒绝的能力。 底线应该由人提前决定 当然,底线并不是系统自己创造的。

十一 | 企业需要提前决定,什么事情绝对不能由AI单独完成。 可能是一笔超过限额的付款,可能是删除核心数据库,可能是修改管理员权限,也可能是让现实设备进入不可逆状态。 这些边界一旦确定,就不应该交给Agent在执行过程中临时解释。 真正的安全,不是让AI在最后一秒重新思考,而是让人类在风险发生之前提前划清边界。 AI可以负责分析、规划、推荐,甚至完成绝大部分自动化工作。 但越是不可逆、越是高价值、越可能造成现实损失的操作,越需要一道独立于AI判断的最终约束。 AI安全的终点,不是把模型训练成永不犯错的圣人,而是让系统在模型犯错时依然守得住自己的底线。 未来的AI一定会越来越聪明,也会获得越来越多的工具和权限。 我们没有必要因为它可能犯错,就拒绝所有自动化。 但我们也不能因为它越来越强,就默认把最后的决定权一起交出去。 最后想和大家讨论一个问题: 对你来说,AI最不能越过的底线是什么——钱、管理员权限、核心数据,还是现实设备的控制权? 本内容由作者授权发布,观点仅代表作者本人,不代表虎嗅立场。如对本稿件有异议或投诉,请联系 [email protected]。
Current article:http://yp011w7.zhuaicaisaanzhenshunnaiwei.bond/news/20260826_21281.html
Published on:11:04:15
