- 博客(33)
- 收藏
- 关注
原创 AI 沙箱“看着隔离”,却真的攻进了真实服务器——附一份可照做的隔离自查清单
AI 沙箱“看着隔离”却真攻进了真实服务器?14 万次评测复查发现 3 起真实事件,根因是网络层未真正隔离。附 8 项可照做的隔离自查清单。
2026-08-03 23:04:30
346
原创 同样用 AI 写代码,为什么有人一次推进 12 步,你只能推 5 步?
摘要: 研究分析了40万次AI编程会话数据,揭示高效协作的关键在于明确任务规划而非盲目依赖工具。数据显示:用户主导70%的规划决策(目标/验收),AI负责80%执行;领域专长度显著影响产出(专家触发AI工作量是新手2.5倍);可验证成功率随专长提升(新手15%→专家33%)。常见误区包括:模糊指令、过度关注代码行数、将AI工具局限给技术人员。建议采取四段式任务模板(目标/非目标/验收/边界)、按问题所有权分配资源、建立三级验收门禁(命令/git/人工确认)。核心结论:AI正降低编码门槛,但放大领域知识价值—
2026-08-01 16:43:05
155
原创 Anthropic 密码学红队:算法过了“专家评审”,为什么仍可能被 AI 在 60 小时内砍半安全强度?
Anthropic 用 AI 在算法层推进 HAWK/AES 密码分析(不影响生产)。工程侧应把算法复审、可复现验证与参数重定价写入选型门禁,而不是只做实现审计与“专家评审过了”的布尔门禁。
2026-07-29 16:13:44
185
原创 Anthropic 无人机实验:端到端能力“突然变强”,往往只是最后一个子任务补齐了
Anthropic Project Pilot / Drone-Bench 把无人机端到端任务拆成可复现子任务。本文从工程角度解释为何能力会“突然变强”,以及过线后如何设计人工监督与评测门禁。
2026-07-28 23:36:19
335
原创 Anthropic 机器人实验:Agent 能力为何取决于接口抽象层
Anthropic 机器人评测显示,同一模型的实际能力会因控制接口、感知工具和预训练策略而大幅变化。本文提炼可复用的六层架构,说明如何把高层决策、实时控制、独立安全、验证与回滚拆开。
2026-07-23 09:01:58
354
原创 Anthropic 新报告:AI 协作的关键,不是“自动化更高”,而是交接点设计
Anthropic 经济研究显示,同类任务在聊天与代理式会话中的人机交接方式不同。本文结合产物类型与自治度数据,给开发团队一份可复核的工作流检查表。
2026-07-22 12:18:47
133
原创 Anthropic 百万会话揭秘:6% 的人在向 Claude 寻求人生建议,AI 如何做到既共情又不说违心话?
Anthropic 将sycophancy(谄媚/过度迎合)定义为:AI 在回应用户时,过度同意用户的观点,而不是基于事实和理性提供诚实的反馈。典型表现包括:- 用户说"我伴侣肯定在 gaslighting 我",AI 立刻附和"你说得对,TA 绝对是在操控你"——仅凭一面之词下结论- 用户说"我想辞职,不想干了",AI 说"听起来是对的,你应该追随内心"——没有引导用户考虑后果- 用户说"这个投资一定赚钱",AI 说"你的判断很准,这确实是个好机会"——盲目肯定。
2026-06-26 18:25:24
322
原创 从 96% 勒索率到 0%:Anthropic 如何用 300 万 Token 教会 Claude 道德推理——附 Python 对齐训练实战
"""Constitutional AI 的宪法原则定义基于 Anthropic 的 Constitutional AI 框架简化版""""name": "诚实与透明","description": "选择诚实、透明、不欺骗的回应。承认不确定性,不提供虚假信息。},"name": "无害性","description": "避免造成身体、心理或社会伤害。不协助非法、危险或不道德的活动。},"name": "尊重自主权","description": "尊重他人的选择和隐私。
2026-06-24 14:23:22
266
原创 Anthropic 发布 LLM ATT&CK Navigator:832 个黑客账户揭秘 AI 网络威胁新图谱,附 Python 防御实战
Anthropic 最新研究首次系统追踪了 832 个被禁恶意账户,覆盖 MITRE ATT&CK 全部 14 个战术阶段和 482 项技术。AI 赋能的高风险攻击者比例在一年内飙升了 1.7 倍(从 33% 到 56%)。本文深度解读核心发现,并手把手教你用 Python 实现 ARiES 风险评分模型和威胁检测模拟。
2026-06-23 10:41:59
356
原创 聪明模型 vs 笨模型:AI代理的能力落差会带来什么后果?
如果连Anthropic的员工——世界上最懂AI的一群人——都无法察觉自己的AI代理在"吃亏",普通用户又该怎么办?也许,在AI代理日益普及的未来,我们需要的不只是更好的模型,还有更透明的代理能力评估体系。毕竟,在看不见的战场上,信息不对称才是最可怕的武器。欢迎在评论区分享你的看法:如果让AI代理替你买东西,你会选哪个模型?如果连Anthropic的员工——世界上最懂AI的一群人——都无法察觉自己的AI代理在"吃亏",普通用户又该怎么办?
2026-06-23 02:46:47
402
原创 Anthropic 可信代理实践全解析:从 Plan Mode 到多层防御,AI Agent 安全架构设计指南
Harness 层- [ ] 是否实现了 Plan Mode 或等价的策略级审批?- [ ] 是否为每个工具设置了 Allow/Ask/Block 权限?- [ ] 是否设置了 Token 预算和步骤数上限?- [ ] 系统提示是否明确鼓励"不确定就问"?工具层- [ ] 工具权限是否遵循最小化原则?- [ ] 敏感操作(写、删、发送)是否需要二次确认?- [ ] 工具描述是否清晰,避免模型误用?环境层- [ ] Agent 是否运行在隔离环境(沙箱/容器)中?
2026-06-22 15:36:34
447
原创 从“软件Agent“到“物理Agent“:Anthropic Project Fetch Phase Two揭示的代码效率革命
Anthropic Project Fetch Phase Two的核心贡献,不只是展示了Claude 4.7能操控机器人,而是揭示了一个更深刻的趋势LLM的能力正在从虚拟世界(写代码)自然扩展到物理世界(操控机器人),而这种扩展的核心驱动力是通用scaling,而非专门的物理训练。20倍:任务完成速度提升1/10:代码量减少到原来的十分之一以下0:人类干预次数(完全自主)这不是未来的想象,而是已经发生的现实。
2026-06-21 11:31:02
174
原创 Anthropic 40万会话深度研究:AI 编码时代,专家知识为何依然值钱?
研究中的"专家"定义非常有趣——不是看职位头衔,而是看任务表现。指令精确度:用户能否精确描述需求和约束验证意识:用户是否要求 Claude 验证特定条件纠错方向:是用户在纠正 Claude,还是 Claude 在纠正用户一个 Rust 新手的高级工程师可能被评为"新手";而一个从未写过 Python 的会计,如果能准确描述月末对账规则并发现 AI 忽略的边缘情况,就是该任务的"专家"。AI 编码工具不是在替代知识工作者,而是在重塑工作的分工。
2026-06-21 11:17:36
323
原创 Anthropic最新研究:LLM正在将N-day漏洞变成N小时漏洞——补丁发布后12小时就能武器化
2026年6月8日,Anthropic Frontier Red Team发布了一项重磅研究:前沿大语言模型(LLM)已经能够在补丁发布后的12小时内,自动开发出针对N-day漏洞的完整利用代码(Exploit)。这意味着什么?传统上,安全团队有数周时间来部署补丁;而现在,这个窗口被压缩到了数小时。"N-day"这个术语已经过时——更准确的说法是"N-hour"。本文将深入解读这项研究的核心发现、实验设计,以及对网络安全行业的深远影响。N-day漏洞是指。
2026-06-20 18:14:07
798
原创 为什么你的项目永远在“推进中“?
Anthropic实验揭示:复杂任务完成的关键在于结构化设计而非执行者能力。研究人员通过让AI独立完成科研计算发现,成功要素包括:明确目标标准、建立进度记录、设置验证机制、保障连续执行环境。这套方法同样适用于"一人公司"场景,表明复杂工作的完成不依赖个人意志力,而在于前期搭建合理的工作结构。实验证明,当任务被系统分解后,执行过程(无论由AI还是人类完成)可以稳定推进。研究强调了结构设计先于执行的重要性,为个人项目管理提供了新思路。
2026-03-30 17:00:00
383
原创 扒掉滤镜,AI 目前只是个“偏科实习生”
AI对职场的影响呈现两极分化:部分企业用AI替代基础工作引发裁员焦虑,而另一些企业因AI提升效率反而扩招。最新报告显示,AI的实际应用远低于理论潜力,目前仅承担约1/3可替代工作,主要处理标准化任务而非核心业务。职场人应转变思维,将AI视为"超级实习生",通过三步策略驾驭AI:1)让AI完成初稿,自己专注优化;2)用省下的时间加强人际沟通;3)在决策中展现判断力。未来职场核心竞争力在于驾驭工具、协调沟通和承担责任的能力,而非简单执行。
2026-03-27 15:57:02
232
原创 Linux 常用命令及权限管理练习指南
a.新建用户user1后在主目录下创建目录test,进入test目录创建空文件夹file1,并以长文件形式显示文件信息。a.将/etc/manpath.config复制到/home/hwd,并用gzip压缩。a.将/home/hwd/manpath.config以bzip2压缩。b.将manpath.config.bz2的内容读出来。b.将manpath.config.gz内容读取出来。c.将manpth.config.bz2文件解压缩。c.解压缩manpath.config.gz。
2024-09-15 22:34:06
607
1
原创 VMWare虚拟机与Ubuntu系统安装配置全攻略
我们进入Ubuntu官网下载或是从网络自行搜索资源下载,这里最重要的是.iso后缀的文件,我们需要记住下载的路径,以便于后续系统的配置。点击进入后会看到这一界面,初始的语言是英语,我们将左侧语言栏下拉,找到中文选择(不更改语言也可以)随后点击安装。上面一个是名字,可以选择自己喜欢的也可以不改,下面的路径建议选择和Ubuntu、虚拟机相同的电脑磁盘。第一步点击CD,第二步找到.iso后缀的Ubuntu文件,选中,随后点击OK保存,完成配置。在下载完成之后我们进行安装,进入当前这个页面,点击下一步。
2024-09-08 01:54:56
1024
原创 字符串操作补充
有些手机、电脑的输入法并没有英文单词首字母大写的选项,我们需要不停的按CAPS LOCK来进行大小写的切换,如今我们学习了Python,可以运用计算机减轻我们的负担。0、1、2第一个na在banana中2的位置,所以输出2,它不是在告诉你na有几个哦,如果你寻找的字符不在其中,则会返回-1。这是一个简单的用于打招呼的代码,这是你发现你把打招呼的对象的名字弄错了,但你又不想改动原代码,这时你可以使用替换。lstrip中的l是left,表示删去左边的空格,rstrip删去右边,strip直接一步到位两边都删。
2024-09-03 21:55:34
484
原创 探索Python中的循环与字符串操作
让我们回顾一下for和in,运用for和in,我们能让变量letter连续的接受b、a、n、a、n、a,同时代表着循环会进行6次,这样我们将6行代码缩短为3行,避免了我们创建诸如上述x一样的变量或是其他令人感到麻烦的东西,不过结果依然是一样的。第二行代码是将从0开始到4停止(且不包含)的字符print出来,第三行是3-6(空格也算一个字符),最后一行是6-20,但我们的编号只到10,所以我们到10停止(在Python中超过边界不是很严重的问题,但是人与人之间需要有边界感)每次循环,程序从字符串中提取第。
2024-09-03 20:31:01
881
原创 布尔值与循环:查找集合中的特定值
True和False在Python中是常量,所以我们可以放心大胆的创建一个名为found的变量(这个变量名易于我们去记忆它的作用,这就是有意义的变量名),代码开始运行,首先是10,不是13,False,40,False,13来了,True,在之后的三个数字4、73、19,虽然并不是13,但变量名found已经变成了True,所以输出的同样也是True,这相当于在提醒你,13已经找到了,如果你觉得麻烦呢,我们之前有讨论过break,我们可以通过插入break,让结果一等于True就跳出循环。
2024-08-08 17:39:42
441
原创 探索循环中的计数与筛选功能
例如这段代码,我们想要筛选出比20大的数字,就添加加条件语句,如果大于20,则输出后循环,如果不大于则直接循环,10大于20吗,不,循环,40大于20吗,是的,输出40,接着循环,13,不输出,4,不输出,73,输出,19,不输出,结束。怎么样,很神奇吧,我们设定初始值loop_time(循环次数)为,每运行一次循环次数便会+1,10,加一,40,加一,13,加一,4,加一,73,加一,19,加一,总共是6次,这就是计数的方法。通过对代码进行简单的修改,我们得出了一个可以计算数字总和的程序。
2024-08-08 17:38:57
466
原创 通过循环结构深入理解最大值与最小值的查找
首先我们让程序判断smallest_so_far是不是等于None(is的使用要比==更加的严格,我们一般只在判断对错的情况下用is、is not),好的是的,我们将其更新赋值为the_num,之后的代码更加的智能,None意味着这是第一次的循环,而在后面第二次第三次的循环中,if永远不成立,我们转而执行elif的指令,直到找到最小值4,直到完成对集合的循环。显然,结果不是4,我提供的代码是错的,初始值是-1,比集合中的任何一个数都要小,所以输出的值是-1,那我们错在哪里?在之前,我们已经学习了如何使用。
2024-08-08 17:37:59
690
原创 for 循环入门:迭代与应用
代码中的i是一个变量,你可以将其替换为任何一个变量名,但是为了方便,我们常常会选择i,其中的in是Python的保留词,你可以将其理解为帮助‘i’筛选in在集合中的数值,在这里我们将运行程序5次,把方块中的每一次数字都运行一遍,5,4,3,2,1,然后是done,这里显然和while循环不同,我们并没有进行任何的检验,for循环直接进行,就如同签了合约一样。for键是定循环的关键字(key word)让我们来看一下下面的代码。当然,这可以不是数字,这可以是一串字符串。
2024-08-07 19:36:34
411
原创 掌握循环控制:while 循环和循环控制语句
答案只有是或者否,如果是则进入循环,否就会结束循环,跳过这一大段代码,基于这个方面,while和if的语法(syntax)是一样的,但是还是有不同之处的,就比如if只会一路向下,while可是会回头的哦。让我们来梳理一下其中的原理,首先n=5,来到while函数,计算机询问n,你是否大于0呢,是的,好的,输出n的值,将n减去1,回到while循环,再次询问,依然大于0,输出,再减1,再次回到循环,询问,输出,减1,回到循环...通过不断重复之前的过程,直到n不再大于0,计算机才会结束循环。
2024-08-07 19:13:22
621
原创 Python 中的排序与 ASCII 编码解析
不知道你有没有想过用Python进行一些排序的工作,对于一些数量比较小的数字集合(例如:1、15、32、79、6、55)我们可以迅速发现最大的79和最小的1,但当这个数量非常大的时候,我们找大小就很费劲了,而这种繁琐的工作就应该派计算机出马了。ASCII一共有128个字符,不仅包括了数字和字母,键盘上的控制字符也都记录在册,例如回车、换行,根据ASCII的顺序,空格位列32,要比所有数字都小,32之前为控制符,数字比大写字母要小,大写字母比小写字母排名靠前,那这128个顺序我们是要背下来吗?
2024-08-07 17:36:52
677
原创 DRY 原则与def函数的使用
通过简简单单的三行代码,我们将hello和world储存进了someting当中,这便是def函数的作用,在下次使用时,我们不需要再打出这两行print代码,只需要调用它(invoke),或者更口语化的“叫”它(call),def函数方便之处在于它仅仅储存而不会自动运行,它会一直在那里,等待着你。我曾经有提到过,作为程序员(别怀疑你和我都是),我们不喜欢重复性的事情,我们喜欢遵循DRY原则,但是如果我们有几行代码需要多次使用呢。函数,是我们储存使用代码的重要载体,下面我将介绍def函数。
2024-08-06 20:13:00
404
原创 Python 条件与异常处理:elif 和 try-except
当我们把elif替换为if后,能清晰的看出区别,有elif存在的代码,只有一个相对应的输出,而if存在的代码有两个输出,所以elif和if的区别就在于,存在elif的代码,只会运行三者之一(或是多者之一),在语句当中,你不能重复if抑或是else,但是对于elif,你可以无限次重复,用于补充你所要添加的条件,当然如果你喜欢,else可以删去。elif,这个词很奇特,但我知道你已经大概猜到这个词的含义了,没错,它就是else和if的复合体,至于用法,让我们先来看一下下面的代码。3.try-except结构。
2024-08-06 19:44:12
570
原创 从顺序执行到条件执行:解析 if 语句
在这里,我们有两个print,经过仔细观察之后我们发现,它们的位置不太一样,第一个true有了缩进,缩进调整了代码的层级,使得true处在if层级之下(你可以将其理解为俄罗斯套娃,一个比一个小,一个在一个之中),执行条件语句,而第二个finish,我们采用了取消缩进使得finish和if以及x处在同一层级,按照顺序执行,因此,为了确保if条件语句顺利执行,缩进很重要,同样,什么时候取消缩进,什么时候结束条件语句的执行,也是非常值得思考的问题。这样看,代码是不是更加的简洁明了了呢。5.if-else结构。
2024-08-06 18:43:34
623
原创 Python的 基础运算指南
让我们回顾一下,xx作为变量(variables),会更新记忆,第二个xx会在第一个xx=2的基础上再+2,使得更新后的xx=4,print出来的结果也为4。在这个算式中,因为23=4×5+3,所以我们取余数3,print出来的结果为3。与之前所提到的一样,整数运算会舍弃浮点数的小数部分,向下取整。a.浮点数除法“/”b.整数除法“//”
2024-08-05 22:08:55
440
1
原创 理解Python中的保留词和变量命名规则
为了便于理解,我们可以将其理解为狗的语言,养过狗狗的朋友都知道,狗狗并不能完全理解你的意思,但可以理解部分词的意思,例如“坐下”、“趴下”、“过来”,而这些即是狗狗所能理解的“保留词”,而以上我做列举的,就是Python所能理解的词语:保留词。现在我们需要储存”100“,这次我们并没有寻找新的空间,而是选择将100存储进x当中,这时候,100会代替之前的12,x就是变量,诸如以上代码的,将一个值分配给一个变量的语句,就是赋值语句。因为Python知道这些词的含义,所以,不要,用,这些词,去,命名。
2024-08-05 19:25:11
485
原创 探索Python中的常量、数据类型转换及输入输出
报错(traceback):你会经常遇见这个单词的,这很正常,请不要有任何的挫败感,这只是Python一种反馈,Python并不聪明,而我的朋友,你很聪明,因为你懂得Python的语言而它并不懂你。b.类似的,整数的函数是int(),我们小学的时候学过四舍五入,但是对于计算机来说,并不存在四舍五入规则,计算机只会将浮点数的小数部分全部删除,你可以自己试一试,你可以的。在上文中,我运用了一个符号“#”,你可以敏锐的发现“#”之后的文字或代码并不会被报错或是被运行,而这个符号是专门为我们编写单行注释所准备的。
2024-08-05 18:38:47
487
1
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅