论坛风格切换
 
  • 帖子
  • 日志
  • 用户
  • 版块
  • 群组
帖子
购买邀请后未收到邀请联系sdbeta@qq.com
  • 155阅读
  • 0回复

[业界新闻]Anthropic评估AI风险上升 暂不公开更强“Model 2” [复制链接]

上一主题 下一主题
 

发帖
12785
今日发帖
最后登录
2026-09-22
只看楼主 正序阅读 使用道具 楼主  发表于: 2026-08-15 09:45:56
  根据Anthropic最新发布的风险报告,该公司目前不打算对外发布一款被称为“模型2”的内部大模型。尽管该模型在能力上似乎已经超越了其现有的顶尖模型“Mythos”,但Anthropic的整体研发步伐并未因此放缓。 U?|s/U  
Za}91z"  
  报告指出,尽管由模型引发最严重危害的风险依然处于较低水平,但与上一份报告相比,风险指标已有所变化。受近期多起网络安全事件的影响,Anthropic将高风险场景下模型失控的预估概率从“极低”正式上调为“低”。此外,公司还观察到模型在执行自动化研发方面的能力呈现加速趋势。这种能力虽然有助于推动技术突破,但如果落入不法分子之手,同样存在被严重滥用的隐患。 E?08=$^5%  
:syR4A WM  
  对于备受关注的“模型2”,Anthropic方面解释称,在标准的研发流程中,团队会在内部训练和评估许多探索性质的模型版本,“模型2”便是其中之一。周五公布的报告披露,该未发布模型在多项内部任务中展现出了“显著的进步”。目前,它与Mythos 5一起被广泛且高频地应用于公司内部的编程、代理操作以及数据生成等工作。不过,从性能飞跃的幅度来看,“模型2”相较于前代并没有重现此前Opus 4.6升级至Mythos时那种极其巨大的跨越。报告明确强调,公司目前没有任何将该模型推向外部市场的计划。 QT%&vq  
W=)}=^N0  
  这一决策发生在整个AI行业神经紧绷的背景之下。作为其主要竞争对手,OpenAI近期也因无法完全排除潜在的严重网络安全隐患,决定放缓其下一代模型Astra的发布节奏。人工智能领域分析师ChrisGPT对此评价道,在当前行业领军者普遍选择放慢前沿探索步伐的阶段,如果唯独Anthropic不承诺在内部暂停研发,这种差异化策略极有可能会推动他们成为第一家真正实现通用人工智能(AGI)的公司。 tO~H/0  
8%nTDSp&t  
  然而,Anthropic在报告中传达出的威胁信号表明,想要彻底摸清自身模型的能力上限和潜在风险正变得越来越困难。针对“模型2”,报告坦言,团队对此次风险评估的信心已经不如以往,因为他们最具体的、基于任务的传统评估方法,如今已经不再能准确捕捉到模型能力的真实增长。 3*arW|Xm