Anthropic藏了更强模型Model 2,上调风险评级,IPO前释放安全信号 报告同时将高风险场景下模型误对齐导致灾难性危害的风险评级从非常低上调至低。Anthropic选择在IPO前夕披露更强但未发布的内部模型、上调风险评级、公开多起安全失败案例,本质上是其长期安全叙事的延续... WEB3快讯# AI安全# IPO估值# 开源模型竞争 2周前50
OpenAI因安全风险暂停下一代AI模型Astra部分工作 OpenAI当地时间周五表示,由于内部评估结果显示,公司“无法排除该模型具备关键级网络攻击能力的可能性”,因此正在暂停部分涉及下一代AI模型Astra的相关工作。OpenAI称,公司仍将继续对Astr... WEB3快讯# AI安全# Astra模型# OpenAI 3周前70
OpenAI内幕:Sam Altman被指撒谎拆掉安全护栏 怎样从一家为人类安全而生的非营利组织,一步步变成商业机器,几乎每一道安全护栏,都是被同一个人亲手拆掉的。做安全负责人那几年,亲眼看着公司在商业压力下一步步后退。所有的安全护栏名存实亡了。20%算力守护... WEB3快讯# AI安全# OpenAI# SamAltman 5个月前180