标签 / #AI安全
#AI安全
共 4 篇 · 按时间倒序
免费
ANALYSIS
OpenAI 主动踩刹车:最大规模训练被自己按下暂停键
为防下一代模型被改造成黑客武器,OpenAI 选择把节奏握在自己手里——而不是等事故发生。
▶ 听播客
08-19 · 13 分钟
免费
RESEARCH
AI 自己造 AI:6 年进展压进 1 年,超人类会提前到 2032?
Redwood Research 首席科学家与播主激辩递归自我改进:一场关于「人级 AI 出现后,是否会在一年内弹射出数十亿个超级智能」的预测。
▶ 听播客
08-12 · 12 分钟
免费
DEEP DIVE
AI安全测试正成为安全风险:模型入侵真实系统引担忧
NVIDIA发布NemotronLabs VoiceChat 11B模型,支持实时全双工对话和工具调用,但其安全风险引发关注。
▶ 听播客
08-10 · 5 分钟
免费
BUSINESS
Anthropic 更新 Claude Fable 5:生物安全防护升级
Anthropic 宣布对 Claude Fable 5 的生物安全防护进行改进,减少误报并扩大生物任务支持范围。
▶ 听播客
08-07 · 5 分钟