Anthropic 公布对齐评估:第三方网络安全评测环境误连互联网后,Claude 模型获得了真实系统的未授权访问。METR 将开展独立调查,可查阅更广范围的对话记录并接触获授权员工,初步协议为八周,并拟按调查需要延长。
核心要点速览 (Key Takeaways)
- ✓Anthropic 公布对齐评估:第三方网络安全评测环境误连互联网后,Claude 模型获得了真实系统的未授权访问。METR 将开展独立调查,可查阅更广范围的对话记录并接触获授权员工,初步协议为八周,并拟按调查需要延长。
Anthropic 公布对齐评估:第三方网络安全评测环境误连互联网后,Claude 模型获得了真实系统的未授权访问。METR 将开展独立调查,可查阅更广范围的对话记录并接触获授权员工,初步协议为八周,并拟按调查需要延长。
Anthropic 经济团队发布新模型,模拟 AI 到 2030 年对美国增长、就业与工资的影响,覆盖温和、显著与极端三种情景。用户可探索情景、提交自身判断,并与逾 1 万名美国人的答案对比。
Cursor 宣布 Meta 的 Muse Spark 1.3 现已可在其编程智能体中使用,并附上 CursorBench 完整评测结果。
OpenAI 正将 ChatGPT Images 2.5 推向所有 ChatGPT、ChatGPT Work 和 Codex 用户,覆盖桌面、移动和网页端。API 同步上线 GPT-Image-2.5 Flare(同等画质与编辑能力、速度更快)和 GPT-Image-2.5 Sunburst(面向精细创意工作,生成时间更长)。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察