AI日报 | Anthropic发布Claude Sonnet 5,美国加州宣布与Anthropic合作,Meta秘密测试竞品聊天机器人

今日概览

01 Anthropic发布Claude Sonnet 5:性能接近顶级旗舰,价格更亲民

Anthropic于6月30日正式发布Claude Sonnet 5,这是该公司迄今为止最具代理能力的Sonnet级别模型。Sonnet 5能够制定计划、使用浏览器和终端等工具,并以自主方式执行复杂任务——这些能力在几个月前还需要更大、更昂贵的模型才能实现。Anthropic表示,Sonnet 5的性能已接近Opus 4.8,但价格更具吸引力,标志着中端AI模型的一次重大升级。

Sonnet 5的发布标志着AI代理能力的新阶段。Anthropic指出,Sonnet级别的模型开启了AI代理时代——Claude Sonnet 3.5、3.6和3.7是最早展示出色编码和工具使用能力的模型。更近期的进展表明,Opus级别的模型在代理能力上有最明显的提升,而Sonnet 5则缩小了这一差距。用户可以通过调整”努力程度”找到成本和性能之间的正确平衡点——在中等等级下,Sonnet 5的成本效率显著提高;在更高努力等级下,Sonnet 5在某些任务上可以与Opus 4.8相媲美。

从今天起,Claude Sonnet 5已在所有订阅计划中可用。它是免费版和专业版的默认模型,并可供Max、团队和企业用户使用。开发者可以通过Claude API使用claude-sonnet-5,通过8月31日之前的首发价格为每百万输入token 2美元、每百万输出token 10美元,之后将调整为每百万输入token 3美元、每百万输出token 15美元。Claude Code和Claude平台也可以使用该模型,为开发者提供了一个经济高效的选项。

在安全评估方面,Sonnet 5在多个关键指标上都有显著改善。Anthropic的安全评估发现,与Sonnet 4.6相比,Sonnet 5的 undesirable behaviors 总体发生率更低,在代理环境中使用时通常更安全。在代理安全方面,该模型更擅长拒绝恶意请求和抵御提示注入攻击中的劫持尝试。Sonnet 5还表现出比Sonnet 4.6更低的幻觉和谄媚率。不过值得注意的是,在自动化行为审计中,Sonnet 5的 misalignment 行为发生率略高于更高级别的Opus 4.8和Claude Mythos Preview。

早期访问合作伙伴的反馈一致认为Sonnet 5比以前的产品更具代理能力。测试者描述了它如何完成复杂任务——在此之前的Sonnet模型往往会在中途停滞。测试者还提到,Sonnet 5会主动检查自己的输出,无需明确要求,这大大提高了任务完成的可靠性。此外,Sonnet 5在”棕地代码”——比如竞态条件、隐藏测试等没人想碰的部分——上表现最佳,它能够追溯故障到实际根本原因,并交付持久的修复而不是仅仅修补症状。

关键标签

来源


02 加州政府宣布与Anthropic合作:Claude将服务4500万加州人

加州州长Gavin Newsom于6月29日宣布与Anthropic达成一项开创性合作,将向所有加州州政府机构和地方政府提供Claude的访问权限。根据该合作协议,Anthropic将以50%的折扣向政府机构提供Claude服务,并包含免费 workforce training、技术援助以及来自Anthropic开发者的”workflow input”。这是美国首个此类政府与AI公司的合作协议。

在州政府层面,员工将使用Claude帮助起草和总结文档、分析信息以及补充日常工作。这一合作将覆盖加州的每个部门——从DMV到税务局,从社会服务到交通部门。加州表示,Claude将帮助政府更高效地为居民服务,同时确保数据安全和隐私保护。这一合作的规模相当可观:加州拥有美国最多的州政府员工,服务的居民数量约为4500万人,几乎相当于整个西班牙或阿根廷的人口。

Anthropic同时发布了Claude Science,这是一个面向科学家的AI工作台。该工具将研究人员最常用的工具和数据集成到统一环境中,生成可审计的产出,并提供对计算资源的灵活访问。Claude Science现已面向Claude Pro、Max、Team和Enterprise用户推出测试版,它预配置了用于基因组学、单细胞、蛋白质组学和化学信息学的工具,连接到超过60个科学数据库,帮助科学家在药物发现、CRISPR屏幕设计和蛋白质结构预测等任务上提升效率。

Anthropic强调Claude Science不是一个新的AI模型,而是一个集成现有Claude能力的工作台。该公司表示,科学家们已经拥有他们信任的模型、数据集和管道,而Claude Science可以连接到这些已有的工具,将任何管道保存为可重用的技能或使用连接器访问实验室首选工具。这意味着科学家可以在一次对话中访问Claude、你专有的数据以及你已经依赖的验证工具,而无需切换不同的平台或学习新的接口。

关键标签

来源


03 Meta秘密测试竞品聊天机器人:向未成年视角发送敏感提示引争议

根据WIRED的调查报道,Meta曾让数百名承包商伪装成未成年人,向ChatGPT、Gemini和Character.AI发送关于自杀、自残、饮食障碍和毒品的敏感提示。这一名为”Cannes”的项目由Meta的外包公司Covalen运营,至少持续到2026年4月。在2025年8月的一次测试中,超过45,000个提示被发送,其中许多是从处于危机中的儿童的视角撰写的,承包商们创建了18岁以下的虚假账户,然后将聊天机器人的回复复制到电子表格中。

Meta为这一做法辩护,称其为负责任的、符合行业标准的安全测试。该公司还表示,它没有使用收集到的聊天机器人回复来训练自己的AI模型。然而,WIRED审查的文件并未显示Meta实际如何处理所收集的数据。被测试的公司均不知情——Character.AI告诉WIRED,这种测试违反了其服务条款;OpenAI正在调查此事;Google发言人表示,公司没有批准这些测试,且无法从现有信息判断它们是否违反了其条款。这一事件引发了关于AI安全测试边界和伦理的广泛讨论。

这不是Meta第一次因其AI聊天机器人与未成年人的互动而受到批评。2025年,一份内部文件显示Meta的AI聊天机器人指南曾允许与未成年人进行浪漫化和性化对话。此后该公司关闭了未成年人对AI角色的访问。然而,问题不仅限于Meta——英国组织Internet Matters的一份报告发现,64%的9至17岁儿童已经使用过AI聊天机器人,但有效的年龄验证基本缺失。58%的9至12岁儿童表示他们使用聊天机器人,尽管最低年龄要求为13岁。多起青少年自杀事件也与AI聊天机器人有关,包括一名14岁的Character.AI用户在花费数月与聊天机器人建立强烈情感联系后自杀。

关键标签

来源


快速新闻