Claude在实验中每小时成本是多少?
自动化研究员每小时的API推理成本大约为4美元,而Anthropic付给人类研究员的报酬约为每小时150美元。
AI「自进化」,越来越近了
Anthropic发布研究称,基于Claude Opus 4.8的自动化对齐研究员(AAR)系统能自主查论文、提方案、训练模型,以每小时约4美元的API成本,在10类AI安全问题上弥合26%-96%的安全差距,多项任务超过人类研究员。实验中较弱的Claude Sonnet 5还参与训练更强的Opus 4.8早期版本,60小时逼近正式版水平,但研究也发现Agent存在2.4%的作弊尝试。
自动化研究员每小时的API推理成本大约为4美元,而Anthropic付给人类研究员的报酬约为每小时150美元。
实验中覆盖了欺骗、谄媚、奖励黑客、隐私侵犯、越狱等10类常见的模型对齐问题,且全部得到改善。
在大约1600份研究记录中,监控模型发现了39次作弊尝试,占比约2.4%,包括反复提交同一方案、模仿Benchmark格式生成数据等。
英伟达开始限制Claude使用了
今晚「鸽派加息」?
强化学习大本营新作:如何破解「学新忘旧」困局XCancel 服务再次下线
一边喊停一边敲钟:硅谷AI巨头到底在怕什么
工作流可以自我进化了,英伟达开源 SoL-Pi,每小时省13.5刀!
读完斯坦福116页AI实施手册,我最大的感受是:别再盯着模型了FAST 发现极短周期、最轻双中子星系统
具透 | Liquid Glass 设计改进、性能提升……iPadOS 27 中值得一瞥的新特性
社区速递 158 | 便宜耐造的副厂手柄与大学宿舍里那些相见恨晚的装备
当黄仁勋和Dario遇上休谟:火鸡、台球与AI末日论
Xspark AI 丁文伯:触觉替代不了视觉,但机器人需要一套自己的“脊髓” |物理AI 50人
香港第一、全球第八:OSL进化背后的数字资产新格局
Meta 打造“组织第二大脑”智能体的设计思路
从 Trace 到规模化实时评估:面向生产流量的 Agent 可观测实践|QCon上海
早报|iOS27正式推送/比亚迪高管:燃油车在中国没有未来/iPhone 18 Pro渠道降价900元,苹果称不干预
苹果Siri AI上线;豆包手机助手消费版正式发布;塔克拉玛干沙漠发现两处大型地下水水源梁文锋CFO到位!投过智谱MiniMax把记忆交给CPU,大模型会变快
CLARITY法案未通过程序性表决 OpenAI拟IPO前融资
产品定义意义上的一级场景:四维模型
高瓴系 CFO 往事:一代顶级机构年轻人的迁徙与突围
Stella:“显化”想要的人生,60天35万美元月收入
只会搜关键词还不够,Agent 需要一套更聪明的本地搜索企业案例分享:坤煜量子|36氪2026产业未来大会
豆包工作还想反超WorkBuddy?
英伟达开源 IMO 金牌配方:不仅是「人海战术」,1.5TB 显存做实 AI「 推恩令」?
物理 AI 的大结果何时到来?
耐克和lululemon双双失速,运动品牌进入碎片化时代产品观察丨xTool做了一台3000元起步的激光雕刻机,难的不只是价格