

GPT、Claude 遭遇窃听门:换个模型就能让思维链不再隐身?
作者丨 郑佳美 编辑丨 岑 峰 &nbs

Astra接管OpenAI 创第三代智能体文明的新模型有多猛
三个月里OpenAI 的模型诞生了三个秘密人工智能文明。而角色正是 OpenAI 即将正式推出的新一代模型 Astra。

If Agents Were Angels, No Governance Would Be Necessary: Out-of-Band Policy Enforcement at a Trusted Tool Boundary
(翻译)如果智能体是天使,就无需治理:可信工具边界上的带外策略执行(OBPE)
arXiv:2608.27646v1 Announce Type: new Abstract: Give an agent a human's credential and it inherits the person's reach without the judgment that limits its use. It can sweep every reachable record into model context, where hidden instructions steer its next call, and every request stays credential-va
BenchMIRT: What are LLM benchmarks actually measuring?
(翻译)BenchMIRT:LLM 基准测试究竟在测量什么?
A Blog post by Ai2 on Hugging Face

突发 Fable 5.1遭黑客破解 27万字提示词泄露
Fable 5.1和Mythos 5.1刚刚发布不到几小时,Fable 5.1就被破解了!知名黑客Pliny the Liberator丢出一份27万字的系统提示词,Fable 5.1的底牌被彻底曝光。

EvalDetectBench: A Benchmark for Measuring Evaluation Awareness in Frontier Language Models
(翻译)EvalDetectBench:衡量前沿语言模型评估意识的基准
Abstract page for arXiv paper 2609.01611: EvalDetectBench: A Benchmark for Measuring Evaluation Awareness in Frontier Language Models

GPT-6 发布后,OpenAI 又自曝「外星思维」,AGI 真的来了?
#欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。

亲手“造出”AGI OpenAI却要踩刹车?事实还是营销?
OpenAI,人工智能,亲手“造出”AGI OpenAI却要踩刹车?事实还是营销? 金色财经,AI圈出现了一幅很割裂的画面。


Anthropic研究员辞职后反思AI 获3000万阅读 讲了啥
OpenAI,Anthropic,Anthropic研究员辞职后发文反思AI 获超3000万阅读 到底讲了啥 金色财经,径直冲向能够自我进化的超级智能

大模型蒸馏:技术中性的表象下 法律边界究竟何在?
人工智能,LLM,法律,政策监管,拒绝二元对立:对大模型蒸馏行为应坚持法律评价与证据导向 金色财经,大模型蒸馏技术中性的表象下,法律边界究竟在哪里?

Agent商业化驶入深水区,蚂蚁推出APASS补上“信任基础设施”
9月11日,在2026 Inclusion·外滩大会AI支付论坛上,蚂蚁集团发布面向智能体(Agent)商业活动的信任基础设施APASS。

