

Celebrating 25 years of visual search innovation
(翻译)庆祝视觉搜索创新25周年
Google Images is turning 25. Here’s a look back at some major milestones — and new ways to explore and create visual content.

A survey detection channel overrides the pixels in an astronomical foundation model, and biases tomographic mean redshifts
(翻译)巡天检测通道覆盖天文学基础模型中的像素,并使层析平均红移产生偏置
arXiv:2608.23626v1 Announce Type: new Abstract: Foundation models for astronomy are trained on survey pixels together with the catalogue products derived from those pixels. Those catalogues are incomplete at a measurable rate, and a model trained on both inherits that incompleteness as a systematic.
对话纬钛机器人CEO李瑞:具身智能仅靠视觉容易到天花板,触觉是未来必选项
作者丨 向 欣 编辑丨 高景辉 &nbs

李飞飞、吴佳俊再联手,打破世界模型和机器人动作的「巴别塔」
作者丨 幸丽娟 编辑丨岑 峰  

SCAFFOLD: A Large-Scale Structured Dataset of Computer Science Research Figures with Diagram QA and Chain-of-Thought Reasoning Traces
(翻译)SCAFFOLD:面向计算机科学研究图表的大规模结构化数据集,包含图表问答与思维链推理轨迹
Abstract page for arXiv paper 2609.00018: SCAFFOLD: A Large-Scale Structured Dataset of Computer Science Research Figures with Diagram QA and Chain-of-Thought Reasoning Traces
李飞飞的 World Labs,把赛博朋克的「超梦」做出来了
#欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。

AI 群星闪耀之前,商汤先相信那群少年
2018年,王延森还是一名本科生,做生成对话方向。 那时候CV正热,Transformer浪潮初起。告诉别人自己在做“能聊天的机器人”,对方听完往往礼貌地点点头,表情里写着“挺前沿的,但然后呢?”

从“单次出图”到“精确交付”:GPT-Image-2.5深度解析与实战手册
GPT-Image-2.5 不再卷画面惊艳感,转而解决交付链路的稳定性与效率。Flare 与 Sunburst 双模型拆分速度与画质,多轮编辑抗衰减、多参考图精准解耦、真透明通道等工程改进,正让 AI 生图从概念演示走向可稳定嵌入商业流程的生产力工具。

全球首个3D原生城市世界模型ABot-Earth 0.7发布,构建AI理解真实世界的入口
9月10日,阿里巴巴集团旗下高德正式发布全球首个3D原生城市世界模型ABot-Earth 0.7。
Open AI官网首发提示词教程,教你玩转GPT Image 2.5
GPT Image 2.5 上线,生图能力再突破。本文结合官方指南与实测,拆解手绘角色、带字海报、照片换装、线稿转写实、界面生成五大玩法,手把手教你写提示词、调结果,让设计师和产品经理都能快速上手。

GPT Image 2.5 对比实测:变化与局限
GPT Image 2.5 在复杂中文图文任务中表现如何?本文通过十一类任务、72张输出,对比两代模型在海报、安装说明、经营简报等场景下的能力。结果显示,2.5 在商品信息对应和数字复现上有所提升,但在工具接触点、零件数量和图表比例上仍会出现错误,书法风格差异明显。

