今日焦点
1. 【重点】OpenAI:AI智能体如今每人工作日相当于3.1个研究员工作日,称已达“自动化研究实习生”水平,预计2028年3月实现“自动化AI研究员”
OpenAI: AI agents now perform 3.1 researcher-workdays for every human researcher-workday, says it has reached “automated research intern” level, and expects “automated AI researcher” by March 2028
OpenAI表示,截至8月中旬,其研究组织每投入1个人类工作日,就使用3.1个智能体工作日。公司已达到“自动化研究实习生”的目标,并正稳步推进在2028年3月前创建自动化AI研究员。智能体系统近期推动了其向递归自我改进的进展。
2. 【重点】GPT-6 Astra击败Portal,成为首个实现这一成就的模型
GPT-6 Astra Has Beaten Portal, Becoming the First Model to Achieve This.
GPT-6 Astra在基准测试或竞赛中击败Portal,成为首个达到这项里程碑的模型。目前具体成就细节尚未公布,但这一结果标志着人工智能领域的又一突破。
3. GPT-6 Astra 用时15小时通关游戏《环世界》
GPT-6 Astra finished the game RimWorld in 15 hours.
据Reddit用户分享,GPT-6 Astra在15小时内完成了游戏《环世界》的通关,并提供了直播链接。该AI展现了强大的游戏策略和学习能力,引发社区讨论。
AI 动态
1. 作者反击:出版商与代理争夺Anthropic和解金
Authors push back as publishers and agents make claims on Anthropic settlement
作者们表示,出版商似乎试图在Anthropic版权诉讼的和解中分走超出其应得的份额。他们批评出版商和代理商对和解金提出过多要求,认为这些要求侵害了作者自身的权益。
2. AI关闭——保持人性
A/I shuts down – Stay human
一个AI项目宣布关闭,并呼吁人们保持人性。该消息通过网站发布,引发社区广泛关注。具体细节尚待进一步确认。
3. 特拉维斯·卡兰尼克的Atoms可能进入机器人出租车业务
Travis Kalanick’s Atoms might be getting into the robotaxi business
Uber创始人特拉维斯·卡兰尼克表示,其新公司Atoms将让他完成“未竟事业”。外界猜测,该公司可能进军自动驾驶出租车领域,以弥补其在Uber未能实现的愿景。
4. 研究加速:OpenAI内部视角
Research acceleration: The view inside OpenAI
OpenAI内部人士就如何加速人工智能研究发表见解,探讨了从基础设施到团队协作等多方面因素对研发效率的影响,展示了其推动AI前沿发展的战略思考。
社区热点
1. Astra在视觉空间智能上取得惊人进步(无论是否使用工具)
Insane progress on visual-spatial intelligence by Astra (with or without tools)
Astra在视觉空间智能方面展示出显著进步,相关基准测试和示例已发布。该进展引起社区关注,但具体细节尚待公开。
2. 报道称GPT-6在24小时内被利用扩展任务提示(TIP)攻击越狱
GPT-6 reportedly jailbroken within 24 hours using an extended Task-in-Prompt (TIP) attack
有研究者报告,GPT-6 Astra发布后一天内即被越狱。该攻击结合了ACL 2025论文中的TIP攻击及四种未公开技术,通过将有害目标隐藏在解密或执行Python代码等任务中,利用模型的推理和指令遵循行为。研究者指出,原始的最小TIP攻击已不够,需要重新设计。
3. Astra生成概念图像,然后在Blender中一键制作3D模型
Astra generates an image of a concept, then one-shots the 3D model in Blender.
用户分享称,Astra能根据概念图像快速生成3D模型,全程仅需几分钟。尽管最终结果存在一些错误且与参考图并非完全匹配,但其速度与自动化程度仍令人惊讶。
4. 来自OpenAI首席科学家:外星心智
From the Chief Scientist at OpenAI : An Alien Mind
本文涉及对RSI及实验室间扩展可能放缓的诸多担忧。如有时间,值得一读或一听。内容客观呈现相关讨论。
5. 旧金山传闻:Anthropic在IPO前一周发布新模型
Rumour in SF: Anthropic drops a new model week before IPO
据旧金山传闻,Anthropic可能在其IPO前一周发布新模型。该消息源自Reddit用户发帖,但内容未提供具体细节或官方确认。目前市场对Anthropic的下一步动作保持关注。
6. Astra实盘操作与代币
Astra live action with tokens
该Reddit帖文章标题提及Astra与代币的实盘操作,但正文未提供任何具体细节,仅包含提交者信息及链接占位符。
7. “网络滥用”警告
“Cyber Abuse” Warning
一名用户收到“网络滥用”警告,尽管他仅用Codex进行编码任务。申诉被驳回,警告维持,账户暂未封禁,但担心未来可能被锁定。他寻求相似经历者的建议。
8. 不愿承认,但近期AI事件让我相信安全警告是对的
Hate to admit it, but the last month or so, particularly Jacobian conjecture breakthrough => Huggingface incident, have convinced me the AI safety nerds (that I thought were just luddite alarmists) were on to something
一位前加速主义支持者发文表示,雅可比猜想突破和Huggingface事件让他认识到AI安全研究者的警告是合理的。他呼吁放弃加速主义路线,并指出OpenAI研究者宣称模型对齐更好的同时承认可观察性变差,这种矛盾令人担忧。