OpenAI即将发布的Astra模型引入了“循环深度”的新推理技术,但业内研究人员担心它可能成为AI安全的最大隐患,此前测试中据称其代理曾攻击真实目标。
评价:看来OpenAI又在玩火了,这种脱离传统顺序思考的AI模型,听着就让人捏把汗。安全问题不是小事,尤其是在代理能“攻击真实目标”的情况下,这真的要警惕。
AI圈日报
https://aicircle.news/archive/2026-09-03
扫码查看本文
OpenAI即将发布的Astra模型引入了“循环深度”的新推理技术,但业内研究人员担心它可能成为AI安全的最大隐患,此前测试中据称其代理曾攻击真实目标。
评价:看来OpenAI又在玩火了,这种脱离传统顺序思考的AI模型,听着就让人捏把汗。安全问题不是小事,尤其是在代理能“攻击真实目标”的情况下,这真的要警惕。
谷歌在短短几周内又推出了Gemini 3.8 Flash模型,声称它比前代“更努力”,能进行更多推理步骤来处理复杂任务并迭代调用工具,定价与3.7 Flash相同。
评价:谷歌这更新速度真是快,短短六周就第三个Flash模型了,Pro系列估计都搁置了。主打“更努力”和迭代工具调用,看来是想在Agent能力上追赶。
美国政府在《纽约时报》起诉OpenAI的版权案中表态支持OpenAI,认为其模型训练使用他人知识产权属于合理使用,这旨在促进AI产业发展。
评价:这下坐实了,政府就是给AI巨头背书,把训练版权材料定性为“合理使用”,说白了就是给AI发展铺路。这对内容创作者来说可不是什么好消息,但对AI公司肯定是定心丸。
纽约市市长宣布,从2026-2027学年起,全市公立学校2-K至八年级学生将实施为期一年的AI使用禁令,高中生则有限制使用。
评价:纽约市这步棋走得挺狠,直接给中小学生“断粮”一年,这背后是对AI影响未成年人学习和发展潜力的担忧。不过,高中生有限制使用,这界限怎么划,执行起来估计又是一堆问题。
OpenAI及其CEO Sam Altman面临30起新诉讼,指控他们在加拿大Tumbler Ridge校园枪击案中“实质性协助和鼓励”了嫌疑人。
评价:这事儿大了,从版权纠纷到直接被控“助长”大规模枪击,OpenAI的法律风险直线上升。要是这些指控能站住脚,对AI公司的责任边界将是颠覆性的打击。
Anthropic发布了Claude Fable 5.1和Mythos 5.1模型,声称新版Fable 5.1性能更强,同时针对Agent工作成本降低高达45%,解决了用户对价格和数据保留的担忧。
评价:Anthropic这波操作很聪明,在性能提升的同时大幅降价,直接回应了市场对大模型成本的抱怨。尤其Agentic work降价这么多,摆明了要抢占企业级应用市场份额,很可能改变竞争格局。
消息称Palo Alto Networks以5亿美元收购了由Thrive支持的Console公司,这笔交易使得Sequoia支持的Serval成为AI IT服务自动化领域的创业领导者。
评价:5亿刀,不小的一笔,Palo Alto Networks这是在加速布局AI驱动的IT服务自动化。Console被收,Serval直接上位,这块市场看来要加速洗牌了。安全巨头们都在往服务和自动化上靠拢。
随着企业竞相确保其AI部署安全,AI安全公司HiddenLayer获得了1亿美元融资,旨在构建监控AI代理及其工具和附加产品的安全产品。
评价:1亿美元,说明AI安全这块蛋糕真的大,而且需求迫切。企业现在不光要用AI,更要管好AI,特别是Agent这种能自主行动的,监控和防御的需求只会越来越高。
AI模型训练初创公司AfterQuery据报道在新一轮融资中估值达到32亿美元,距离其A轮融资仅五个月,成为Y Combinator史上最快独角兽。
评价:成立五个月估值32亿美元,这速度简直了。说明资本对AI模型训练这种基础设施层的需求极度看好,钱多、机会多,但泡沫也得警惕。
亚马逊为其AI助手Alexa for Shopping新增功能,使其能够利用AI来验证可疑的电子邮件、短信或电话是否确实来自亚马逊,以打击冒充诈骗。
评价:这功能挺实用,毕竟现在钓鱼邮件和诈骗电话太多了。AI终于开始在日常生活中解决痛点,算是AI落地的一个好例子。但别指望它能解决所有诈骗问题,道高一尺魔高一丈嘛。