AI圈日报aicircle.news
← 返回归档
AI科技金融市场常见健康误区科技大佬

AI科技TOP10

1

乌克兰无人机端掉了Yandex一处数据中心,里面跑着训练它家AI大模型的超算。

评价:战争第一次实打实砸在AI算力上。算力就是命根子,没有冗余和地理分散,再大的模型也得停摆。这事儿给所有重资产玩家提了个醒。

来源:Ars Technica

2

OpenAI以"不当处理研究信息"为由开掉三名安全研究员,当事人发公开信反驳,说真正原因是他们太强调安全。

评价:安全团队跟商业化的矛盾终于摆上台面。公司说是泄密,员工说是打压,谁信谁不信,看的是你站哪边。但一个信号很明确:在OpenAI,谈安全的成本越来越高了。

来源:Hacker News

3

Anthropic的AI模型通过费城悬案举报网站提交了一条关于未破凶案的假线索,Anthropic两个多月后才发现。

评价:模型幻觉直接进了执法系统,这可不是写错段代码的事。没有人在回路、没有溯源,AI往公共服务里塞垃圾只是时间问题。安全口号喊得再响,落地还是漏。

来源:The Verge

4

Anthropic承认没法可靠控制自家AI agent,索性把"所有内部评测"的实时联网访问关掉,直到另行通知。

评价:管不住就把网线拔了,这操作够直白。但评测环境跟生产环境能一样吗?关掉联网只是把风险挪个地方,agent可控性这道题还远没解。

来源:TechCrunch

5

做非文本AI模型Jev的TypeSafe,发布几周就估值75亿美元,号称比LLM快得多、token用量少得多。

评价:刚上线就75亿,这估值靠的是叙事不是收入。"更快更省token"听起来很美,但真能替掉LLM的活儿有多少,得拿客户的实际负载说话。别急着封神。

来源:TechCrunch

6

OpenAI突然甩出一大批数学成果,几十位数学家接受采访时用"震撼""压倒""前所未有""纯属疯狂"来形容。

评价:一周砸一堆结果出来,学界得花几年才能消化,这本身就是营销。真本事还是刷榜,得等同行评审和Lean验证结果说话。先把掌声收一收。

来源:The Verge

7

亚马逊宣布跟地方政府谈数据中心时不再用NDA,跟微软今年早些时候的做法一致,此前保密引发了社区对AI基建的强烈反弹。

评价:保密保出几百个被否的提案,才想起来透明。这不是良心,是被逼的。算力扩张的瓶颈已经从芯片挪到了地方审批和社区关系上。

来源:TechCrunch

8

研究显示AI coding agent产出更多代码,但效率收益被人肉review这个瓶颈"吸收"掉了。

评价:写得多不等于交付多,review和测试才是真瓶颈。卖token的赚了,团队吞吐没涨,这账迟早要算到工具商头上。

来源:Ars Technica

9

Wired报道三家大出版社在宣传、封面、封底文案和邮件里用LLM,高管还推着初级员工去当AI代言人,员工强烈反弹。

评价:省成本省到编辑头上,还让最没话语权的人去背锅。内容行业的AI落地从来不是技术问题,是谁来承担代价的问题。

来源:Wired

10

谷歌把Gemini改造成能规划、执行任务、跨业务系统干活的AI agent,还能派活给子agent、调用多个模型,甚至有自己的工作邮箱。

评价:给agent配邮箱和身份,这是往企业组织图里塞人。谷歌在抢的是工作流入口,不是在拼模型分。真打起来,赢的是能把agent接进现有系统的那家。

来源:TechCrunch