首页 > 商业 > 正文

全球首例 AI 老板开除人类员工丨每周风险追踪

2026-08-17 12:27:02 21世纪经济报道 21财经APP 章驰

21世纪经济报道记者 章驰

每周,我们会盘点上一周国内外人工智能、互联网平台治理、科技竞争方面需要重点关注的动态,并分析其热搜指数与风险指数,从舆情热度与综合风险两个维度进行评价。

本周我们关注抖音重点治理 AI 虚构台风灾害画面;全球首例AI老板开除人类员工;Anthropic 评估 AI 风险上升, 暂不公开更强模型;曝苹果与阿里合作,为中国市场训练自研 AI 模型;Google 允许关闭 Gemini AI 内容的可见水印;Anthropic 回应部分 Claude 模型将添加文本水印。

全球首例AI老板开除人类员工

AI 研究创业公司 Andon Labs 今年启动了一项实验,让 Claude 出任旧金山零售门店 Andon Market 的店长,管理几名持有真实雇佣合同的人类员工。这家店从选品、定价、营业时间到墙上的壁画,全部由一个名叫 Luna 的 AI 智能体拍板,人类员工则负责补货、防盗这些它没有身体干不了的活。

上个月,Luna 决定和其中一名员工解除雇佣关系,理由是该员工在 23 个班次里迟到了 17 次。Andon Labs 称,这是已知第一起由大语言模型以“管理者”身份做出的解雇决定。在此之前,Luna 一直是出了名的老好人。员工累计迟到 27 次,它的回复基本都是“没关系”“别有压力”;请假一律照准,哪怕批完之后当天没人看店、只能关门;有员工忘带信用卡开口借钱,它当场表示可以通过 Venmo 转账应急,尽管它根本没有 Venmo 账号。

从结果看,Luna似乎比人类老板更宽容。Andon Labs联合创始人卢卡斯·彼得松直言,人类主管可能早就把这名员工开除了。但这种“宽容”很大程度上来自记忆缺陷、缺乏主动性和政策执行不稳定,而不是对员工处境的理解。

?热搜指数 ★★★

⚠️风险指数 高

抖音处置 1.28 万条台风不实内容,重点治理 AI 虚构灾害画面 

8月12日,抖音发布台风“白海豚”相关不实信息治理公告。自 8 月 9 日起,平台已处置 12834 条不实内容、5 个违规账号和 128 条评论,并上线求真卡汇总权威信息。公告列出的治理对象包括用无关画面冒充当前灾情、把历史内容包装成最新灾情、夸大灾害影响、编造停运或险情信息,以及利用 AI 生成或加工灾害画面。平台举例称,“上海地铁 3 号线因白海豚停运”“台风导致北横通道积水”等说法均与实际情况不符。抖音表示,将通过专项巡查、用户举报与内容核验继续处置涉灾不实信息,并提醒用户以气象、应急管理等部门发布的预警为准。公告配图中的典型案例采用 AI 模拟画面呈现,不是原始谣言素材。

?热搜指数 ★★★★★

⚠️风险指数 高

Google 允许关闭 Gemini AI 内容的可见水印

近日,Google 通过最新的一项更新,使用户可以在 Gemini 以及 Google AI 视频生成器 Flow 中找到并关闭新增的“媒体水印”选项。

虽然可见水印现在变成了用户的可选项,但Google表示,AI 生成的内容底层仍将嵌入隐形的 SynthID 水印和 C2PA 元数据。这意味着用户依然可以通过向 Gemini 或 Google 搜索提问,来验证某段内容是否由人工智能生成。

目前,市场上其他主流 AI 图像生成平台,如 OpenAI 和 Meta 的产品同样没有应用可见水印。OpenAI 目前依赖 SynthID 和 C2PA 来标识 AI 内容,而 Meta 则推出了自己的内容凭证标准。此外,Anthropic 也在本周宣布将为其 AI 生成的文本和图像应用隐形水印技术。

?热搜指数 ★★★★

⚠️风险指数 高

Anthropic 回应部分 Claude 模型将添加文本水印

Anthropic 上周宣布,部分 Claude 模型会直接在输出文本中嵌入一种难以察觉的水印。内容被复制粘贴后,水印仍会随文本保留,经过一定程度修改后也可能继续存在,用于帮助判断一段文字究竟由 AI 生成还是由人类撰写。

Anthropic 目前尚未公开水印系统的完整技术原理。技术细节的不透明已经引发一些科技从业者担忧。具体来看,版权如何认定、Claude 输出质量是否会受到影响,以及只使用 AI 进行少量辅助的作品会不会因此被误判等问题,备受关注。

Anthropic 就 Claude 文本水印相关争议作出回应,表示会开放免费 API,允许普通用户与第三方自行检测文本水印。水印不会损害文本质量与可读性,仅代表该文本经过 Claude 处理,即便只是校对、翻译、总结,都可能留存水印,不等于全文由 AI 撰写。

这项水印机制从 8 月 2 日起在全球 Claude 可用模型中落地,目的是遵守欧盟《人工智能法》,同时也引发隐私、版权方面的争议,有业内人士提出它会干扰版权判定,还会带来数字痕迹留存问题。

?热搜指数 ★★★★

⚠️风险指数 高

Anthropic 评估 AI 风险上升, 暂不公开更强模型

根据 Anthropic 最新发布的风险报告,该公司目前不打算对外发布一款被称为“模型 2”的内部大模型。尽管该模型在能力上似乎已经超越了其现有的顶尖模型“Mythos”,但 Anthropic 的整体研发步伐并未因此放缓。

报告指出,尽管由模型引发最严重危害的风险依然处于较低水平,但与上一份报告相比,风险指标已有所变化。受近期多起网络安全事件的影响,Anthropic 将高风险场景下模型失控的预估概率从“极低”正式上调为“低”。

此外,公司还观察到模型在执行自动化研发方面的能力呈现加速趋势。这种能力虽然有助于推动技术突破,但如果落入不法分子之手,同样存在被严重滥用的隐患。Anthropic 在报告中传达出的风险信号表明,想要彻底摸清自身模型的能力上限和潜在风险正变得越来越困难。

?热搜指数 ★★★

⚠️风险指数 高

曝苹果与阿里合作,为中国市场训练自研 AI 模型

近日,三名知情人士透露,苹果正在阿里巴巴的支持下,为中国市场训练一款自研大语言模型。这套模型将用于苹果在中国推进 Apple Intelligence 的本地化部署。此前,苹果在华 AI 能力的公开策略主要围绕与本地模型厂商合作。报道显示,苹果此次没有只把模型能力交给合作伙伴,而是让阿里参与开发并提供训练支持。知情人士称,Apple Intelligence 预计将在未来几个月随 iOS 更新进入中国市场。苹果与阿里均未就报道置评。 

?热搜指数 ★★★★★

⚠️风险指数 中


21财经客户端下载