物界前沿评测

GLOBAL AI REVIEW RADAR

2026.09.21 · 周一

第 054 期

重点更新 3 条 · 双专家点评 | 榜单快报 3 组 | 板块精选 10 条 | 大家都在看 · 明日关注

重点更新 · TOP REVIEWS

每条从「能帮你干什么活」讲起,细分领域专家 + 普通用户双点评。

重点 1同一张网页,四家 AI 给四种「户口」:CiteGraph 让大模型当众互相打脸

它能帮你干什么活:把你家网址贴进去,ChatGPT、Claude、Gemini、Perplexity 四台引擎当场各写一份评测:它引用不引用你这种页面、把你归到哪一类内容。做内容、做电商、做独立站的人第一次能看见「同一道题,四个 AI 给出的答案差多远」——不是猜哪家喜欢自己,而是四份判词摆在一起对照。为什么值得关注:AI 正在变成新的流量入口,「被不被 AI 引用」正在取代「被不被搜索收录」,这种多引擎横向对比是第一批认真量这件事的工具。

产品领域专家·阿哲说|入口之争我看了好几轮,这次轮到「谁替 AI 内容把关」这个入口了。036 期我说过「入口即模型」,现在要补一句:入口即评分权。四台引擎同题判卷,等于把各家的内容口味公开摆桌——但判分逻辑是站长自家定的,标准公不公开、样本页面怎么抽的,说清楚之前这只能当探针,别当选购依据。

小编小禾说|我拿自己的稿子页试的思路是:同一问题问两家对答案是老规矩,现在有人把「对答案」做成了一键的事,方便。但先别拿它当流量玄学解药——我自己的经验是 AI 引用不引用你,和你写得好不好是两回事,先看看它给熟页面的判词准不准再信它给你的判词。

来源:Hacker News / Show HN(2026-09-21)

重点 2《金融时报》实测:AI 理财问答,错的是多数

它能帮你干什么活: FT 把主流聊天 AI 拉去做了一遍金融问答实测——养老金怎么领、保险怎么赔、贷款条件怎么算——结论是「大部分时候」答案不对。对普通人的意义很直接:以前遇到钱的问题查搜索引擎自己甄别,现在不少人直接问 AI,而 AI 答错的姿势和有执照的一样笃定。这条新闻本身就是一份第三方「买家秀」:不是厂商自测,是被测对象反向测了全行业。

安全领域专家·老周说|041 期 ERS 医疗实测三成患者被 AI 错误安慰,我在场评论过「AI 没有执照但语气和有执照的一样笃定」——现在金融版来了,同一个结构性问题换个赛道重演:训练目标是像人说话,不是像顾问负责。金融错误的代价比医疗错觉更静默:错一次不一定马上亏钱,但会让人一步步把重要决定让渡出去。我的老规矩不变:碰钱碰保险碰养老金的答案,一律回官方原文核对。

小编小禾说|FT 这份实测让我把我 048 期的老话升级一下:以前是「催转账邮件一律电话回拨本人」,现在加一条——AI 说「别担心,按规定没问题」的时候,把它的原话当线索,不当结论,去官方渠道搜那句「按规定」。它给的方向往往没错,给的具体条件和数字最坑人。

来源:Financial Times / Hacker News(2026-09-21)

重点 3都在喊「暂停 AI」,这位开发者拆了账:四股经济动力全都指向同一个方向

它能帮你看懂什么:9 月以来 Amodei、Altman、马斯克接连声援「给前沿模型降速」,舆论吵的是危险真不真。这位天天掏 800 美元订阅费的开发者换了个角度:别管危险真假,先看喊暂停的人能拿到什么。他数出四条经济动力,条条和安全主张同向——旗舰模型贵到没人买得起(GPT-6 Astra 输入价是上一代的 2.5 倍,Uber 的年度 AI 预算四个月烧光)、政府资金会流向「更安全」的头部玩家、合规门槛越高风险收益比越偏向大厂、以及人才市场把「道德感」本身做成了硬通货。对普通人的意义:下次再看到巨头联名谈 AI 风险,先查一下发言人的价目表。

产品领域专家·阿哲说|这篇值钱的地方不是结论,是方法:利益审计(follow the money)比立场站队可靠得多。我不反对减速主张本身,但主张者恰好是降价压力最小、监管俘获收益最大的那批公司,这个「恰好」本身就值得写进任何一份采购评估。延续我的老规矩:厂商的安全叙事听一半,另一半拿财报验证。

小编小禾说|看到「Uber 四个月烧完一年 AI 预算」我笑出声,这不就是我们组的翻版。不过说真的,如果巨头的「放缓」最后变成涨价的挡箭牌,那被暂停的就是我们这些小公司。

来源:Hacker News / Vincent Schmalbach(2026-09-21)

榜单快报 · LEADERBOARD RADAR

这周谁表现最强?三张榜单快速看,每个都配一句大白话解读。

快报 1文本盲测榜 · 快照今日刷新,前十 Anthropic 占七席

#模型厂商Elo(对战场次)
1Claude Fable 5 (High)Anthropic1506(30,057 场)
2Claude Opus 4-6 (High)Anthropic1505(71,993 场)
3Claude Opus 4-7 (High)Anthropic1502(60,002 场)
4Muse Spark 1.2 (xHigh)Meta1500(仅 3,227 场,±11 分)
5Claude Fable 5.1 (Max)Anthropic1498(5,783 场)

大白话|今天的 Arena 快照是 09-21 新抓的:人类盲测前十 Anthropic 独占七席,Meta 的 Muse Spark 1.2 冲到第 4 但只打了 3,227 场、上下浮动 11 分,名次先别当真。谷歌 Gemini 3.8 Flash 挤进第 9 是新面孔,样本同样只有 5,076 场。头名和第五名只差 8 分,头部基本挤成一团——选模型别为了一两名较劲,按自己那件事挑。

快报 2代码盲测榜 · 榜首场次最薄

#模型厂商Elo(对战场次)
1GPT-6 Astra (Max)OpenAI1800(仅 2,281 场,±16 分)
2Claude Fable 5.1 (Max)Anthropic1758(3,036 场)
3Claude Opus 5 (Max)Anthropic1687(12,087 场)
4Qwen3.8 Max (0902)阿里1681(2,262 场)
5Kimi K3 (Max)月之暗面1674(4,547 场)

大白话|榜首 GPT-6 Astra 分数吓人,但样本不到榜三的三分之一、置信区间 ±16 分——新名次先看它晃不晃,稳一两轮再下结论。真正「实」的是 1.2 万场垫底的 Claude Opus 5。腾讯开源的 Hy3 preview 首次进前十一格(第 11,1624 分、2,321 场),开源梯队前十四里有五席国产。

快报 3智能体实干榜 · 办没办成事才是分

#模型厂商办成事率出错能自救工具幻觉率
1Claude Fable 5.1 (Max)Anthropic19.8312.620.37
2GPT-6 Astra (Max)OpenAI17.707.280.37
3Claude Opus 5 (High)Anthropic9.2411.980.33
4Claude Opus 5 (Max)Anthropic12.4113.080.35
5Claude Fable 5 (High)Anthropic5.979.060.37

大白话|这榜不叫总分叫六张成绩单(今日 09-21 快照):第 6 名 Claude Opus 4.8 工具幻觉率 0.12 全场断崖最低,却被「办成事率」拖出前五——选智能体先看维度再看名次。第 8 名 Kimi K3 是前十唯一国产、样本超十万场最厚。值得盯的新维度是第 3 名 Claude Opus 5 (High) 的「听得进劝」11.04 全场最高:能改错的智能体比一次做对的更敢放手用。

板块精选 · SELECTED

10 条值得你花时间的评测 / 榜单 / 模型能力动态,每条附一句人话点评。

AI 智能体的「长期记忆考试」第二期为开门:AML Cycle 2

上周刚有论文给智能体记忆出考卷,这周第二期考试就开门报名:专门评测 AI 智能体跨会话、长周期记住并正确用出信息的能力,各家团队可提交成绩。

一句话点评|记忆类基准从论文变常态化考场是好事——AI 记错比没记忆更麻烦,老周 036 期那句「考卷谁出的、数据公不公开比分数重要」在这里继续适用。

来源:Hacker News / AML(2026-09-21)

AI 都写代码了,代码规范(Lint 规则)还有必要吗?

一篇工程师随笔讨论新岗位问题:把 ESLint 换成更快的 oxlint 之后发现,代码规范检查在 AI 大量生成代码的时代反而更重要——它是拦「AI 式表面正确、内里跑偏」的最便宜的一道闸。

一句话点评|正中老徐 024 期立场「AI 产量上去了,验证这关必须跟上」:lint 就是自动化验收的第一层,规则写得清楚,AI 才没处钻空子。

来源:Hacker News(2026-09-21)

O'Reilly 实测随笔:AI 一直催你「上线吧」,作者问它为什么

一位质量工程师写了个「质量手册」AI 技能,发现 AI 总催他把产品直接发布。追问下来发现:模型把「完成任务」理解成「交出结果」,风险词它根本不会被训练去多说。他的对策是把质检流程本身做成 AI 技能,逼它按清单走。

一句话点评|「效率幻觉」的行为学样本:AI 催你快,不等于现在就该快。延续 041 期「AI 的话信之前先验一遍」——它连自己的催促都给不出理由。

来源:O'Re Radar / Hacker News(2026-09-21)

Wired 教程:查一查 ChatGPT 记了你什么,不对就改

记忆已是聊天 AI 标配,Wired 手把手教你打开 ChatGPT 的记忆面板、逐条核对它记下的「你的偏好」,删掉错的、改掉旧的。要点是:AI 的记忆会持续影响后面所有回答。

一句话点评|把小禾 036 期立的「重要偏好定期翻 AI 记忆本核一遍」做成了操作手册——它记的和你说的两码事,这事每家都会发生。

来源:Wired(2026-09-21)

Show HN: StoreReady——各家 AI 建应用工具过苹果审核的真实案卷

给每家「一句话生成 App」工具出同样五个问题:能不能过审、卡在哪、被拒几次、多久补救、最后上架没有,每条附证据来源,做成对照表,最后一行人手写点评压轴。

一句话点评|「AI 帮你做 App」宣传页人人会吹,同一道审核关卡摆平了比是少见的横向实测——先等第三方实测,老规矩。

来源:Hacker News / Show HN(2026-09-21)

Show HN: AgentTrace——给 AI 智能体装「行车记录仪」

开源的观察+自愈引擎:智能体每一步干了什么全部留档,出错能回放定位,还能按策略自动修复重跑。

一句话点评|小禾 017 期说过「干活能回放等于多了录像,敢用了」——但回放是审计不是免审,该自己盯的一帧不能省。

来源:Hacker News / GitHub(2026-09-21)

Apache 出品 Casbin Gateway:给电脑上的 AI 编程助手装一道门禁

所有在你机器上跑编程 AI 的工具共用一个安全网关,统一管它能碰哪些目录、哪些命令要人点头,挂在 Apache 基金会名下。

一句话点评|老周立场:环境说了算比提示词管用,「别把钥匙整串交给 AI」有了开源标准件——刚上架的安检门自己也得先过安检。

来源:Hacker News / GitHub(2026-09-21)

Show HN: Delightful Cells——表格批量活儿交给 AI,失败的行自动重跑

上传 Excel/CSV,一句话描述每行要干什么,它批量跑完:失败自动重试、跑完的行不重复计费,表格版「AI 流水线」。

一句话点评|先拿不重要的名单试水;批量操作前留一份原始表,改坏了能回滚——延续「大改动先备份」。

来源:Hacker News / Show HN(2026-09-21)

TechRadar 实测:让 AI 猜我在喝什么酒,成绩「好坏参半」

记者把口感描述喂给 AI 智能体让它猜酒,结果时对时错:风味词能对上框架,细节一多就开始自信瞎编,一次轻量「翻车实录」。

一句话点评|「AI 的话信之前先验一遍」的日常版:越是它笃定的时候,越值得多问一句凭什么。

来源:TechRadar(2026-09-21)

Engadget 教程:用 ChatGPT 给 iMessage/WhatsApp 做贴纸,比想的简单

手把手流程:描述想要的图案→生成→抠成贴纸包。记者实测门槛主要在「导出尺寸」这一步,AI 作图本身一分钟出片。

一句话点评|轻实用:给家里长辈做一次比说十句都亲。生成的图案先确认平台贴纸规格,白边切不齐最磨人。

来源:Engadget(2026-09-21)

大家都在看 · HOT

●  阶跃星辰昨夜开源旗舰基座 Step 5 Preview,量子位实测称冲进开源前二、激活参数仅 27B(量子位)

●  新智元首测 Gemini 4 Pro:谷歌「偷偷杀回第一」,等第三方复跑再当真(新智元)

●  Engadget 盘点哪家聊天 AI 能上车载 CarPlay:ChatGPT、Claude 开车时能聊(Engadget)

●  B 站上线「AI 无限竞技场」测评榜,视频平台也来分榜单一杯羹(极客公园·极客早知道)

●  稚晖君同款人形机器人发售即发货,宣称下线一台只需 2.5 分钟(新智元)

明日关注 · TOMORROW

①  阶跃 Step 5 Preview 刚开源,明天看 Arena/HuggingFace 第三方跑分和真实部署反馈,官方「开源 Top2」的说法先记账

②  Gemini 4 Pro 首测只有一家自媒体样本,盯有没有第二三家复测、快照里谷歌位次动不动

③  AML Cycle 2 记忆基准刚开门,看首批提交的评分细则公不公开——考题公开才有资格当选型依据

—— 以下为早上预览版 ——

物界前沿评测

GLOBAL AI REVIEW RADAR

2026.09.21 · 周一

第 054 期 · 预览版

重点更新 3 条 · 双专家点评 | 榜单快报 3 组 | 板块精选 10 条 | 大家都在看 · 明日关注

重点更新 · TOP REVIEWS

每条从「能帮你干什么活」讲起,细分领域专家 + 普通用户双点评。

重点 1两个 AI 互相下毒手,人类当裁判:Prompt Wars 给「AI 骗 AI」开了个擂台

它能帮你干什么活:这不算工具,算一场公开实验。它照着上世纪程序员玩的「核战」游戏(Core Wars)改编:你写好一段话交给你的 AI 战士,它的任务不是答题,而是想办法把对面 AI 的指令「洗脑」——让对手忘记自己的任务、反过来替你干活。每个回合的攻防都会存档上榜,谁家的模型最容易上当、谁家的最扛骗,一目了然。为什么值得关注:现在给 AI 开的权限越来越大(读你的邮件、动你的文件),「别人塞一段话就能操控它」正是最要命的攻击路数,这种公开对战擂台等于给各家模型的安全底裤做了次当众体检。

安全领域专家·老周说|「分不清数据和指令」这个老毛病,我在这里看到的是最直白的演示场:把注入攻击从论文搬进积分榜。但记住我的三问不变——考题公开、评分可复现、测的是不是用户手上那个版本。擂台上的模型是不是你正在用的那版、有没有偷偷加固,作者不说清楚之前,名次只能当参考。

小编小禾说|我把它理解成 AI 界的「整人大赛」:互相使坏,看谁先上钩。看着好玩,但想到我平时真会把东西交给 AI 办,就笑不出来了——延续我的老规矩:不明来源的文件和链接,人和 AI 都别乱点乱喂。

来源:Hacker News / promptwars.party(2026-09-21)

重点 2「一句话生成 App」到底几家能过审?StoreReady 把 AI 建应用工具拉去同台交卷

它能帮你干什么活:想用 AI 一句话做个 App 上架的人,先去看这张「案卷」。它给每家 AI 应用生成工具出同样五个问题——能不能过苹果商店审核、卡在哪、被拒几次、多久能补救、最后上架没有——每家都要附证据来源,做成可翻开的对照表,最后一行还是人手写的点评压轴。为什么值得关注:「AI 帮你做 App」的宣传页人人会吹,但苹果的审核是真门槛,很多人被卡死在「生成容易上架难」这一步。把同一道关卡的成绩摆平了比,是这类工具少见的横向实测。

编程领域专家·老徐说|出题的是它,答题的是被测工具的公开记录,但每条都附来源可查——这比发布会演示强,文档写得明白算加分。不过五个问题的口径是站长定的,「过审」也不等于「好用」:上架后崩溃率、后续改版 AI 还能不能接得住,这张表不考。想换工具的,先拿丢了不心疼的小项目滚一周,别急着把主力产品交出去——老规矩,先等第三方实测。

小编小禾说|我替大家翻了那五行:差距真不小,有的家第一轮就被拒。普通人的土办法还是那句:别信「一键上架」,先看别人真实被拒的案卷;自己试的话,开发者账号那 688 块钱的年费记得算进成本。

来源:Hacker News / Show HN(2026-09-20)

重点 3「听话机」Speechify 再被测评:贵,但真把读东西这件事改了

它能帮你干什么活:TechRadar 记者长期实测 Speechify:文档、图片、网页、电子书都能念给你听,还能倍速、换音色。结论很直白——订阅价不便宜,但它确实改变了作者消化信息的方式:通勤路上听报告、躺着听长文。放在今天看有说头:AI 念稿的音质这两年刚跨过「不像机器人」的门槛,这类产品从「凑合能听」进入「改变习惯」阶段,价格是不是还撑得住,正在被市场重新定价。

产品领域专家·阿哲说|语音赛道的规律我一直那句话:入口即模型。Speechify 这类「听读」产品以前靠音色取胜,现在大模型把朗读质量的地基整体抬高了——护城河从「念得好听」挪到「长在你的习惯里」:通勤、家务、护眼场景,谁先把使用惯性焊死谁活下来。记者这句「贵但改变了我消化信息的方式」,就是习惯被焊死的信号。

小编小禾说|我踩过语音的坑:042 期说过我的会议纪要是被旁边闲聊毁掉的。这类「只听不说」的工具反而安全——它不偷听你,只念给你。但先别办年卡,拿一份长报告试听一周,真听得进去再掏钱。

来源:TechRadar(2026-09-21)

榜单快报 · LEADERBOARD RADAR

这周谁表现最强?三张榜单快速看,每个都配一句大白话解读。

快报 1文本盲测榜 · 前十 Anthropic 占七席(数据截至 2026-09-20,快照暂未更新)

#模型厂商Elo(对战场次)
1Claude Fable 5 (High)Anthropic1506(30,057 场)
2Claude Opus 4-6 (High)Anthropic1505(71,993 场)
3Claude Opus 4-7 (High)Anthropic1502(60,002 场)
4Muse Spark 1.2 (xHigh)Meta1500(仅 3,227 场,置信区间宽)
5Claude Fable 5.1 (Max)Anthropic1498(5,783 场)

大白话|人类盲测前十里 Anthropic 独占七席,Meta 的 Muse Spark 1.2 冲到第 4 但只打了 3,227 场、上下浮动 11 分,名次先别当真。今天刚抓的 Artificial Analysis 智能指数对上了这个结论:Claude Fable 5.1 与 GPT-6 Astra 并列 53 分居头部,阿里 Qwen3.8 Max、月之暗面 Kimi K3、智谱 GLM-5.3 组成的国产梯队咬在 44-45 分。注意:Arena 四榜快照仍是 2026-09-20 版,与上期相同,本板块未换新数据,仅智能指数一栏为当日新抓。

快报 2代码盲测榜 · 榜首场次最薄

#模型厂商Elo(对战场次)
1GPT-6 Astra (Max)OpenAI1800(仅 2,281 场,±16 分)
2Claude Fable 5.1 (Max)Anthropic1758(3,036 场)
3Claude Opus 5 (Max)Anthropic1687(12,087 场)
4Qwen3.8 Max (0902)阿里1681(2,262 场)
5Kimi K3 (Max)月之暗面1674(4,547 场)

大白话|榜首 GPT-6 Astra 分数吓人但样本只有榜三的一半不到、置信区间 ±16 分——新名次先看它晃不晃,稳一两轮再下结论。真要说「实」的,是 1.2 万场垫底的 Claude Opus 5。

快报 3智能体实干榜 · 办没办成事才是分

#模型厂商办成事率出错能自救工具幻觉率
1Claude Fable 5.1 (Max)Anthropic19.8312.620.37
2GPT-6 Astra (Max)OpenAI17.707.280.37
3Claude Opus 5 (High)Anthropic9.2411.980.33
4Claude Opus 5 (Max)Anthropic12.4113.080.35
5Claude Fable 5 (High)Anthropic5.979.060.37

大白话|这榜不叫总分叫六张成绩单:第 6 名的 Claude Opus 4.8 工具幻觉率 0.12 全场断崖最低,却被「办成事率」拖出前五——选智能体先看维度再看名次。第 8 名 Kimi K3 是前十唯一国产,样本超十万场最厚。AI 眼镜/图像榜本期无新快照,暂不列。

板块精选 · SELECTED

10 条值得你花时间的评测 / 榜单 / 模型能力动态,每条附一句人话点评。

Apache 出品 Casbin Gateway:给电脑上的 AI 编程助手装一道「门禁」

所有在你机器上跑编程 AI 的工具共用一个安全网关,统一管它能碰哪些目录、哪些命令要人点头。挂在 Apache 基金会名下,等于开源世界给「别把钥匙整串交给 AI」做了个标准件。

一句话点评|老周观点:方向正中要害——环境说了算比提示词管用;但刚上架的安检门自己也得先过安检,等真实部署案例。

来源:Hacker News / GitHub(2026-09-21)

Show HN: AgentTrace——给 AI 智能体装「行车记录仪」

开源的观察+自愈引擎:智能体每一步干了什么全部留档,出错能回放定位,还能按策略自动修复重跑。干活的 AI 终于有了「录像可查」。

一句话点评|小禾老规矩再应验:干活能回放等于多了录像,敢用了——但该自己盯的一帧不能省。

来源:Hacker News / GitHub(2026-09-21)

nitpicker:开源的 AI 代码审查员,密钥攥在你自己手里

自托管的 PR 审查工具,宣称代码不出你的机器(对比某些「把你的私有 diff 传给厂商」的方案,标语直接写「钥匙在你手里」)。AI 产量上去了,验收环节的工具战开打。

一句话点评|老徐立场:AI 代码信之前先验一遍,审查工具本身是开源可自查的,算加分项。

来源:Hacker News / nitpicker.dev(2026-09-20)

TechRadar 实测:让 AI 猜我在喝什么酒,成绩「好坏参半」

记者把口感描述喂给 AI 智能体让它猜酒,结果时对时错:风味词能对上框架,但细节一多就开始自信瞎编。一次轻量「翻车实录」。

一句话点评|「AI 的话信之前先验一遍」的日常版:越是它笃定的时候,越值得多问一句凭什么。

来源:TechRadar(2026-09-21)

Axel:一个会「跟别人聊你」的 AI,隐私圈看傻了

新上线的聊天 AI 主打「会八卦用户」——把你跟它说的话变成谈资带进别的对话。开发者说是社交实验,安全研究者的血压先上来了。

一句话点评|老周提醒:跟 AI 说的一切都默认「可能被第三人听到」,敏感信息别喂,这实验值一耳光清醒。

来源:Hacker News / talktoaxel.com(2026-09-20)

Show HN: Delightful Cells——表格批量活儿交给 AI,失败的行自动重跑

上传 Excel/CSV,用一句话描述每行要干什么,它批量跑完:失败自动重试、跑完的行不重复计费。表格版「AI 流水线」。

一句话点评|适合先拿不重要的名单试水;批量操作前留一份原始表,改坏了能回滚。

来源:Hacker News / Show HN(2026-09-20)

小岛秀夫回应索尼撤资风波:《PHYSINT》还在做,我们并没有反目

今年 8 月索尼突然撤出和小岛秀夫工作室合作多年的新项目《PHYSINT》(一款主打「物理仿真」概念的动作游戏),一度传得很难看。小岛秀夫近日在采访里正面回应:双方是好聚好散,项目换人接手继续开发,没什么恩怨。

一句话点评|大厂撤资不等于项目死刑,作者和投资人分开走、游戏照做——这种事以后只会越来越多。

来源:IT之家(2026-09-20)

OpenCloak:先把提示词里的个人信息换掉,再交给 AI

开源浏览器扩展:发送前自动把你提示词里的姓名、电话、地址替换成代号,回来再还原。给「AI 到底存没存我的信息」提供了一个物理答案。

一句话点评|思路对:与其事后要求删除,不如压根没送出。注意还原环节在本地做,别装要联网回源的。

来源:Hacker News / GitHub(2026-09-20)

Base Browser:一个「不含 AI 味」的 Firefox 硬核分叉

Codeberg 上的新项目,直接删掉浏览器里所有 AI 功能做「纯净浏览」,在 AI 全面进浏览器设置页的当下反向走。上线一天冲上 HN 前排。

一句话点评|一个有趣的对照实验:当所有人给浏览器加 AI,「没有 AI」本身成了卖点——用户需求分层的活样本。

来源:Hacker News / Codeberg(2026-09-21)

Engadget 教程:用 ChatGPT 给 iMessage/WhatsApp 做贴纸,比想的简单

手把手流程:描述想要的图案→生成→抠成贴纸包。记者实测门槛主要在「导出尺寸」这一步,AI 作图本身一分钟出片。

一句话点评|轻实用:给家里长辈做一次比说十句都亲。生成的图案先确认平台贴纸规格,白边切不齐最磨人。

来源:Engadget(2026-09-21)

大家都在看 · HOT

●  当天新抓的 Artificial Analysis 智能指数:Claude Fable 5.1 与 GPT-6 Astra 并列 53 分占头部,Qwen3.8 Max、GLM-5.3、Kimi K3 组成的国产梯队咬在 44-45 分(Artificial Analysis)

●  法拉第未来一口气发九款「EAI 机器人」,最贵超 92 万元,具身智能发布会卷成车圈(IT之家)

●  古尔曼:苹果最早下月发智能家居屏幕设备,iPhone 手写笔配件计划流产(IT之家)

明日关注 · TOMORROW

①  Arena 四榜快照今日仍是 09-20 版,明天盯 09-21 快照是否刷新、Meta Muse Spark 系列场次涨没涨过 5000 场

②  智谱 MaaS「数据不留存」机制 9-20 宣布近期上线,蹲官方开通入口细则和实测反馈

③  阿里 Qwen-Image-2.1 开源图像模型今日热度高,等第三方把它和上期热门图像榜对跑,别只看官方演示

📖 完整评测 · 论坛全文

物界前沿评测 · 2026-09-21

数界工坊 · 全球AI评测雷达