和AI 聊天,可以选择付费了

有证据显示,豆包要收费了。

所谓豆包要收费,就是说,C端要搞付费会员制了。在人机对话中,用户可以选择付费成为会员——当然,你也可以不选。

这是APP Store里豆包所呈现的:

标准版、加强版、专业版。其实这些名词起得不好,不如 pro max ultra 深入人心一眼看到差异。当然,还有一个更好的中文化名字,是友人刘晶说的:中杯大杯超大杯。

价格算不算贵?这暂时没法评判。因为付了钱之后,回答是不是更准确了,这事得用过才晓得,对吧?

说个国外chatpgt的例子给你们听——我现在不是gpt的会员,所以请尊贵的 GPT 会员费拉拉帮了一个小忙——这是一个从来不玩游戏的主儿。

我准备了一个很简单的无需上下文线索的问题:在某某游戏中,珍珠这种材料该如何获得。之所以准备的是这个问题,因为在很多游戏中,珍珠是常见的材料,但这个游戏里,珍珠却约等于无用,它只有消耗100个换一把武器,再消耗100个换一个盾牌的作用。而在游戏新版本里,这把武器和盾牌,对于能已经搞到200个珍珠的玩家而言,就是废物。所以这是一个很小众的问题,几乎没有玩家会关心。但这个问题的答案特别简单:去某个副本打boss会随机掉落,只此一法。

费拉拉先用了GPT的快速模式,这不是收钱的,任何能接通GPT的人都可以对话。AI丫丫叉叉地写了一堆,充斥着常见游戏的各种套路,拼完盘端了出来。我告诉费拉拉,去和GPT说:滚。

费拉拉大笑,说用思考模式看看,这个就要付费了。

AI又丫丫叉叉地写了一堆,我看完后,感叹了一句:银子这个变量太重要了。付过钱后的回答,极其靠谱,相当准确,无可挑剔。

今年以来,我确实有一种这样的个人体感:免费ai,几乎和骗纸差不多。

我曾和字节的人贱兮兮地说,啥时候让我掏个荷包?人回曰:快了快了,略等等。

确实挺快,主动要求掏荷包和正式推出,最多相隔一周。

自从gemini 3问世,付钱成为pro这个级别的会员后,我一方面沉迷与之互动,一方面也明显感受到,所谓限量已经频频发生。

我记得在春节期间,由于本人肉身在英国,用得极其高频,都没碰到过触发限量的事。以至于我一直误以为,只要不进行接口调用,只是人机对话,就不会碰到限量。

我没有仔细统计过,但在当下,大概三十四轮互动就会触发限量,应该不是我的幻觉。以至于我都在琢磨,要不要成为”尊贵的ultra会员“。

饶是谷歌家大业大,也快承受不起了。毕竟,人机对话聊天的背后,也是海量token的消耗。(其实前阵子 GPT 都想搞广告来贴补家用,被一通好喷啊)

今年以来,ai领域,按token付费的模式,越来越被人提及,被厂商采纳。尤其是小龙虾这种agent火了以后。

事实上,基于LLM的ai发展到今天,其实就诞生了两种主要的模式:聊天机器人bot,一问一答,其本质就是搜索。还有一种就是agent,接受用户的目标——自主执行多步任务——向用户返回结果。

付费模式大致也是两路,聊天机器人bot,采用按时间付费,比如你包月、包年。这种付费模式下,即便你不用,照付不误。但如果你狠狠地用,理论上应该伺候。不然怎么叫包时长呢?

agent会按token调用量来收费。你不用,就是token零消耗,一分钱不花。你要用起来,用得越多付得越多,很合理嘛。

有些产品的付费是混杂的,比如我是沉浸翻译的会员(因为我想用gemini flash),看上去是包月,但人明确告诉你,每个月的token消耗是有上限的,pro级别是月量两千万token。如果你用得很疯狂,达到上限,要么等到下个月再来,要么追加付钱。

这两种付费让我这种互联网老登想起了过往的服务器付费模式,比如早年专用服务器租赁模式,固定月费的,但买家自行规划容量,没有弹性收缩。贵司这个月没啥流量也得付这个钱,下个月种种原因突发高峰流量,服务器扛不住也只能懵逼,要么就是紧急加月费选择更高一级套餐。但云计算普及后,基本属于不用不付钱,少用少付钱,多用就狠狠付钱。

这个模式省钱么?不不不,其实不省钱。或者这个问题换过来问,供给方是不是能多收钱?对的,供给方盆满钵满。

云计算是一门好生意。

目前看,在ai领域,2c端的人机对话,搞收费的话,应该还是包时长为主。普通人其实很难扛住token消耗的量。

举个例子,我用沉浸翻译,翻译了两本书和一本杂志,token消耗量为300万。

所以2c端,极有可能未来也就是个引流的买卖。规模足够大,用户足够多,然后提取其中一部分有更多的需求用户,转化为可以接受按token付费的主。

依然还是一个金字塔模型,或者叫三级火箭模型:免费用户——时长付费用户——用量付费用户。

但我这个ai投降派,已经贱化成付费投降派。我用包时长的钱,去消耗海量token,天天把gemini打到限量,有可能还是在薅谷歌羊毛,毕竟深度研究这种 agent 服务,也含在月付费里头了。

免费ai,反正我是信不过,因为诸厂之间的跑马圈地已经基本完成。

—— 首发 扯氮集 ——

我最近沉迷于和ai交流游戏…绝不是沉迷游戏

最近入坑了一个有点年头的游戏:流放者柯南。我以前小小上过手,这次比较深入,当下已经到了150个小时。

这个游戏真心做得不错,照例向朋友馒头大师推荐,大概是我种草功夫日益见长,馒头在这款游戏毫无折扣的情况下,明知史低到过一折,还是入手。

馒头大师表示确实不错,连续两个深夜一二点,和我讲述游戏体验。

我意识到我推荐到位,但他又喜欢自己满世界闷头转,效率很低,于是我写了一个游戏萌新指引给他。他大为感动,在四番群扬善公庭,夸我很暖。这引起了群友们的围观,并引发了ai投降派代表风端的不服。

在风端看来,这个年代,让ai写一个某游戏的萌新攻略,轻而易举,于是他开启了若干ai,甚至调用了gemini的深度研究模式,形成了数千字的文档。

而在我看来,这些ai回答,基本都是“大而无当”状态。馒头也插话表示:没啥用。他甚至打了个比方:看得出很努力,相当于老师问了一个其实不大知道的问题,但东拉西扯好歹还是硬讲了十分。态度分满分。

风端提供的大多数ai结果,都有着相当多的幻觉,细节不可靠,会误导人。但不得不说,gemini的深研模式文档,虽然大用没有,但至少幻觉非常少。我认为及格线保住了。

流放者柯南是一款SOC游戏,即生存、开放世界、建造。这类游戏通常没有什么主线任务,不需要先完成一再完成二的情况,自由度非常大,你完全可以按照自己的理解走自己的发展路径。但带来的问题也在于此:SOC三大新手灵魂拷问:我是谁,我在哪里,我要去做什么。

以某国产LLM为例(我后面简称为Y,随便取的字母,看官不要去对应了),它的做法看得出,是全网找攻略,然后拼凑出一个答案给你。我一开始嫌麻烦,就直接和Y交流,多轮问答下来,如果满分是100分的话,Y能拿5分,真的,不能再多了。

比如我告诉它我抓获了一个仆从,有没有培养的必要。虽然我给Y下过一些严禁夸赞之类的限定性指令,但很明显,Y还是在用另外一种方法来进行所谓“对齐”:它先要说这个仆从属于游戏里属顶级角色,然后一通叙述。然而,实际情况完全不是这么回事。这个仆从只是中下等最多中等水平而已。Y其实依然在“迎合”我的对齐心态:我有一个物事,通过盛赞这个物事,来让我爽,仅此而已。

我后来专门就一些我知道得很清楚的细节问题测试Y,幻觉大了去。有一次它甚至用方舟的攻略来回答我——大概我以前问过它几嘴方舟,虽然这次是开的新对话框。Y每次都保证我100%靠谱,可惜几乎每次都打脸。

我一直认为,在游戏细节操作上,尤其是很多很鸡零狗碎的小问题,或者很少人关心的地方,ai是很不靠谱的。由此我也有个推论,很多事你问ai问个大面没问题,往细里刨,ai不行。除非这个ai关于这个领域特别训练过,比如医疗,比如教育。

但gemini告诉我:您这是刻板印象。

我没有比较gemini和Y的意思,比如gemini我掏了银子做了会员,用pro模式,而且我给gemini的限定指令很复杂也很全面,再加上我和gemini各种问题交流非常多,它确实算比较了解我——我有一次临时解除所有限定指令让它推测我是个什么人,除了年龄它的判断是错的外,其他几乎全中。

我开启了和gemini交流这款游戏的细节。越聊越觉得它真得牛逼。很多犄角格拉的小tips,它确实能给出。我注意到它的两个倾向,其一,它会频繁引用玩家社区里的链接(而不是什么大型游戏垂类网站的攻略),以及游戏官方维基。这是Y没有的倾向;其二,它会频繁从游戏设计角度,尤其是底层代码机制来给我解法。老实讲,我玩游戏几十年,找游戏攻略这种事从《大众软件》时代就开始了,很少看到这种人类手搓的设计机制角度讲解游戏的(不是没有,但确实少)

我举一个例子,你们就明白了。

我曾经带上两个仆从满世界乱逛,作死跑到了空气墙(游戏将之设计为一道绿幕)之外。游戏规定,玩家本体角色一旦被判定为在空气墙之外,立刻猝死,但仆从不死。于是,我两个仆从就被留在了那里,我很希望能想个什么法子再去到那里,把他们给带回来。

我第一时间想到的就是开无敌模式,虽然我知道极有可能不顶用,但还是尝试一下。果不其然,立刻猝死。

我们来看看gemini是怎么告诉我的:

作为一款本质还是LLM的模型,gemini当然不可能自行发现这个被我后来证实确实有效的技巧,但有句讲句,这比我满世界去找解法方便太多,我甚至不知道该在各种攻略网站里搜索框里输入什么。考虑到这是一款有年头的游戏,我去玩家社区里发帖询问,得到答案的可能性也不高,至少时效性会很差。

我还询问过一个第三方模组的使用问题,由于游戏是老外开发的,第三方模组也是老外开发的,中文世界几乎找不到答案。这个问题大致就是:我使用了这个模组提供的建筑物,为什么我的仆从不会自行走到建筑物里去找椅子坐或者找床睡觉:

有句讲句,我都不知道gemini是哪里进行大语言材料训练出来的这个结果。

你们可能也注意到了,我的gemini风格很装逼,明明是在讨论游戏这个娱乐向问题,它非要搞得像在写学术论文——这可能和我的限定性指令有关。各人有各人的不同爱好,反正我没有向ai索要情绪价值的需求。

gemini经常怼我的构想,比如我打算所有副本打完,最后再开启游戏里的“宝库大清洗任务”,gemini不屑一顾地说:

我打某个副本,发现副本里有个尤弥尔锻炉可以制造神兵利器,但每次都携带材料过去有点烦,就提议能不能在锻炉里放置很多材料,gemini不以为然(这点我没测试过,我还是倾向于它有幻觉):

我一直没太在意香料这个材料该怎么做,翻箱倒柜发现基地里只有18个香料,以为这是什么高级的特别的材料,gemini像看白痴一样地看着我:

与gemini交流游戏,确实有一种和一个资深玩家交流的感觉,它不仅告诉你该怎么做——表层攻略,还在告诉你为什么该这么做——核心机制。

于我而言,它那种冷峻机械绝不附和,时不时就要怼你的想法,机器性感风拉满。

(我的全局限定性指令,核心有三:第一性原理、循证医学原理和魔鬼辩护人)

作为一个人类玩家,我当然知道gemini不可能是百分百靠谱的,尤其是在游戏版本问题上,gemini多次表现出幻觉:它会搞混age of war和age of heroes两个新旧版本的差异。

但我确实发现,问ai关于游戏操作性细节问题不靠谱这个刻板印象属于我这个人类的幻觉。事实证明,它确实极有可能知道怎么做(know what)和为什么这么做(know how)。

我深信谷歌不会针对游戏攻略领域将gemini做什么特别性的训练,这就意味着似乎可以举一反三:很多领域,ai的表现,其实已经非常强悍。

对了,利用ai找答案,还可以很有针对性的个人化。比如,根据自己的电脑配置来决定游戏画面设置。我保证,你只能在网络上找到推荐你的画面设置参数做一个参考,而在gemini中,你告诉它你的机器配置,它会给出一个极为靠谱的就你电脑而言的最佳游戏画面设置参数。

我和gemini聊游戏太过沉迷,从一开始找个具体操作tips,到了后来游戏思路的交流,以至于多次触发使用量峰值。这篇公号写完,我大概已经使用量限额已经解封了。

走了。

—— 首发 扯氮集 ——