每个模型都有其用武之地
“正如人们所说,人工智能是一种锯齿状智能,它在某些方面极其聪明,而在另一些方面又极其愚蠢。而且它的结构与人类截然不同——当你使用Claude时,你使用的是同一个AI模型,即使你同时运行10个实例。所以10个实例互相交流并不会像10个人类互相交流那样真正改善其思考,因为那些人类是在10个不同的数据集上训练的。
人类天生就非常有创造力,思维不受限制。而AI代理是在相同的数据分布上训练的。它们实际上运行的是同一个模型。这就像10个拥有相同大脑和相同数据集的人在互相交谈。当然,仅仅通过热力学,他们可能会有一些不同的想法,得出略有不同的结果,但总体上他们的想法会是相同的。所以当你让10个代理互相交谈时,你只是在用10倍的token数量去处理问题。这就像说如果需要的话,花10倍的时间。
现在有不同的模型,比如Codex、Gemini和Grok Code,它们的训练方式略有不同。虽然差别不大,但确实有些不同。因此它们可能会有一些不同的见解。
Claude通过一个名为Artifacts的系统拥有非常好的视觉呈现能力,而且Claude非常擅长根据我的水平与我交流。它非常擅长从你的问题和对话中判断你能够理解什么,以及你在什么层次上提问。它非常擅长与你保持在同一水平。
ChatGPT仍然是元老。它在各方面都非常出色。
Gemini非常擅长搜索,因为它底层有Google的爬虫。这是一个令人沮丧的产品——它在应用上经常超时,失去连接,忘记上下文。但它非常快,并且拥有出色的搜索索引。所以如果我问的问题本质上是一个搜索问题,我就会用Gemini。
Gemini还能访问YouTube。所以如果你认为答案藏在某个YouTube视频里——而YouTube上有大量视频——那么Gemini就拥有YouTube的数据优势。所以Gemini实际上是靠数据优势取胜的。对我来说,它感觉不是最好的模型,但它拥有最好的底层数据。
而Grok是我可以信赖的、会告诉我真相的模型。它就像是最少被阉割、最少被削弱的那一个。它能访问X,所以非常擅长新闻。而且它非常擅长技术问题。所以如果你在科学/数学领域提出一个深奥的难题,我认为Grok实际上相当不错——不是说其他模型不行,但我认为Grok在这方面很突出。这反映了创造、训练和驱动它们的公司的偏见。
目前,四个领先的前沿模型各有其用武之地。”
完整节目:https://youtu.be/lIUEJqIDPcA