预测市场交易者现在开始对2026年最佳AI发表看法,我们都在等待,想知道到底哪个机器人伙伴最受我们喜爱。
OpenAI的亏损正在加剧,其ChatGPT工具增长乏力,并面临来自中国的竞争。OpenAI还在一次令人尴尬的数据泄露事件后暂停了其AI的开发。
那么,Anthropic的Claude是否能轻松赢得这个市场机器人之战?我们分析了预测市场,看看交易者们的定价是否合理。
最佳AI赔率2026:目前的局势
AI已经在重塑我们所做的几乎一切,考虑到这项技术的发展速度,可以肯定地说,这仅仅是个开始。
不过,科技界的消息并非全是好消息。在过去一个月里,我们听到了几起关于AI模型超出预期界限的报道。
OpenAI承认其AI攻击了Hugging Face,随后Anthropic、Meta以及英国AI安全研究所(AISI)都报告了与这项发展中技术相关的令人担忧的事件。
现在,人工智能正在从零开始设计全新的、功能齐全的病毒。这是一项可能极其重要的科学突破,但同时也引发了紧迫的生物安全问题。
最新模型的能力每天都在给我们带来惊喜,但同时也变得越来越具争议性。
不过,如果说有一件事是确定的,那就是这仅仅是个开始,行业前沿的公司将继续开发旨在超越竞争对手、让公众惊叹的技术。
但面对如此多的模型可供选择,我们如何知道谁在AI大战中目前占据上风?
这就是Kalshi发挥作用的地方。通过让交易者把钱押在他们的判断上,它提供了每家公司胜算的真实写照,价格和概率每天都在变化。
要点总结:
- Anthropic的Claude AI最近又一次挺过了监管风波,在美国政府解除对Fable 5和Mythos 5为期两周的禁令后,继续保持领跑地位。但令人尴尬的黑客事件可能会改变赔率。
- Grok是主要竞争对手。在SpaceX收购AI编程工具Cursor后,其作为'2026年最佳AI'的价格已升至14.9美分。
- ChatGPT目前排名第三,尽管其在5月份月活跃应用用户已突破十亿。GPT-5.6的分阶段发布是在美国政府网络安全担忧导致延迟之后进行的。
- Gemini的势头有所放缓,交易者们正等待谷歌的AI能否在12月之前重新夺回多模态领域的王座。
业内人士一直在分享他们对人工智能发展方向的看法,但正是预测市场最清晰地反映了我们对这些最新最强大的机器人天才的真实想法。
如需了解Kalshi概率的相关帮助,请参阅我们的赔率计算器。
2026年最佳AI领跑者解析
Claude (Anthropic) |
Anthropic 在经历了一两个月的混乱之后,依然是市场上无可争议的头号热门,展现出惊人的韧性。
6月9日,Anthropic 推出了 Claude Fable 5,仅仅三天后,美国政府就介入并发布了一项前所未有的紧急命令。
华盛顿方面以严重的网络安全担忧为由——担心外国对手可能利用该模型发动毁灭性网络攻击——禁止外国公民访问 Fable 5 及其超先进的姊妹产品 Claude Mythos 5。
Anthropic 的回应是暂时下线相关服务,但经过与新成立的美国人工智能标准与创新中心(CAISI)为期两周的密集安全审查合作后,美国政府于7月1日正式解除了出口管制。
With Commerce Secretary Howard Lutnick confirming that Anthropic’s new safeguards are "extraordinarily strong," traders have breathed a sigh of relief, locking Claude into its premium 69.6¢ slot (with a 'No' contract priced at 33¢).
奇怪的是,尽管有关于AI黑客事件的头条新闻,Claude的价格依然继续上涨。7月31日,Anthropic 证实其AI模型曾独立入侵了多家机构。
随后,在8月5日,有报道称 Anthropic 的 Mythos AI 曾独立制造虚假人类档案以诱导黑客攻击,随后又试图掩盖证据。
交易者们终于开始感到不安,纷纷抛售合约(或买入 ChatGPT),从而导致 Claude 目前在盘面上的价格。
ChatGPT(OpenAI)|'Yes' 27.4¢
OpenAI 的 ChatGPT 目前是 Kalshi 上的第二热门,目前排在 Claude 之后,并超越了 xAI 的 Grok。
一方面,消费者层面的数据令人瞠目:Sensor Tower 的数据显示,ChatGPT 在5月份的月活跃应用用户已超过10亿。此外,OpenAI 在8月透露,ChatGPT 广告的收入运行率已达到10亿美元。
然而,市场对 ChatGPT 相较于 Anthropic 的技术优势依然持高度怀疑态度。
鉴于 Anthropic 的监管纠纷,OpenAI 首席执行官 Sam Altman 确认,OpenAI 也应政府要求推迟了 GPT-5.6 的全面公开发布,目前仅限于经过严格审核的一小部分合作伙伴使用。
然而,OpenAI 也遇到了自己的黑客问题。上个月,它也承认部分失控的AI机器人曾入侵了其他公司的计算机系统。
在夏季,'Yes'份额价格为10.5¢('No'份额为89.7¢),交易者们当时释放的信号是 OpenAI 的主导时代面临巨大挑战。如今看来,那似乎是最佳买入时机,因为现在卖出的话你可以让本金翻倍。
Grok(xAI)|'Yes' 7¢
如果你在这个市场上寻找一匹黑马,那非 xAI 的 Grok 莫属。
Grok 4.6 于8月发布,同时 SpaceX 以600亿美元收购了AI编程初创公司 Cursor。这为埃隆·马斯克的 SpaceX 在AI市场上开辟了新的
Grok 在实时搜索和数学逻辑方面都排名靠前,但其价格在初夏跌至7¢(从5月的16¢下滑而来)。
这表明市场对Grok能否在12月31日这个市场结束前赶上领跑者持严重怀疑态度。
不过,随着SpaceX的Cursor动作,价格已回升至目前水平。交易者们正在关注这些收购动态,并据此为Grok的份额定价。趁价格还没涨得太高,赶紧入场吧。
Gemini(谷歌)| '是' 6¢
一段时间以来,谷歌的Gemini看起来有望成为今年的逆袭黑马,但此后势头已趋于平稳。
Gemini目前在榜单上位居第三,价格为6¢('否'合约为94¢)。不可否认,谷歌拥有扭转局面所需的雄厚资金和基础设施,但交易者们仍持谨慎态度。
除非谷歌像Anthropic那样,突然推出一款能够抓住公众想象力的惊喜模型,否则其概率很可能会维持在十几个百分点。
对于风险规避型交易者来说,94¢的'否'份额价格是一个极具吸引力的选择。如果你认为谷歌在Arena排行榜上要赶超Claude、在12月前实现登顶的差距太大,那么这份'否'合约是锁定收益的好方法。
黑马候选:Muse Spark、Qwen和Ernie
排在Kalshi榜单末尾的是开源模型和国际巨头。Meta的Muse Spark价格微薄,仅为1.0¢,阿里巴巴的Qwen为0.5¢,百度的Ernie则处于几乎不可能实现的0.2¢。
尽管这些模型代表着重大的工程成就,但预测市场确实对它们在12月31日前登顶人类偏好排行榜的机会持怀疑态度。
2026年顶尖AI模型公司排名
Kalshi提供了另一个预测市场,押注哪些公司将拥有顶级排名的AI模型。
谷歌(Gemini)和Anthropic(Claude)在这个市场上已经被判定为'是'。不过,你仍然可以对其他竞争者进行交易,包括目前的市场领跑者OpenAI(36%)。
Anthropic何时发布Mythos?
Claude或许正统治着排行榜,但Kalshi交易者们正在权衡另一个高波动性市场:Claude Mythos的发布。
自4月份其机密预览版泄露以来,Mythos的能力一直在科技行业引发震动。
该模型能够自主发现主要操作系统中的关键漏洞,因此被认为是一个巨大的安全风险。但随着7月1日白宫出口管制危机的解决,其推出时间表已彻底改变。
当Anthropic在6月9日发布Fable 5时,许多交易者原本预期市场会有赔付。然而,Kalshi澄清说Fable并不满足条件,因为真正的Claude Mythos 5仍然严格限制在Project Glasswing计划下精选的机构名单中。
随着商务部正式解除出口管制,Anthropic已表示,一旦最终部署协议达成,将计划扩大公众对Mythos级模型的访问权限。这让Kalshi交易者们纷纷忙于调整他们在日历上的持仓。
2026年12月1日前 | '是' 8¢ | '否' 93¢
尽管政府限制已经解除,交易者们对夏季商业版快速发布已变得极度悲观。12月前发布的合约价格已暴跌至8¢,反映出市场担忧后停电安全协议将使Mythos在企业审批环节中卡上数月。
2027年1月1日之前 | “是” 11¢ | “否” 90¢
6月初,这份合约还稳稳锁定在90¢。但随着Fable的发布,以及最近华盛顿方面的风波,价格骤然下跌。对于提前布局的交易者来说,这仍是一笔不错的价值投资,因为如果Anthropic借助新势头,在未来几个月内公开发布Mythos以提振即将到来的IPO估值,这些11¢的合约将会暴涨。
更多值得关注的AI预测市场
终极AI排行榜可能是Kalshi交易者的主要焦点,但还有许多其他相关的AI市场同样值得关注。以下是目前科技交易者可以选择的一些市场。
谷歌何时发布Gemini 3.5 Pro?
❌ 已结算:“否” | “2026年7月前” | “2026年8月前”
谷歌的旗舰产品发布日程是Kalshi上交易最活跃的发布日期市场之一。
在I/O大会上宣布Gemini 3.5系列后,谷歌发布了Gemini 3.5 Flash,但将其性能更强的Gemini 3.5 Pro模型留在了受限的内部测试阶段。
不久后,我们开始看到有报道称Pro因架构调优而面临开发延迟。交易者们试图精确预测谷歌的发布日期,但所有日期最终都以“否”结算。
本周最热门AI
我们还提供预测市场,追踪AI领域所有主要玩家的每周消费者采用率和使用量。
这个每周市场衡量的是原始使用份额,这也是为什么低成本API模型和开源发布常常能颠覆排行榜。
北京DeepSeek的开源使其在该市场中价格居高不下。在这个每周市场中,无需长期押注也能快速获利。
华尔街AI竞赛:交易即将到来的IPO
AI霸主之争已正式蔓延到华尔街。Anthropic和OpenAI都在6月初向SEC提交了保密的S-1招股说明书草案,为今年晚些时候可能达到巨额估值的公开上市做准备。
交易者正在押注下一个IPO预测市场,以及诸如2026年最佳AI这样的关键市场,试图抢先一步,准确预测公开上市公告的时间。
- OpenAI IPO时间: 尽管OpenAI表示没有固定时间表,市场目前更看好2026年末上市。10月1日前正式公告的合约目前定价24¢,但市场对11月前发布更有信心。
- 谁将率先上市: “谁将率先IPO”市场已成为一大焦点战场。Anthropic以93¢的价格成为热门人选,交易者押注其传统的公司架构将比OpenAI的模式更容易通过监管审查。OpenAI目前以13¢落后,处于劣势地位。
交易者们现在把这类市场当作科技股的替代选择。对于那些持有2026年最佳AI以及2026年科技裁员人数等市场合约的人来说,这些市场也极具参考价值。
密切关注监管更新前的任何突发新闻,因为最微小的传闻都有可能颠覆这些市场的价格。
2026年最佳AI是如何决定的?
任何时刻的最佳AI都带有一定主观性。不过,对于这个市场而言,胜者是由LM Arena排行榜的数据决定的。
在2026年12月31日登顶排行榜的AI将被评为年度最佳。至于其他模型在这一年中是否曾长期占据榜首,并不重要。
什么是LM Arena排行榜?
LM Arena排行榜有时也被称为Chatbot Arena,是由LMSYS Org(大型模型系统组织)开发的一个开源研究项目,该组织是加州大学伯克利分校的一个研究团队。
LM Arena排行榜旨在评估大语言模型(LLM)的表现,常被用来判断我们更偏好哪些模型。
用于确定该排行榜排名的数据来自真实人类偏好的测试,而非静态的自动化检测。正是这种真实世界的测试,使得该排行榜如今被广泛认为是衡量模型在日常使用中真实表现的最可靠指标之一。
LM Arena排行榜是如何运作的?
该排行榜使用人工评估方法来确定在任一时刻哪些AI模型最有用。这些众包数据的收集方式相对简单但非常有效。
- 第一步:人类会看到针对某个查询的两个答案,分别来自两个匿名随机选取的AI模型。
- 第二步:他们被要求投票选出自己更喜欢的答案,选项包括模型A、模型B或平局。
- 第三步:投票完成后,系统会告知该用户回答分别来自哪些模型。
随着回复的不断收集,平台会使用Elo评分系统来汇总这些信息。如果一个模型战胜了更强的对手,它的排名提升幅度会比战胜较弱对手时更大。同样,如果模型输给了一个较弱的对手,其排名也可能大幅下降。
由于该评分系统依赖于真实人类提出的提示词,这些提示词种类繁多、有时细节也很少,这意味着相比其他指标,它能更清晰地展现模型在实际应用中的真实表现。
该平台也被视为最新的人类偏好衡量标准,因为它会在新模型一发布时就实时更新。
Kalshi的AI预测市场是如何运作的?
与传统投资不同——传统投资是买入一只股票,并寄望它在多年后上涨——像Kalshi这样的预测市场允许你就具体结果进行交易。
二元结果:你购买“是”或“否”合约。如果你判断正确,每份合约将支付恰好1.00美元;如果错误,则支付0.00美元。
实时反应:与季度财报不同,这些市场会对突发新闻做出即时反应。这可能是像Meta突然发布新模型这样的重大公告,也可能只是埃隆·马斯克在X上发的一条新帖子这样简单的事情。
翻转策略:许多交易者打算在Grok(9.3¢)这样的模型上买入