最新消息
为您精选

汤森路透基于中国Qwen平台构建了Claude的替代方案。

经过阿什什·库马尔阿什什·库马尔 阅读时间:3分钟
汤森路透基于中国Qwen平台构建了Claude的替代方案。
  • 汤森路透正在将一些法律人工智能工作从 Claude 转移到 Thomson-1,这是其内部模型,通过对阿里巴巴开源 Qwen 进行调整而构建。.
  • 成本和控制是关键原因,Thomson-1 最初用于处理大量结构化文档审查,而不是完全取代 Claude。.
  • 此举引发了西方公司对依赖中国开放权重模型的安全担忧,尤其是在透明度、训练数据和潜在偏见方面。.

汤森路透已开始将其部分法律人工智能任务从Anthropic公司的Claude系统转移到Thomson-1系统。Thomson-1是汤森路透自主研发的人工智能模型,采用中国开源技术。此举有望降低成本,但同时也引发了另一个问题:在当前充满不确定性的行业环境下,使用中国人工智能解决方案的安全性如何?.

据《商业内幕》报道,Thomson-1 将接手 Claude 此前负责的文件审核流程。使用 CoCounsel 及类似产品的法律专业人士、会计师和各类公司可能不会感受到任何显著的操作变化。然而,最能说明问题的是,这家西方信息公司对这家经过内部重大调整的中国公司的能力表示信任。.

比克劳德便宜,这是有意为之。

费用在此案中扮演了至关重要的角色。首席技术官乔尔·赫伦向《商业内幕》解释说,Anthropic 和 OpenAI 等实验室收取的高额费用促使汤森路透考虑开发自己的模型。通过开发自己的模型,该公司可以利用其知识产权,而无需向第三方支付服务分包费用。.

Hron解释说,Thomson-1不会完全取代Anthropic。汤森路透在5月份加强了 合作 ,而CoCounsel目前主要使用Claude系统。该公司计划循序渐进地推进,仅在能够发挥自身专业优势的情况下才会将任务交给Thomson-1处理。初期,计划将Thomson-1的系统用于“大量结构化文档的审阅”。

Qwen“重新调整”的真正含义

Thomson-1 是 基于 Snowdon 模型构建的,而 Snowdon 模型是通过“重新调整”阿里巴巴的开源 Qwen 模型创建的。与通过 Anthropic 平台以封闭系统形式访问的 Claude 模型不同,Qwen 的开放权重可以下载和修改。

汤森路透和伦敦帝国理工学院的一个团队花费数月时间将Qwen移植到Snowdon平台,Hron称其“在伦理和政治上都已消除偏见,使用起来很安全”。Cryptopolitan Cryptopolitan 曾报道,西方公司越来越多地 采用外国的开放权重模型, 以更好地控制其人工智能堆栈。Hron还淡化了对阿里巴巴模型的依赖,称“我们与Qwen之间并没有什么必然的联系”。

汤森路透表示,Thomson-1 在其更广泛的评估套件中,性能与 Claude Opus 4.8 相当,并优于 GPT-5.5、Claude Sonnet 5 和 Gemini 3.1 Pro。目前,这些结果仍由公司发布,dent 的学术基准测试仍在进行中。已公布的分数显示,其表现参差不齐,并非完全领先。.

对使用中国开源模型的担忧

这些节省成本的同时也带来了政治隐患。Anthropic公司指责中国实验室非法“提炼”其模型输出结果,并敦促华盛顿方面采取限制措施。参议员汤姆·科顿也对美国公司使用中国开源模型的安全问题表示担忧。.

斯坦福大学的研究人员则看到了不同的问题。HAI公司的詹姆斯 ·兰迪 认为,可下载的模型权重并不能使系统完全可审计,因为用户仍然无法查看其训练数据或了解其所有行为。他称之为“开放分发”,而非开源。这使得客户难以独立dent。

基准 汤姆逊-1-大号 克劳德作品 4.8 GPT-5.5 克劳德·索内特 5 Gemini 3.1 Pro
斯坦福法律法庭 0.823 0.818 0.832 未发布 0.843
PRBench 法律硬 0.352 0.315 0.333 未发布 0.293
哈维法律代理基准 0.857 0.869 0.781 未发布 0.555
遵循以下说明 0.914 0.861 0.885 未发布 0.848
推理 0.684 0.737 0.589 未发布 0.748
编码 0.399 0.598 0.414 未发布 0.500
长篇背景 0.753 0.741 0.703 未发布 0.750
培训中使用的汤森路透专有内容 <10% 不适用 不适用 不适用 不适用
Claude Sonnet 5 被纳入汤森路透的整体性能声明中,但并未出现在该公司发布的数值对比图表中。指令跟踪测试结合了 IFEval 和 FollowBench;推理测试结合了 GPQA Diamond、Humanity's Last Exam 和 MMLU-Pro;编码测试结合了 SWE-Bench Pro 和 Terminal-Bench 2.1;长上下文测试结合了 Infinity Bench 和汤森路透内部基准测试。数据来源:汤森路透 2026 年 7 月 31 日发布的早期基准测试版本.

以月为单位的差距

由于中国模型发展迅速,企业愿意权衡利弊。斯坦福大学2026年人工智能指数指出,中美人工智能性能差距已“基本消除”。截至2026年8月21日,在Arena的文本处理排行榜上,美国领先模型得分1508分,中国领先模型得分1489分,差距仅为1.3%。阿里巴巴的Qwen3.8-Max得分为1481分。当性能差距仅为几分,而成本却相差悬殊时,文档审阅自然成为检验更经济替代方案的理想场所。.

 

最顶尖的加密货币专家都在阅读我们的简报。想 加入他们

常见问题解答

Thomson-1卫星基于什么技术制造?

据首席技术官乔尔·赫伦 (Joel Hron) 介绍,Thomson-1 基于 Snowdon,而 Snowdon 是 Thomson Reuters 通过“重新调整”阿里巴巴的开源 Qwen 模型而创建的。Thomson Reuters 与伦敦帝国理工学院的联合团队花了几个月的时间对该基础模型进行了改进。.

为什么汤森路透要建立自己的模型而不是直接使用 Claude 模型?

Hron指出成本是主要原因,并表示拥有自己的模型可以让公司利用自身的知识产权进行开发,而无需不断向外部人工智能实验室付费。Thomson-1并非旨在取代Anthropic;CoCounsel目前仍然主要依赖Claude。.

使用中国开源模型是否存在安全隐患?

是的。Anthropic公司指责中国实验室非法“提炼”其模型,参议员汤姆·科顿也对美国公司使用中国开源模型存在后门风险提出了质疑,而汤森路透则表示其改编后的模型是无偏见且安全的,bnb 也表示其通过美国云服务提供商运行此类模型。.

分享这篇文章

免责声明:本页面提供的信息并非交易建议。Cryptopolitan.com对任何基于本页面信息进行的投资概不负责。我们tron您在做出任何投资决定前进行独立dent /或咨询合格的专业人士。Cryptopolitan研究

阿什什·库马尔

阿什什·库马尔

阿什什·库马尔是一位拥​​有八年新闻从业经验的加密货币和金融记者。他主要报道加密货币市场、监管、 DeFi以及交易所生态系统的最新动态。他曾就职于Coingape、Todayq和Newsroompost等媒体。阿什什拥有印度管理学院加尔各答分校(IIMC)英语新闻专业的研究生文凭(PGDP)。他还采访过包括亚瑟·海耶斯、萧逸、奥斯汀·费德拉等在内的多位业内人士。.

更多…新闻