新警察故事
小模型赢了GPT-5.5!这家初创公司有点东西_我的网站

A | 骑士连续完成重磅操作!在通过先签后换4年8800万拿下佩顿-沃特森后,名记Shams又曝出后续交易,骑士又将交易扩大到5方顺利得到火箭旧将“白魔”惠特摩尔,而骑士之所以能够在错失詹姆斯后连获沃特森+白魔逆袭口碑,哈登降薪+等待立了大功,让骑士如愿打造出豪华争冠五虎,全新14+3名单也出炉。 五方大交易拿下沃特森+白魔 据ESPN名记Shams报道,骑士、快船、掘金、奇才和黄蜂达成5方大交易。

B |
骑士得到:惠特摩尔+沃特森;
快船得到:斯特鲁斯;
掘金得到:骑士2031年的首轮签+2032年国王的次轮签+朱利安里斯;
奇才得到:特雷-曼恩+2027年76人的次轮+部分现金;
黄蜂得到:施罗德。
在众多由前 Google DeepMind 员工创办的初创公司中,Inherent 此前获得的关注相对较少。上赛季他场均14.6分4.9板2.1助,三分命中率达到41.1%,同时拥有出色的防守尺寸和运动能力,23岁的年龄,又不需要大量球权,放在哈登和米切尔身边几乎就是最理想的3D锋线。骑士过去几年真正缺少的就是这种三号位,别看首发仅更换沃特森一人,骑士五虎防守端却明显迎来大升级。
C | 白魔又是一笔低价刮彩票 惠特摩尔则属于另一种类型的补强。他只有22岁,身体天赋和自主进攻能力一直非常突出,火箭时期就多次展现过连续得分能力,上赛季由于右肩深静脉血栓问题提前报销,只为奇才出战21场,场均9.2分2.8板,这也是目前最大的风险,但骑士付出的核心筹码只是曼恩+次轮,风险完全能够接受。如果白魔恢复健康,他可以直接成为第二阵容的锋线得分手,尤其哈登擅长给运动型锋线创造轻松得分机会,惠特摩尔的空切、转换和冲筐能力都有机会重新被激活,打出来就是捡漏,打不出来损失也有限。不过,与那些资金更加充裕、却还没有拿出太多实际成果的竞争对手相比,这家总部位于伦敦的团队如今已经开始展示自己的研发成果。 哈登降薪+等待立了大功 而骑士队之所以能够顺利完成补强,哈登无疑是头号功臣。这家英国初创公司仅在以 5,000 万美元(IT之家注:现汇率约合 3.37 亿元人民币)种子轮融资走出隐身模式几周后,就宣布推出新的 AI 智能体 Faraday。哈登此前主动跳出2026-27赛季4230万美元球员选项,希望与骑士重新签下一份多年合同,预计会明显降薪,更重要的是,他没有催促球队先解决自己的合同,而是愿意继续等待,让管理层把薪资空间优先拿去补强锋线,这才给了骑士连续操作的空间。

D | 据Brett Siegel统计,交易完成后骑士触发硬帽,还剩约2900万美元薪资空间留给哈登。 全新14+3争冠阵容出炉 按照哈登最终续约计算,骑士全新14+3框架出炉,预计首发五虎为哈登+米切尔+沃特森+莫布里+阿伦。该公司表示,在一项特定任务中,Faraday 击败了规模更大、知名度更高的 AI 模型:在事先不知道答案的情况下,自主复现已发表科学论文中的研究结果。如果考虑到 Inherent 更宏大的目标 —— 打造能够发现全新科学知识,而不仅仅是验证已有研究成果的 AI,那么复现论文的能力听起来似乎只是一个“小把戏”。

E | 其余9份正式合同为:梅里尔、克雷格-波特、普罗克特、米利克-托马斯、惠特摩尔、杰伦-泰森、海佐尼亚、汤姆林和托马斯-布莱恩特。3份双向合同:特里斯坦-埃纳鲁纳、莱利-米尼克斯、欧内斯特-乌德。但 Inherent 联合创始人兼首席科学家 Edward Hughes 表示,论文复现本身也是人类科学家的标准训练方式。不仅首发完成针对性补强,替补还增加惠特摩尔、海佐尼亚和布莱恩特等人,锋线天赋和运动能力相比上赛季明显升级,又一次降薪的哈登也将再度向冠军全力发起冲击。“很多博士生实际上都是从这件事开始的。”Hughes 告诉 TechCrunch,击败其他 AI 系统并不是重点,真正重要的是 Inherent 如何做到这一点。

F | 他说:“对我们来说,最有意思的并不是击败那些前沿智能体的结果 —— 当然,我们对此也很高兴,而是我们构建这个系统的方式。

G | ”真正值得投资者关注的是,Faraday 在与 Anthropic 的 Claude Opus 4.8 和 OpenAI 的 GPT-5.5 进行比较时,所依赖的却是一个规模小得多的模型 Qwen 3.6,仅拥有 270 亿参数。这两个对手都是规模庞大的前沿 AI 系统。简单来说,“参数”可以作为衡量模型规模的一个指标,通常也与模型的训练成本有关。此外,Inherent 对 Faraday 的成功标准也并不只是准确率。除了复现科学研究结果之外,公司还希望 Faraday 展现出所谓的“研究品味”,也就是能够判断哪些实验值得进行,以及应该如何合理设计这些实验的能力。

H | 教会 AI 掌握这种难以量化的“品味”并不容易,这也是强化学习发挥作用的地方。强化学习是一种训练 AI 的方法,它并不是把一套明确的规则直接告诉 AI,而是根据最终结果对 AI 的行为进行奖励,从而让系统逐渐学会采取更有效的行动。相比主要通过学习科学研究本身的流程来训练智能体,Inherent 更依赖这种基于奖励的训练方式。

I | 公司希望这种方法能够更好地泛化到长期目标,即让 AI 智能体具备参与多个科学领域研究工作的能力。

J | Hughes 表示:“我们始终以打造 AI 科学家智能体、赋予智能体研究品味这一北极星目标为指导。”这一理念也影响了 Inherent 决定不开发哪些产品。例如,公司没有选择自行开发编程工具,而是让 Faraday 使用 OpenAI 的 GPT-5.5 Codex。这与人类科学家的工作方式类似 —— 科学家通常会利用现成的软件工具,而不是把所有工具都从头开发一遍。

K | Inherent 还试图避免打造那些只会迎合用户、告诉用户想听什么的 AI 智能体。Hughes 表示,公司希望打造的智能体更像他最喜欢的那类队友:他们会回来告诉你:“我对这个问题产生了兴趣,于是自己去做了这些实验。你觉得这些结果怎么样?”这种协作理念同样体现在 Inherent 的公司运营方式上。目前公司约有 12 名员工,全部在伦敦国王十字区的一间办公室里线下办公。国王十字区曾经是一个较为破败的伦敦街区,但随着 Google DeepMind 在当地的发展,如今已经成为全球最重要的 AI 创新中心之一。Hughes 表示:“我们相信,伦敦就是最适合发展的地方。”Hughes 对伦敦高度密集的 AI 人才资源非常看好,但与此同时,他也加入了要求英国取消“竞业休假”(garden leave)制度的呼声。所谓“竞业休假”,是英国职场中较为常见的一种做法。员工离职后,公司可以要求他们在数个月内不得加入竞争对手或创办竞争企业。美国研究人员通常不会受到类似限制,这也让美国初创公司在招聘那些刚刚离开上一份工作的 AI 人才时拥有一定的先发优势。Hughes 告诉 TechCrunch:“这是我个人的看法,并不代表公司的立场,但我确实受到过竞业休假的影响。”最终,Hughes 找到了绕开这一限制的方法,并与另外两名前 DeepMind 员工以及第四位联合创始人共同创办了 Inherent。

L | 而这家初创公司目前也没有放缓发展的迹象。

M | Inherent 计划在今年年底前将员工人数扩大至“大约 20 至 25 人”。考虑到公司同样在布局世界模型,再加上 Demis Hassabis 出任新职后,一些 DeepMind 员工的未来去向出现不确定性,Inherent 正在进行的大规模招聘,或许会让它成为考虑离开 DeepMind 的员工颇具吸引力的新去处。

N |
Current article:http://bqphm.chuanshaonianmokuanchouzhei.sbs/e37a9/20260826/1365363.html
Published on:20:02:09








