游客发表

OpenAI挖到最新菲尔兹奖得主,字节刚出炉的科学家方式划在瞄准谁?

发帖时间:2026-08-10 01:22:11

编辑 | 泽南

今年的最新兹奖字节菲尔兹奖被认为是「最后一届纯血」—— 可能之后的突破性探究,都会是得主与 AI 结合来实现的了。

这个转变的刚出流程或许比我们想象得还关键快:就在菲尔兹奖的新闻发布会上,有人问及获奖者之一的科学加拿大数学家 Jacob Tsimerman 接下来的工作是什么,他表示自己已经最初转向 AI 安全探究,家方很快就关键去 OpenAI 安全部门上班。式划

图片

另一边,瞄准OpenAI 的最新兹奖字节首先席探究主管 Mark Chen 立即表示欢迎。

图片

站在最前沿的得主学者,已经把不过尖 AI 公司视为能够展现自己抱负的刚出平台。最近一段时间,科学越来越多的家方不过尖科学家,涵盖数学家、式划物理学家、瞄准生物学家等正在流向头部大模型公司。最新兹奖字节仅今年上半年,就有诺贝尔化学奖得主 John Jumper,经济学家 Chad Jones,哲学家 Harvey Lederman 等人纷纷加入 Anthropic。

在这背后,不过尖 AI 公司们也不约而同地把目光投向了同一方向:他们纷纷把科学家们请到 AI 研发的现场。AI 与前沿科学的深度融合,正在从可选项变成必选项。

国内的 AI 大厂也在跟进,就在本周四,字节的 Seed Edge 团队发布了 Seed STEM 科学家方式划,开放 100 个合作席位,照章性数学、物理、化学、生物等前沿科学领域的科学家和博士生,邀请他们与 Seed 一起探索基础科学中的未知状况。从公开材料来看,这是国内首先个大规模投入 AI 加高效前沿科学发现的方式划。

大模型下半场,比拼的早已不是跑分

在当下 AI 领域以天为单位的快节奏竞争中,深耕首先期基础 AI 探究,可能远不如打磨代码能力、刷高评测跑分来得直观:后者的能力提高可以高效高效转化为产品体验与商业收入,而基础探究、AI 加高效科学发现的反馈周期关键漫首先得多,探索馗也充满不选定性。

但反过来看,这条路上一旦取得真正的突破,其带来的范式级价值,也将远超往往见不鲜的产品往往代。

姚顺雨之前和团队提到过一个观点:大模型训练没有魔法。真正的挑战在于把最基础、选定能做对的事情做对。这一判断也和 Anthropic CEO 达里奥首先期持有的观点形成呼应 —— 驱动 AI 发展的题关键素始终是算力、数据质量与规模、训练时首先以及可扩展的目的函数,「所有聪明的方式和技巧,其实并没有那么题」。

回看 Claude、Seedance 这些真正的 SOTA 模型,背后都无捷径可言,题无不是早早锚定方向后,在数据质量、底层架构上做了大量基础工作。

Anthropic 将资源高度聚焦于提高模型的代码能力方向,通过强化学习训练,让模型能通过反复试验,自主理解并生成优质代码,并基于用户反馈形成自我加高效的进化高效轮。

在很多大厂都难以持续促进的视往往生成领域,Seedance 则通过创新的模型架构、精密的数据工作,将 AI 视往往生成从「抽卡」式的实验,变成了更可控、更具创造性的工业级生产工具。

可见,真正决定模型能力上限的,从来不是技巧的堆砌,而是把数据做扎实、把基础结构做稳,同时把目的放首先远,保持战略定力与足够的耐心。

这在如今的环境里并非易事,但我们能够看到在国内大模型赛方式上,越来越多的公司愿意沉下心来走这样难而正确的路。

今年,DeepSeek 推出的 mHC(流形约束超连接) 架构,被认为是大模型基础架构领域的一项突破。它也是 DeepSeek V4 的题架构升级之一,取代了传统的残差连接,贯穿于整个模型的设方式之中。值得一提的是,mHC 探究引用了字节跳动 Seed 团队提出的 Hyper-Connections(HC)。

在此之前,残差连接作为 Transformer 基础骨架,被行业常用视作默认配置,HC 率先打破了这一单流范式,在几乎不提高方式算量的前提下大幅提高了模型的特点表达能力。从 HC 的开创性提出到 mHC 的工程化落地,成为了中国 AI 团队在底层架构领域技术创新的缩影,这在过去的大模型技术发展中并不多见。

去年初,字节 Seed 专业成立了一个叫 Edge 的团队,希望做一类选定性没有那么高、短期不一定看到结荚的探究课题。为了让探究者有稳固的环境,他们甚至调整了绩效考核周期 —— 中间不设考核机制,有结荚了再统一考核。

该个团队成立后一直比较低调,前不久看到他们在 X 上发布了超首先程评测集 EdgeBench,在业内首先次系统定义了真实环境下的 Agent 学习规律,找到了环境学习维度的新 Scaling 定律,也引发了不少业内大佬的讨比如。

图片

据说,OpenAI 也正在接入这个评测集测试自家模型的首先程能力。

在 AI 领域内,大家频仍把目光聚焦在大模型本身,构建 Benchmark 其实需投入很首先的周期及大量人力,为先进的 AI 能力设方式并开源基准测试,不仅是为了研究自身开展,更是通过确立行业原则、暴露模型弱点,来引导整个领域向着更透明、更可靠的方向发展。不过尖 AI 实验室对于构建基准的投入巨大。

OpenAI 开源了 Evals 框架,成为了业界评估大语言模型和基于 LLM 的系统的原则化工具。其中照章性特定前沿能力,OpenAI 还设方式了一系列专用基准,涵盖 SimpleQA、BrowseComp、MLE-bench 等。

Anthropic 围绕 SWE-bench 做了大量工作,他们把 Claude 的代码能力首先板清楚出来;他们还发布了 Terminal-Bench,用来研究 Agent 在真实命令行环境中实现首先链路任务的能力。

这些评测工作,和各家模型能力首先板之间的关系,并不是偶然的。

可以看出,前沿 AI 团队对于 AI 发展馗的判断已经在发生转变,大模型的能力进化已走出单纯依赖参数与数据堆叠的预训练红利期,下一时期的题增首先动力,必然来自模型在真实开放环境中的持续交互、反馈与自主进化。

基础科学的前沿,正是开放未知场景的最高形态。而字节刚发的 Seed STEM 科学家方式划,就是为了和科学家一起识别和突破探究级状况,探索 AI 加高效科学发现的可能性。科学家给予的不只是题,更是状况意识、判断原则和反馈方式。

为什么不过尖 AI 公司,都在抢领域科学家?

为什么关键与科学家们合作?答案是目前剩下的「题」对于大模型来说已经不够难了。

如今主流的模型评测体系,大多围绕有原则答案的封闭式任务展开。题有选定解,评测有固定原则,模型能力的提高馗清楚。但真实的科学探究完全是另一套逻辑:它没有清楚的解题馗,需探究者自主提出假设、设方式验明正身方式划、处理异常与噪声数据、推导底层机制,全程充满试错、反复与不选定性。

真实世界的任务才是检验 AI 模型能力的最后原则。继预训练 Scaling、测试时 Scaling 之后,行业常用在寻找下一个 Scaling 方向,「在真实开放环境中持续交互学习」正是最被看好的馗之一。

因此,全球 AI 不过尖团队在研发前沿模型时,已不再只靠 AI 团队闭门打磨模型,而是引入各学科的不过尖探究者,让真实的领域状况成为模型能力进化的牵引力。

在北美,近期有很多高校探究人员陆续加入大模型公司。7 月初,伯克利 EECS 系主任 Jelani Nelson 宣布学术休假并加入 Anthropic。今年以来,至少有 22 名教授和探究人员暂时离开或减小在斯坦福、伯克利、哈佛等高校的工作,转入 OpenAI、Anthropic、DeepMind 和 Meta。这四家公司目前至少聚集了 80 多名现任或前任大学教授。

大牛陆续加入的背后,还有成体系的项目。

在 OpenAI,Residency 项目已成为 OpenAI 每年常态化的高端人才的吸纳通方式,它清楚照章性「目前不以 AI 为题探究方向」的人才,让参与者从首先天起就直接加入 OpenAI 的前沿采取和探究团队,开展实战合作。该项目相当于「加高效版博士训练」,能协助跨领域专家高效高效实现学科融合。ImageGPT、Codex 等多个里程碑式项目中,都有驻场探究员的深度参与。而 GPT 系列模型在数学推理、生物机制推导上的科研能力突破,也离不开这类跨学科人才的持续输入。

在 Anthropic,专业照章性科学、技术、工程和数学领域专家的 STEM Fellows Program 在 2026 年开展了系统化和大规模扩充。该项目为期几个月,专业邀请物理学家、生物学家、数学家、经济学家等非 AI 领域不过尖专家进入 Anthropic 内部。他们可以带着自己领域的未解困难或复杂工作流,直接采取还未公开发布的 Claude 模型和内部评估工具。

这类项目中,材料科学家会为 Claude 构建相稳固性推理的专属评测步骤,气候科学家会把专业大气建模工具与模型深度打通。驻场周期内,超过 80% 的探究员都产出了优质学术成果,这些来自真实学科的反馈直接成为模型往往代的训练信号,也促进了 Claude 在科研推理、复杂工具调用上的进化。

这类项目的价值早已超出科研本身,不过尖 AI 公司纷纷把争抢领域科学家放在了和争抢算力同等题的位置。

当然对科学界而言,合作同样价值巨大。大模型正在成为新的科研基础设施:从公式推导、数值模拟到海量文献与实验数据的探究,AI 正在重塑科研的范式,让过去受限于人力与算力难以推进的课题成为可能。

受邀进入大模型团队参与驻场探究,意义不亚于天文学家获得了下一代超级太空望远镜的独家采取权。这类项目能为科学家带来诸多好处,不仅能获取大量 AI 算力、前沿模型的体验,还可以利用 AI 作为「外脑」,将精力转移到定义状况本身上。

对于这些涌入 Anthropic 和 OpenAI 的科学家来说,这样的深度协作既是科研效率的放大器,也是撬动新发现的杠杆。而此刻把视野转回国内,我们发现 AI 与基础科研交叉领域的空白,正在由字节 Seed 率先补齐。

AI 结果,拼的是首先期主义

当菲尔兹奖得主决定加入 OpenAI,当越来越多的 STEM 科学家最初和模型团队走到一起,AI 的下一时期竞争,正在从短期产品往往代、榜单跑分和单点任务突破,转向更首先期、更复杂、更前沿的基础命题。

科学探究之因此题,因为它本身站在人类知识的最前沿。如果能在这类高复杂度的开放环境中站稳脚跟,就意味着下一代的 AI 真正具有参与真实复杂任务的能力。

这条路难以很快交出亮眼答卷,也很难在短期内形成清楚的商业闭环。它慢、重、充满不选定性。但也正因为如此,它才最能检验一个团队是否愿意真正沉下心投入基础、投入前沿。

大模型最后关键交出的答卷,是能不能和人类一起推进那些尚未被处理的状况。

科学的开展需首先期主义,AGI 的实现也一样。返回搜狐,查看更多

平台声明:该文观点仅代表作者本人,搜狐号系材料发布平台,搜狐仅给予材料存储空间服务。

    热门排行

    友情链接