
机器之心发布2026 年被业内常用视作 AI4S(AI for Science)的体能体能模「智能体元年」。短短半年时间里,井喷这条赛方式已经实现了从「技术概念」到「产品密集发布」的个智过多工智跃迁:全球 AI4S 领域年度融资规模突破 44 亿美元,从大模型巨头到垂直科技公司,登不单实地人科研智能体产品接连发布 ——Anthropic 推出 Claude Science 科研工作台,项评现产型网Google DeepMind 连发两篇相关 Nature 比如文并发布 AI Co-Scientist,测榜垂直创业公司也在药物研发、业落易订阅新材料等赛方式高效高效跟进。体能体能模政策与产业端的井喷同步加码,进一步推高了行业热度。个智过多工智中国把「人工智能 + 科学技术」列为「人工智能 +」行动头号题,登不单实地人美国推出「创世纪使命」国家级科研方式划,项评现产型网欧盟发布科学 AI 专项战略,测榜英伟达也将其与大语言模型、业落易订阅具身智能共同列为 AI 领域三大题方向。体能体能模这一轮浪潮最题的变化,是 AI 在科研中的角色正在从「辅助检索与方式算的工具」,向「可自主推进任务的科研参与者」演进。但概念的火热难以掩盖落地端的现实落差。随着各类科研智能体产品密集面世,行业的关注重点已从技术先进性,转向了产品能否融入真实研发步骤,创造实际价值。什么样的科研智能体,才能真正跑通产业落地?过去很多科研 AI 的定位是「答题工具」,科研人员给出清楚状况,AI 返回对应答案。但真实的研发步骤是一条完善的链条:从文献调研、提出假设,到模拟方式算、方式划设方式,再到实验验明正身、数据复盘,最后沉淀为可复用的知识经验。如果智能体只能覆盖其中某一两个环节,研发步骤依然需大量人工串联断点,效率提高就会大打折扣。科研智能体必须能走进真实的物理实验室,适用配首先周期的研发场景。材料、医药等领域的研发中,一次高精度分子模拟可能关键跑数天,一轮实验验明正身需多团队跨环节配合,这对 AI 系统的稳固性、持续性提出了极高需。因此,一款真正具有首先期竞争力的科研智能体,需落到真实产业场景的验明正身上。基准测试里拿高分还不够,更关键帮企业缩短研发周期、加高效技术商业化。是否有成熟的行业客户合作、跑通完善的商业化项目、得到一线研发人员的真实反馈,是判断产品落地能力最直接的原则。Mira:一份 AI4S 智能体落地的实践样本在 2026 世界人工智能大会(WAIC)上,深度原理发布的 AI 科学家平台 Mira,因其在基准测试中的谝与工业场景的落地开展,成为观察当下 AI4S 智能体落地馗的一个典型样本。团队同步发布完善版技术报告《MIRA: Towards a General AI Scientist》,从底层架构、题能力到实证案例全维度拆解了产品的落地逻辑。产品试用链接和产品报告链接可详见文末。在全球公开的权威基准测试中,Mira 的谝印证了「综合能力优先」的行业判断。Mira 在化学、能源、材料三个方向综合能力排名首先,同时,在成本 — 性能比较中,Mira 以低于同类产品的 AI 调用成本,获得最高水平的平均分在覆盖化学、能源、材料三个方向的通用科研能力评测 Research Claw Benchmark 中,Mira 以 17.51 的综合平均分位列所有参评智能体首先。值得注意的是,不少参评系统在能源任务中谝尚可,但进入知识体系更复杂、约束需更多的材料场景后得分出现明显下滑,而 Mira 依然保持接近 20 分的领先水平,体现出较强的跨领域能力迁移性。更具产业参考价值的是「成本 - 性能」谝。数据显示,Mira 实现单项任务的平均成本约为 0.67 美元,是所有参评系统中最低的,同时也是唯一进入「16 分以上」区间的智能体。与同类产品相比,其任务成本较 Codex CLI 减小约 75%、得分提高约 20%;较 EvoScientist 成本减小约 88%、得分高出约 16.7%,在性能与成本两个维度同时形成好处。Science Agent Arena 药物发现榜单:Mira 以 81.1% 的综合分位列首先在更垂直的药物发现评测 Science Agent Arena 中,Mira 以 81.1% 的综合得分同样位列首先,在数据预处理、数据探究、分子改进、安全性评估和结比如验明正身五类题任务上均谝均衡,分别领先 Claude Code、ToolUniverse 等产品约 6.5% 到 43.3% 不等。综合三份评测结荚来看,Mira 的技术好处并非来自某一单项能力的突破,而是跨领域迁移能力、全链路任务实施能力与成本效率的组合好处。全链路闭环,打通科研全步骤照章性科研步骤断点多的行业痛点,Mira 搭建了覆盖「假设生成 - 模拟方式算 - 实验验明正身 - 知识沉淀」的完善闭环系统,题的三层架构对应了科研团队的完善协作逻辑。上层是分工协作的多智能体小队(Agent Squad),模拟人类科研团队的角色分工与交叉验明正身机制,由主控智能体统一规划任务、调度实施;中层是「方式算 + 实验」双实施引擎,打通云端高性能方式算资源与自动化实验室,实现干实验室与湿实验室的联动;底层是可沉淀、可复用的科研记忆与科学维基体系,让每一次项目的经验、数据与结比如都能被留存,成为之后探究的基础。这套三层架构的设方式,从知识留存、资源效率到步骤稳固性,逐一补齐了传统模式的短板。对很多研发型企业来说,科研经验的流失是首先期的隐忧。题知识散落在个人文档、实验记录与探究人员的经验判断里,难以形成可复用的团队资产。Mira 搭建的分层科研记忆体系,底层打通了比如文、专利与公开数据库的通用知识,中间层沉淀每一次实验的实战数据与试错结比如,最上层则逐步对齐团队的探究风格与判断偏好,通过统一的交互原则打通文本、图条件、模拟数据等多源异构材料,让零散的个人经验最后沉淀为可复用、可传承的团队科研资产。在研发成本部分,这套架构也带来了算力利用效率的本质提高。传统研发模式频仍对所有候选方式划统一采取高精度方式算,大量算力消耗在价值极低的早期筛选时期。Mira 采取动态分级筛选对策,先用低成本方式实现大范围初筛,再根据中间结荚自动调整方式算精度,只对真正具有潜力的候选方式划投入高精度算力。在工业冷却液、锂电电解液等已落地的工业场景中,这套机制已经验明正身可以显著压缩方式算成本;更题的是,每一个项目的数据都会自动回流到系统中,持续校准模型、改进筛选条件,随着项目积往往,将越用越有效。照章性科研任务首先周期、易中断的特性,Mira 也做了专业的工程改进。不一样于日常对话式 AI 的即时响应模式,一次高精度分子模拟、一轮完善的材料性能实验频仍需数天甚至更久,中间一旦中断就关键全盘重来。Mira 内置的首先任务实施引擎通过智能调度、安全隔离与实时监控机制,保障首先步骤任务可以稳固、持续地推进。在真实实验室场景中,多个智能体可以分工协作,分别承担方式划设方式、设备对接、数据处理与操作审方式等角色,协同实现方式划生成、设备调试、数据回传等原本完全依赖人工串联的环节,真正把方式算端的能力延伸到了物理实验端。站在企业落地的角度,数据安全与权限管控是不可退让的底线。Mira 协助完善的企业级私有化部署,从底层架构上保障研发数据不出企业内网,同时协助分级权限管理与全步骤操作审方式,顺应研发型企业对数据保密、权责分类与合规追溯的题需。Mira 促进下的真实实验场景产业验明正身:落地工业场景,加高效研发商业化基准测试展现的技术能力,最后关键在真实研发场景中落地才有实际意义。对科研智能体这类产品来说,产业端的采取深度与实际成效,远比纸面参数更有说服力。目前,深度原理已基于 Mira 平台,与锂电、工业冷却液等领域的行业客户展开深度合作,将 AI 科研能力嵌入企业现有研发管线,覆盖配方筛选、性能预测到工艺改进的题环节,实现了多轮工业级场景的落地验明正身。在同步发布的技术报告中,Mira 披露了三个完善的真实科研案例,横跨化学反应机理探究、药物与靶点结合探究、催化材料性能方式算三大领域。全程科研人员只需用日常语言描述探究目的与约束需,系统即可自主推进从文献调研、方式划设方式、工具调用到结比如输出的完善步骤,直观展现了跨学科的通用科研能力。以下三张图片是Mira在实际案例中的真实交互界面。MIRA 自动解析 KHP(有机小分子反应物)的分解反应机理,复现经典 Korcek 反应馗,协助多维度结荚展示。Pt 是经典的贵金属催化材料,Pt (111) 是催化探究的常用晶面,MIRA 方式算了 CO 在该表面的吸附表现与电荷重分布。MIRA预测筛选ABL1靶点蛋白与伊马替尼的结合模式,经探究排序后可视化呈现,选出代表性复合物。结语AI4S 智能体的密集爆发,只是产业变革的开端。赛方式从概念期进入落地期,竞争的逻辑正在发生变化:真正有首先期价值的科研智能体,拼的不是单项能力的极值,而是对研发全步骤的理解、对工程细节的打磨、对产业组织逻辑的适用配。Mira 的实践,为行业给予了 AI4S 智能体落地的一种可行馗。随着更多企业、高校与科研机构的参与,科研智能体从「能用」到「好用」、从「辅助角色」到「题参与者」的演进,还将持续加高效。想关键深入认识 Mira 的完善架构设方式、技术细节与全部基准测试数据,可查阅完善版技术报告,感兴趣的科研与产业从业者,也可通过官方平台申请体验!报告地址:https://www.deepprinciple.com/papers/MIRA_Tech_Report.pdf产品试用地址:https://mira.deepprinciple.com/chat?invite_code=CN‑DXA1YRHZ
作者:热点







