美初创建 AI 科研设施 测试发现 AI 模型缺实验室实操能力
6 小时前
美国旧金山初创公司 C5R 耗时 12 周建成 AI 驱动的跨生物学、化学、材料科学研究设施 Facility-0,推出可测试模型真实实验室工作能力的 SciUniverse 基准。测试发现前沿 AI 模型虽具备扎实的科学理论知识,但严重缺乏对物理现实的把握,频繁出现忽略样本冷冻状态、重复使用枪头污染样本、对敞开孔板涡旋震荡无视溶剂蒸发等操作失误。6 款前沿大模型参与 Level1 难度任务测试,这类任务熟练科学家数小时即可完成,但表现最优的 Claude Fable 5.1 Pass@1 通过率仅为 45.3%,且测试结果显示模型表现与推理成本未形成理想的正相关权衡关系。SciUniverse 基准共设 92 个 Level1 任务,覆盖样品制备、仪器控制、协议适配等多个科研核心环节。不同于其他主打全机器人无人自主实验室的行业动向,C5R 的系统将人类操作员纳入工作循环,可同时控制仪器和向人类下发指令,核心是评估模型能否将研究目标转化为人和机器可执行的实验步骤,并基于实验结果指导后续决策。当前 AI 自主科研的瓶颈正从计算转向物理执行,C5R 认为要让 AI 开展真正有用的科研工作,必须为其提供连接实体仪器与实验的物理工作空间,而非仅处理数字数据的系统。
美国初创给 AI 造了座实验室,发现模型缺的是实验室手感
DeepTech 深科技 / 麻省理工科技评论
体验专业版特色功能,拓展更丰富、更全面的相关内容。