斯坦福 Paper2Agent 登 Nature:把论文变成可调用的 MCP 智能体

斯
坦
福
团
队
(
J
i
a
c
h
e
n
g
M
i
a
o
、
J
a
m
e
s
Z
o
u
等
)
的
P
a
e
r
2
A
g
e
n
t
在
N
a
t
u
r
e
发
表
:
把
一
篇
计
算
类
论
文
及
其
代
码
库
自
动
转
成
M
C
P
服
务
器
,
任
何
兼
容
M
C
P
的
智
能
体
(
如
C
l
a
u
d
e
C
o
d
e
)
能
用
自
然
语
言
直
接
运
行
论
文
方
法
。
流
程
为
六
个
环
节
—
—
定
位
并
下
载
代
码
库
、
构
建
隔
离
环
境
、
扫
描
教
程
、
端
到
端
执
行
教
程
并
记
录
参
考
输
出
、
把
教
程
抽
成
参
数
化
工
具
并
由
测
试
器
验
证
、
装
配
成
单
个
M
C
P
服
务
器
;
工
具
只
有
在
产
出
文
件
出
现
且
数
值
误
差
在
3
%
以
内
、
图
形
感
知
哈
希
汉
明
距
离
小
于
2
0
才
算
通
过
,
每
个
函
数
最
多
重
试
6
次
。
以
A
l
h
a
G
e
n
o
m
e
为
例
:
约
4
5
分
钟
、
1
4
美
元
建
出
2
2
个
工
具
,
全
部
无
人
工
干
预
通
过
验
证
;
1
5
条
教
程
类
问
题
上
得
分
9
8
.
7
%
±
1
.
3
,
而
「
C
l
a
u
d
e
C
o
d
e
+
仓
库
访
问
」
为
8
2
.
7
%
、
B
i
o
m
n
i
为
3
7
.
3
%
;
1
5
条
全
新
问
题
上
1
0
0
%
对
7
8
.
7
%
;
3
0
条
开
放
式
问
题
上
8
2
.
7
%
对
5
6
.
7
%
、
7
2
.
2
%
。
规
模
测
试
覆
盖
1
0
0
篇
b
i
o
R
x
i
v
计
算
生
物
论
文
,
7
4
篇
被
自
动
「
智
能
体
化
」
,
5
9
9
个
候
选
工
具
中
5
9
3
个
通
过
验
证
;
单
次
查
询
0
.
2
0
美
元
、
1
.
6
分
钟
,
对
比
基
线
0
.
3
8
美
元
、
4
.
3
分
钟
。
代
码
M
I
T
许
可
,
可
作
为
C
l
a
u
d
e
C
o
d
e
/
C
o
d
e
x
的
s
k
i
l
l
安
装
,
A
l
h
a
G
e
n
o
m
e
、
S
c
a
n
y
、
T
I
S
S
U
E
三
个
预
置
服
务
器
已
跑
在
H
u
g
g
i
n
g
F
a
c
e
S
a
c
e
s
。
意
义
:
论
文
的
可
复
现
性
第
一
次
被
做
成
可
调
用
的
接
口
,
方
法
不
再
需
要
读
者
自
己
c
l
o
n
e
、
配
环
境
、
d
e
b
u
g
。
核验记录
Nature 页直读 citation_online_date=2026/09/16 与 datePublished=2026-09-16T00:00:00Z,标题为 Reimagining research papers as interactive and reliable AI agents;数字与流程经 MarkTechPost 报道交叉,GitHub 仓库 jmiao24/Paper2Agent(MIT)存在。98.7%/91.2% 等指标为作者自报、由两名人类专家评分(评分者间一致率 96.7%),无第三方复现。
← 上一篇MLPerf Inference v6.1 新增智能体基准:Vera Rubin NVL72 首测 3.7 倍于 GB300下一篇 →OpenAI 发布模型失准披露框架,一次交出六起事件报告