Performance, Failures, and Oversight of a Large Language Model Agent for Clinical Data Analysis: Evaluation Study

Yilan Wu, Dun Jack Fu, Yukun Zhou, Siegfried K Wagner, Pearse A Keane

Open source

DOI
10.2196/99597
Published
2026-09-08
Container
Journal of Medical Internet Research
Publisher
JMIR Publications Inc.
Open access
unknown

Credibility signals

uncertain Score 64/100 under policy 1.0.0. This is a metadata assessment, not a judgment of the paper's conclusions.

Show all credibility signals

Cite this work

BibTeX

@article{allodium:10.2196/99597,
  title = {Performance, Failures, and Oversight of a Large Language Model Agent for Clinical Data Analysis: Evaluation Study},
  author = {Yilan Wu and Dun Jack Fu and Yukun Zhou and Siegfried K Wagner and Pearse A Keane},
  year = {2026},
  journal = {Journal of Medical Internet Research},
  doi = {10.2196/99597},
  url = {https://doi.org/10.2196/99597}
}

RIS

TY  - JOUR
TI  - Performance, Failures, and Oversight of a Large Language Model Agent for Clinical Data Analysis: Evaluation Study
AU  - Yilan Wu
AU  - Dun Jack Fu
AU  - Yukun Zhou
AU  - Siegfried K Wagner
AU  - Pearse A Keane
PY  - 2026
JO  - Journal of Medical Internet Research
DO  - 10.2196/99597
UR  - https://doi.org/10.2196/99597
ER  - 

APA

Wu, Y., Fu, D. J., Zhou, Y., Wagner, S. K., & Keane, P. A. (2026). Performance, Failures, and Oversight of a Large Language Model Agent for Clinical Data Analysis: Evaluation Study. Journal of Medical Internet Research. https://doi.org/10.2196/99597

Source records