PaperQA3, 150M+ 논문·특허를 읽는 Edison 과학 deep-research agent로 확장
NVIDIA AI Dev는 2026년 3월 27일 Edison의 PaperQA3가 1억 5천만 건이 넘는 연구 논문과 특허를 추론 대상으로 다루고 LABBench2에서 강한 성능을 냈다고 소개했다. Edison 글에 따르면 이 multimodal 시스템은 이제 figures와 tables를 읽고 수백 개의 시각 자료를 비교한 뒤 답변할 수 있다.
원문: ICYMI 🔬 @edisonsci is redefining scientific discovery. PaperQA3 can now reason across 150M+ research papers & patents and achieved industry-leading accuracy on the LABBench2 benchmark. See how AI accelerates deep research for science: https://edisonscientific.com/articles/edison-literature-agent 원문 보기 →
NVIDIA AI Dev가 X에서 밝힌 내용
2026년 3월 27일, NVIDIA AI Dev는 Edison Scientific의 PaperQA3를 소개하며 이 시스템이 150M+ 규모의 연구 논문과 특허를 추론 대상으로 다루고 LABBench2에서 강한 성능을 냈다고 밝혔다. 연구 보조 agent가 많은 시점이지만, 이 주장이 의미 있는 이유는 실제 과학 workflow의 어려운 부분이 텍스트만으로 해결되지 않기 때문이다.
연구자는 방대한 문헌 속에서 figure, table, 방법론, 수치 결과를 함께 비교해야 한다. 이런 시각적 근거를 읽지 못하는 agent는 가장 중요한 지점에서 한계를 드러낼 수밖에 없다.
Edison 글이 추가한 정보
Edison의 공식 글은 PaperQA3를 frontier multimodal deep research agent for science로 소개한다. 회사에 따르면 Edison Literature와 Kosmos는 이제 1억 5천만 건이 넘는 연구 논문과 특허에서 figures와 tables를 읽을 수 있고, 답하기 전에 수백 개의 시각 자료를 파싱하고 비교할 수 있다. Edison은 이를 기존 PaperQA2가 검색 결과에서 추출한 텍스트에 주로 의존했던 한계를 넘는 도약으로 설명한다.
성능 서술도 비교적 구체적이다. Edison은 업그레이드된 시스템이 관련 LABBench2 subset과 두 개의 Humanity's Last Exam 변형에서 현세대 frontier deep-research agent를 앞서는 수준의 결과를 냈다고 말한다. 또한 PaperQA3 기반 버전이 이미 자사 플랫폼과 API에서 제공된다고 밝혀, 연구실 데모가 아니라 실제 배포 가능한 제품 업데이트라는 점을 강조한다.
왜 중요한가
이 발표가 science와 AI tooling 모두에서 고신호인 이유는 multimodal reading이 연구 agent의 실제 능력 범위를 바꾸기 때문이다. 중요한 과학 정보는 chart, microscopy image, benchmark table, ablation plot, supplementary visual에 숨어 있는 경우가 많다. 이런 자료를 텍스트와 함께 읽고 추론할 수 있어야 진짜 문헌 조사 업무에 가까워진다.
더 큰 흐름은 deep-research 제품이 범용 웹 요약에서 도메인 특화 reasoning system으로 이동하고 있다는 점이다. Edison의 benchmark와 규모 주장이 실제 사용에서도 유지된다면, PaperQA3는 과학 assistant의 기준선을 한 단계 끌어올릴 수 있다. 단순히 관련 논문을 찾는 수준을 넘어, 문헌의 시각 구조 자체에서 근거를 추출하는 보조 시스템으로 가고 있기 때문이다.
관련 기사
수컷 초파리 뇌 16만6000개 뉴런 완전 지도…AI가 이은 1억2500만 시냅스의 최대 커넥톰
16만6000개가 넘는 뉴런과 1억2500만 개 시냅스 연결을 담은 수컷 초파리 뇌·중추신경계 지도가 완성됐다. AI로 전자현미경 절편을 3차원 신경망으로 복원한 이 데이터는 성별에 따른 회로 차이와 감각이 행동으로 이어지는 경로를 한 번에 비교할 기반이다.
Claude가 11일 만에 완성한 페르마의 마지막 정리 형식 증명
Anthropic의 Claude가 11일 동안 거의 자율적으로 작업하며 페르마의 마지막 정리의 첫 컴퓨터 검증 증명을 완성했다. 1,300만 줄의 Lean 코드로 29,500개 이상의 수학 정리를 증명한 이번 성과는 AI 지원 수학 형식화의 새로운 장을 열었다.
Meta, TRIBE v2 공개… in-silico neuroscience용 tri-modal foundation model 제시
Meta는 2026년 3월 26일 X에서 TRIBE v2를 공개하며 sight·sound·language에 대한 human brain response를 예측하는 foundation model이라고 설명했다. 논문과 demo는 zero-shot generalization, 70,000 voxels 규모 예측, 공개된 paper·code·model weights를 핵심 포인트로 제시한다.