Pith. sign in

Paper Citation Record · LEDGER

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models

As of 7 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2505.21409.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.21409 v1

Coverage vector

measured 61 of 61 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:32:50.913865Z

measured 61 of 61 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

61 of 61 outbound references displayed

  • verified exact7
  • verified fuzzy16
  • unresolved34
  • parse uncertain0
  • malformed identifier3
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 07e3c137-1528-4fef-8fd3-8ee46e10ba6c · outbound

This paper cites Ai hallucination report 2025, 2025.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Ai hallucination report 2025, 2025

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:59.261936Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.361753Z digest=sha256:557b3a73e3036c5473c00056887436e0cca37c2fb1a66c187bded82ad1344e07

Observation db2fe7a2-deb1-4651-8dfb-b2face751cf2 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:59.051641Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.403729Z digest=sha256:1c15aec211d4779816e68fb395305357c223d11764e3242584fdc8be59f37f90

Observation f386ed11-ef70-4e89-b24e-978300c46ede · outbound

This paper cites Balsiger, H.-R.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Balsiger, H.-R

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:58.749755Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.441750Z digest=sha256:25035ad52a96795becea002c9c36618cfec02b0e98f69fe6689d9123d5344611

Observation 09c7ceea-687d-4aab-841f-bb57859f6cac · outbound

This paper cites Interpretable Medical Diagnostics with Structured Data Extraction by Large Language Models.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Interpretable Medical Diagnostics with Structured Data Extraction by Large Language Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:46.520937Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:46.520937Z digest=sha256:6546211dcd301f26526db81ccd35f43b9fce5f46b1aa7f5fbc02e7737cf6825f

Observation 83d20bd7-532e-4110-9a9a-e04daa29a71b · outbound

This paper cites Borisov, K.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Borisov, K

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:58.517294Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.573788Z digest=sha256:ee7aeddedf4ec58db26de37f85d78de7c8fff4303af751389ce4f7503ec5b13b

Observation 5a333f0c-374c-44d2-8ba9-77c3db137e51 · outbound

This paper cites Buoncristiano, G.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Buoncristiano, G

Reference 6

Resolution
verified exact
doi, observed 2026-08-07T13:32:52.299853Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.625119Z digest=sha256:54fcb0dda93df6a540a71dc79ae88ee40cf2d546a162c2144367ba4c486e93d7

Observation 21db787f-3b63-472b-a4e7-8305a2cc2a45 · outbound

This paper cites Retrieve, Merge, Predict: Augmenting Tables with Data Lakes.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Retrieve, Merge, Predict: Augmenting Tables with Data Lakes

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:46.676074Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:46.676074Z digest=sha256:542a5e21fee903f1df32ce679eaea525afbacaa277bc0f66883275725a15deaf

Observation c3536f04-1b0a-4238-b799-71090ed6f0d8 · outbound

This paper cites Chang, X.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Chang, X

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:46.713259Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:46.713259Z digest=sha256:2f7324ef6851717854e8b389eafae3ea0625a02378dff1c00d292918a15c64d6

Observation 3de3a363-6858-4b22-bd6b-b316ecd28949 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:58.348469Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.750093Z digest=sha256:87692faf2a4c97dde5938d87301fe3a9c6f83c642e75ab1c2a507e433cacbada

Observation 539ed863-a7ca-4ace-bee0-2aa5697e9122 · outbound

This paper cites Chowdhury, D.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Chowdhury, D

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:58.162748Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.790043Z digest=sha256:ea5d9f7da0cc7ef7d97f7620861a9bf28462e8d85ac9e95654f3faa078c68e0c

Observation 6ebb0201-619e-4392-9502-01af1f438bcc · outbound

This paper cites Christophides, V.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Christophides, V

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:57.979386Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.827253Z digest=sha256:ddd35d862aecb8514e88eac6e378a2c60148a81bb7c1bc899c5423d9369303b1

Observation 9b9c87c3-d87c-4b35-8027-caa2498e6fc6 · outbound

This paper cites DeepSeek LLM: Scaling Open-Source Language Models with Longtermism.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models DeepSeek LLM: Scaling Open-Source Language Models with Longtermism

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:46.863793Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:46.863793Z digest=sha256:056bbdbfb31c4e8e42017ba76345d6b8f6a5ed26a9a547c56738eed6182bbf0d

Observation ccc29672-a4f9-4b2f-8a84-b3a2504f780e · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:57.759832Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.949789Z digest=sha256:56539d0a1a99eb7a6a2f3a75844313860da37f4d2c20eafbd191990a4e818d38

Observation df98fbb8-4333-4889-92e7-52e433d66a7b · outbound

This paper cites Elnashar, J.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Elnashar, J

Reference 14

Resolution
metadata mismatch
raw_fallback, observed 2026-08-07T13:32:53.373000Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:47.101631Z digest=sha256:cd2436222b22871cf0be945e80681722e1fdc693be38c8f8de71b8dfb8dce9d0

Observation 08c5554f-d8b2-4bf7-9373-0fa7ba694972 · outbound

This paper cites doi: https://doi.org/10.1016/j.accinf.2024.100715.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models doi: https://doi.org/10.1016/j.accinf.2024.100715

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.021461Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.021461Z digest=sha256:9efd6f8c4da9a7e594bde64d7a523897098742226bed97c24e4cb02cb3687a50

Observation 04667e40-d325-417c-be23-747a66d0cc9d · outbound

This paper cites Gemma: Open Models Based on Gemini Research and Technology.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Gemma: Open Models Based on Gemini Research and Technology

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.265524Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.265524Z digest=sha256:e39b3e92127ce9f2fd6a74e58ccb976531dd7bcdc430f803f2d96101bea70738

Observation 9f9808ce-865c-42ec-99b6-36da7c895896 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 17

Resolution
malformed identifier
no resolver link, observed 2026-08-07T13:32:47.190773Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.190773Z digest=sha256:5a530fb46bd8ba9177599c07e1af98c38d1fe5e5ddd61f4c370fa9af6b8e908a

Observation c55372c2-1aaa-46f7-83f6-e76287c276b7 · outbound

This paper cites Holtzman, J.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Holtzman, J

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:57.520675Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:47.392521Z digest=sha256:c84a921847c136a83ad87dbdf2251046b822ec684344dd5f2b3d5bd096572d95

Observation 5d98f628-b3f6-4e59-9b1d-f2e583163ebb · outbound

This paper cites Glavic, G.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Glavic, G

Reference 19

Resolution
verified exact
doi, observed 2026-08-07T13:32:52.010553Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:47.329050Z digest=sha256:5cced2178f37401d2814c81aebbf55940e3b235bccf134869b58aaaba8b60146

Observation 1f775385-3eef-40b5-8c87-0d5b04d31c49 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.559143Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.559143Z digest=sha256:7859ba8bc804429a3238df6e3f29981e90877bb2fe8e3b2718ff3588b60f7afb

Observation 7648c6b5-6d7b-4221-a791-bd58a2912d55 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.478077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.478077Z digest=sha256:e63aaa8c45d54824afddce3e3984f2e7b27dcdf1dbc1ecba6cf0b3925fd81965

Observation 8f6d8c24-3092-4da0-9839-90c9010a4939 · outbound

This paper cites Joshi, E.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Joshi, E

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:57.315874Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:47.778376Z digest=sha256:072af0933c5126d68d33bde951a58a8178d70c79a5eddbc65e122e5596b72daf

Observation f9bc9594-3b18-4636-a527-fdaf7ec9b2e3 · outbound

This paper cites Mistral 7B.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Mistral 7B

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.623703Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.623703Z digest=sha256:161411473192c42813ff08e74490b14d6cfd68c71ef67d7f520eb9e00472f8e5

Observation 07134d5f-adf9-4e76-b9f3-13bc1c1d65d0 · outbound

This paper cites Open-WikiTable: Dataset for Open Domain Question Answering with Complex Reasoning over Table.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Open-WikiTable: Dataset for Open Domain Question Answering with Complex Reasoning over Table

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.935799Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.935799Z digest=sha256:14ae1f1024b59875102e8106767fced14b310269dd4da8010073fd58496180ae

Observation 75b5265f-a770-4f4b-a55e-786304332ccc · outbound

This paper cites Kwiatkowski, J.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Kwiatkowski, J

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:56.853352Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:48.009190Z digest=sha256:1a9d01daca3fa9151bed34e57ba37f4c6c9c38bc4d80d81777b2e14f4df24e5c

Observation d849b4bf-17e1-4e8a-a17c-0de972ad3745 · outbound

This paper cites Kasneci, K.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Kasneci, K

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:57.073960Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:47.860715Z digest=sha256:a2d1714e1d94bcbfd500a82f271b0a580dc468b23491e3e60e3cfec3794ca5db

Observation 03ba16d3-e65d-4c38-9153-14c06ef62a34 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:56.626350Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:48.148989Z digest=sha256:c776e71d56815daaa18f865aabca896078ed7dfbba40f081f4db973226953efe

Observation ef23b778-e2ee-4279-ad2b-b2f3286ff541 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:56.448911Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:48.227184Z digest=sha256:a223e47a3e6c761600924225a3ad83d3afe4451e70853c0b808dd7262fd274fe

Observation 8047c490-164c-4fb7-b9dd-bd8b8615ba34 · outbound

This paper cites Lee, M.-W.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Lee, M.-W

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.066912Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.066912Z digest=sha256:5b4b7fac5b579e0671f5ebd74bda03f16604823e5c97baea86d857f6c4f4cd24

Observation d711835e-1280-4b37-bf07-db934020e050 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 30

Resolution
malformed identifier
no resolver link, observed 2026-08-07T13:32:48.433952Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.433952Z digest=sha256:df2c00c1c9e40f3a3b4e4badf9d485458b89bfdd50b27b520e30789601d5f865

Observation 72d61015-d0fe-4da7-b5f8-f561bddc1362 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.521291Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.521291Z digest=sha256:341231a20fa392fa3502563f8d887d770ef7433435da78703be8be467ac807d7

Observation 2b4bc770-9318-4679-b948-ecb4b16afbbc · outbound

This paper cites The Llama 3 Herd of Models.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models The Llama 3 Herd of Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.609492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.609492Z digest=sha256:4af4c7d6be853c5ae1564b9b18f9f51cab39c6182042c17c127dcf5590ab8c71

Observation 48022fea-0bfc-464d-a74c-451b1da09a50 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:56.258592Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:48.357266Z digest=sha256:66fb86709204dce4ef93b4775115533af5b59223944ccbc66e74e533d480c8e3

Observation 203906d0-b638-40db-9095-63eb26094c58 · outbound

This paper cites Papicchio, P.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Papicchio, P

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:56.093936Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:48.801222Z digest=sha256:197491c1e033a5bddbd02fb03a5ae6b2726af5b8fbe8084109871d1b31a5ee46

Observation 3ee3bf0f-0a9c-4f6c-b505-6038d0c9fac2 · outbound

This paper cites Pasupat and P.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Pasupat and P

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:55.903693Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:48.872971Z digest=sha256:1d47eb46fedf013f1ea78e1e757445c7fdfc3922fea60477980fa1c126f9d4bc

Observation 53540648-f8a8-493c-8e1f-b972c4829785 · outbound

This paper cites Semantic Operators: A Declarative Model for Rich, AI-based Data Processing.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Semantic Operators: A Declarative Model for Rich, AI-based Data Processing

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.953399Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.953399Z digest=sha256:32be1f6644aa9bd570e176f993c3e134d6d1d40225b3c20ef47414882c6bc87b

Observation 4bb87158-d39f-489e-8709-8416759587c1 · outbound

This paper cites GPT-4 Technical Report.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models GPT-4 Technical Report

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.702771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.702771Z digest=sha256:5445333179e241c86f301fb9c89a71361647bff970ad6a821257eb88f3d0c84f

Observation 7e8e62e6-53d7-420c-93e4-800ae8fd1de9 · outbound

This paper cites Petroni, P.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Petroni, P

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:55.477197Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:49.165647Z digest=sha256:c97e059631c82426f39cd16ee6b8b35de0a6c424760347cf22c8169276af3490

Observation 346a7052-f8cf-4ad8-902a-20fa0f0b3bd2 · outbound

This paper cites Qwen2.5 Technical Report.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Qwen2.5 Technical Report

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:49.327226Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:49.327226Z digest=sha256:bfe02f6ddcf911118e51b94fd7f1eed1205149a722d5ecb1288a7c94f5f2e457

Observation f39c3868-ee30-4293-9d2e-30ac78f08a52 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 40

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:55.007684Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:49.414543Z digest=sha256:265833ba9ac7bc3965ca1aa2f7fb26ddffd4aeb588d85f9fc5e18e808a47ea16

Observation 5617f6dd-a755-4803-bf1c-fa10dbccc684 · outbound

This paper cites Petroni, T.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Petroni, T

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:55.666087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:49.017964Z digest=sha256:171b68b97c2e2764016d3cea064cf52aac42a6f8c37db3f3f41e419b4034ce7a

Observation 214e4505-e483-4ee3-a224-aaef144eca94 · outbound

This paper cites Saparina and M.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Saparina and M

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:54.724969Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:49.681402Z digest=sha256:2471d000b8b304959ac4fe048d4984aeda5a6b8906d5645dec8f5daba345bd94

Observation f2628c97-c9c0-4033-b7cd-b815f8e49dd5 · outbound

This paper cites DocETL: Agentic Query Rewriting and Evaluation for Complex Document Processing.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models DocETL: Agentic Query Rewriting and Evaluation for Complex Document Processing

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:49.753681Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:49.753681Z digest=sha256:0795b2a294a34000d940e4d4263f09e0fad02b407a44da45574797f114a20f8d

Observation 5393e0aa-2a2f-4186-b6ab-b3c38c2baa2f · outbound

This paper cites Singhal, S.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Singhal, S

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:54.457394Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:49.844507Z digest=sha256:749552315a45c7e456bc5e230a4249cd9872238b76f836fcd3eabf1bd4110a5a

Observation 56c35b50-fe33-4bc5-ace0-e2f4d064e867 · outbound

This paper cites Stuhler, C.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Stuhler, C

Reference 45

Resolution
verified exact
doi, observed 2026-08-07T13:32:51.146841Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:49.922990Z digest=sha256:ac82c0e4536f14c27c6b2e49ea160384a9dffcdbbcc65061a02b8e750335441d

Observation 31cc0abf-f788-4a7e-8436-331998aaef12 · outbound

This paper cites Saeed, N.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Saeed, N

Reference 46

Resolution
verified exact
doi, observed 2026-08-07T13:32:51.625148Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:49.511762Z digest=sha256:f06c11baee938a3f4a32053f72b57b5bcbe6abcc80ff00cf1c62ac75c9674964

Observation 462e6e3c-9e7f-4112-be47-7ce49f70b95c · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 47

Resolution
verified exact
doi, observed 2026-08-07T13:32:51.376941Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:49.580285Z digest=sha256:3e9f78cfd2a102f4be8dc503b518bab92eb8ef5891119cc212e8856a535c9015

Observation f584738f-6c6d-449e-bf4f-c33a73286a87 · outbound

This paper cites Truhn, J.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Truhn, J

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:32:54.214399Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:50.181882Z digest=sha256:bbd7ef27300abcdad1ee2191c5aa29400b160d068b7b0a7882ec585f03239d2d

Observation acbd60b6-dba9-4d11-8652-d52550417321 · outbound

This paper cites Measuring short-form factuality in large language models.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Measuring short-form factuality in large language models

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.289751Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.289751Z digest=sha256:89d7cf663ffbaf013ae63119b73a944a7605d980ae47a91ac84c54003ed632bb

Observation ffa750af-20cd-4e63-9098-d18d57002d8a · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 50

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:53.944357Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:50.376486Z digest=sha256:d1061a0bd239ec08fa0053b46e3e5ed60e8984f9f7ee78f785b66fa9d79f03c8

Observation 80ac46d7-739e-4dfd-a43a-8510c0dbccc0 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.438462Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.438462Z digest=sha256:74064d3e8984c7f415f60618f79027287e985c39d867ca1e13b27f0a6b183a07

Observation fa26c866-5deb-493d-8ea9-74b2814f7e04 · outbound

This paper cites YAGO 4.5: A Large and Clean Knowledge Base with a Rich Taxonomy.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models YAGO 4.5: A Large and Clean Knowledge Base with a Rich Taxonomy

Reference 52

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:32:52.885759Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:50.036801Z digest=sha256:dd3dc39c76becc7396cf036fe087154e15c829cbeeefcafe5e51e3abdf3964c6

Observation 51a3bf34-1a99-41c8-be65-de9f2fc3be9c · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 53

Resolution
malformed identifier
no resolver link, observed 2026-08-07T13:32:50.108142Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.108142Z digest=sha256:7e52d2e6d90508892ec2d61624d8dd8899b5d11b3fe7a0d7bbca0e02cfb0d54f

Observation 1f7e146c-038d-4741-8944-43da98534dda · outbound

This paper cites Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.822133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.822133Z digest=sha256:a41302202d82aedd909e541c7ca92d978ff697bc6097c42dc7f15ef08bf96ccd

Observation 85c57c1d-5f7a-4778-b8c9-00cb62d2b7bc · outbound

This paper cites bird”, “galois.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models bird”, “galois

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.913865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.913865Z digest=sha256:cf1797d3d5ebe497ef08540880cb4b40278bf37bfd0ed9b5579fff8c78be0ca4

Observation c30f6445-753b-4c35-bd49-80e5b3e8ccc1 · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 58

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:53.698539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:50.566418Z digest=sha256:aaf6ee71089cd2c830cf823d860dc1f9a57a0fcd132156e39218a922b9080765

Observation 6bff2db9-7609-4480-b209-367f9cc1daba · outbound

This paper cites TableLLM: Enabling Tabular Data Manipulation by LLMs in Real Office Usage Scenarios.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models TableLLM: Enabling Tabular Data Manipulation by LLMs in Real Office Usage Scenarios

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:50.689286Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:50.689286Z digest=sha256:f68ae3f2f1b1495d3b7fee366401700af08383d922246d343ce6b10f0f8188ab

Observation 88eec023-3341-49c6-969a-3536460f28ae · outbound

This paper cites an unresolved cited work.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Unresolved cited work

Reference 2020

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:32:55.258363Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:49.254197Z digest=sha256:e8ee0d5d54f8208725644383ceea06b0cbaba59c8b2914ad3b6969b05d0293cc

Observation c5c90338-bdf0-448d-867b-c46c29e78773 · outbound

This paper cites TruthfulQA: Measuring How Models Mimic Human Falsehoods.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models TruthfulQA: Measuring How Models Mimic Human Falsehoods

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:48.282123Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:48.282123Z digest=sha256:5d0efa4029801f5066c62a6c9cc469d3dfd19ca1b0e057d8fe3e84c501ce0b96

Observation 23a283f7-c1e8-4d6f-9126-2fc6563a52d4 · outbound

This paper cites Mistral 7B.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models Mistral 7B

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T13:32:47.702623Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:32:47.702623Z digest=sha256:ff89645c79562280da4e10edc7c24062269f7fef1b2f63331f037c420ef4608b

Observation 29306f15-a00a-40f5-8bf4-dd5123b49722 · outbound

This paper cites doi: 10.3390/computers13100257.

RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models doi: 10.3390/computers13100257

Reference 2024

Resolution
verified exact
doi, observed 2026-08-07T13:32:52.618710Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T13:32:46.481258Z digest=sha256:6dbb43e31d20134485bb7f4a389d95e71ae95b1bc93579d0bf31ac9351f9798c

Pith citing papers

No inbound Pith citation observations are available.