Pith. sign in

Paper Citation Record · LEDGER

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models

As of 4 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 2 inbound Pith citation observations for arXiv:2506.17585.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.17585 v3

Coverage vector

measured 57 of 57 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-19T07:39:55.633854Z

measured 59 of 59 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-04T06:34:03.388597+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-02T16:13:43.039645Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-07-10T12:15:01.137692Z

Reference resolution

57 of 57 outbound references displayed

  • verified exact21
  • verified fuzzy30
  • unresolved3
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch2

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d3d896c2-d8f8-44f0-909d-49deb791a28e · outbound

This paper cites S., Turc, I., and Reitter, D.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models S., Turc, I., and Reitter, D

Reference 1

Resolution
metadata mismatch
doi, observed 2026-05-19T07:42:08.697708Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:bf532c7f80858be7aad99e159ca5d8bc60d9565966003c24aeba8406ed56d8d3

Observation bdc83d26-13d7-4211-9662-0558754382d1 · outbound

This paper cites Survey on Factuality in Large Language Models: Knowledge, Retrieval and Domain-Specificity.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Survey on Factuality in Large Language Models: Knowledge, Retrieval and Domain-Specificity

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.127468Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:925c73ccd9a14dd1ca286db721c048110b58887623aead5f8070facd81a09e69

Observation d692540c-e88f-48c0-8081-7d6cbb4a41c3 · outbound

This paper cites an unresolved cited work.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-05-19T07:42:09.562892Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:ec83ee173f0f2f83517c891f1782095b4ee14026cea0ace85383f3be0b3a5d55

Observation 1453a4bd-1915-4f5a-bf67-9d0865bed7d3 · outbound

This paper cites Extracting training data from large language models.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Extracting training data from large language models

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.559070Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:2fc70d5a1c977077c82900bb31a19887312adcf42af7fb1e4e13bf9f46c481c8

Observation d87546b1-4b0f-43db-9ad0-f911cf0e8dd8 · outbound

This paper cites an unresolved cited work.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-05-19T07:42:09.561114Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:e3753c680f5095d74b4f82fdb5047381f6fb97a92759bbb0f5babdff0ebf89fe

Observation a64fc19d-001c-4e1a-9608-967361bcef2b · outbound

This paper cites Chatgpt hallucinates when attributing answers.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Chatgpt hallucinates when attributing answers

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.564924Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:20d4d9f5134eb0dd1d743e696354b69107abb135ab84fb2776f419450f2b99fc

Observation 9fe4d623-db2d-42a7-a36b-3fac688931ab · outbound

This paper cites WebGPT: Browser-assisted question-answering with human feedback.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models WebGPT: Browser-assisted question-answering with human feedback

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-05-19T07:42:09.123048Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:f1d843d09e0d63eda71a8827aeead740109cf3d26673d66187810399b1b88367

Observation 6c32ec35-d171-4979-a12f-3ae8d89c956a · outbound

This paper cites Teaching language models to support answers with verified quotes.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Teaching language models to support answers with verified quotes

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-05-19T07:42:09.131373Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:737a9da946def467ff808480c3a2c71ef104fcb000ad491aa7d1813e54c5acdd

Observation e7b12ee1-6165-415f-8cdc-0d4487f8c030 · outbound

This paper cites Rethinking with Retrieval: Faithful Large Language Model Inference.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Rethinking with Retrieval: Faithful Large Language Model Inference

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.109591Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:15e8d5f41d7d6e7828d203611324c6af94f17d56f8752225f004d8c8eb1d1401

Observation 1e15d027-8d3a-4016-9c68-4c2abf5dfa45 · outbound

This paper cites RARR: Researching and revising what language models say, using language models.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models RARR: Researching and revising what language models say, using language models

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.530763Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:8d37d7dc25237d1f91ea59bf7e34d47e23d2cc407bb796ed542496a5f0d294e2

Observation 1ee1ee64-3468-4784-91df-b7f13f86c70a · outbound

This paper cites Zhao, Ni Lao, Hongrae Lee, Da-Cheng Juan, and Kelvin Guu.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Zhao, Ni Lao, Hongrae Lee, Da-Cheng Juan, and Kelvin Guu

Reference 11

Resolution
metadata mismatch
doi, observed 2026-05-19T07:42:08.689639Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:2e67da9685f2ce8ce6cd9674a60c473c4cff3443b5c2d37700760f49fb6449f3

Observation bf84991a-2225-491a-b8f0-fc69bfc3f95b · outbound

This paper cites How Context Affects Language Models' Factual Predictions.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models How Context Affects Language Models' Factual Predictions

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.091745Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:a1647a35423e4364948f351ac7d2be6db5ba5457fe20754dbbf4f6a0fbe67e67

Observation b345eede-b7e4-40af-87a9-2e14be85c387 · outbound

This paper cites Adaptive chameleon or stubborn sloth: Revealing the behavior of large language models in knowledge conflicts.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Adaptive chameleon or stubborn sloth: Revealing the behavior of large language models in knowledge conflicts

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.532847Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:83ac3b95658522d4c156b0fe69b25631e8a280eed2bdd28858dfbc193c5b8242

Observation fe34ba52-d0d2-4474-b23e-5341f16bb8d3 · outbound

This paper cites URL: https://openreview.net/forum?id=auKAUJZMO6.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models URL: https://openreview.net/forum?id=auKAUJZMO6

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.546619Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:affb1d69174615dac979bb39ccdd57d1b200d2fc2f0b3a0107e96917eb82a00c

Observation 70f10222-862e-4136-932a-14299ba7e4d4 · outbound

This paper cites Automatic evaluation of attribution by large language models.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Automatic evaluation of attribution by large language models

Reference 15

Resolution
verified exact
doi, observed 2026-05-19T07:42:08.675740Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:23dd1578f1932f6bd8d4404b91ec8ede9210347ed38f854012e98ff98d32f694

Observation 01286743-5a93-4d8b-a011-f9e8b758dc59 · outbound

This paper cites Enabling large language models to generate text with citations.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Enabling large language models to generate text with citations

Reference 16

Resolution
verified exact
doi, observed 2026-05-19T07:42:08.683344Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:35786f321f42607eaf271bef1bdfd1d35a0bc7f9e3b71a1558a01c891e27d386

Observation b7fc4f64-d995-4e2a-be22-51dbcaa38264 · outbound

This paper cites Source-aware training enables knowledge attribution in language models.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Source-aware training enables knowledge attribution in language models

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.521249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:04dd2b91a7df39761d91bb6e81ab71a25ebb0fafe7b5b099961328e4d4a4e3ef

Observation 2835b90a-d8b1-4e50-8d21-af62d6c3c698 · outbound

This paper cites Evaluating verifiability in generative search engines.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Evaluating verifiability in generative search engines

Reference 18

Resolution
verified exact
doi, observed 2026-05-19T07:42:08.669300Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:07672333ad52af773e8a2db36832ca4ff28c45beb595defd41e26d47fd359d4e

Observation 66ab1a90-89cc-4c52-924a-ffa01ee108da · outbound

This paper cites Effective large language model adaptation for improved grounding and citation generation.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Effective large language model adaptation for improved grounding and citation generation

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.519450Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:3ab7d8c639ee94eac46acfac4eb448fff51c8ca130bf4130d46548c1994ed3ae

Observation e6a2851a-d976-4227-b43c-a8c90556a935 · outbound

This paper cites HAGRID: A Human-LLM Collaborative Dataset for Generative Information-Seeking with Attribution.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models HAGRID: A Human-LLM Collaborative Dataset for Generative Information-Seeking with Attribution

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.105989Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:b553eb1b5d765fb8297f389634131a208dcf57a55bcc5fec09b1e4fc6d76a7d5

Observation 1d3dd4eb-ea7d-4ae0-af3f-ede33479728b · outbound

This paper cites Training Language Models to Generate Text with Citations via Fine-grained Rewards.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Training Language Models to Generate Text with Citations via Fine-grained Rewards

Reference 21

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.116389Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:e4984839e1549145322dfa280e82e8f2eb19729a6c7659168ff1e6e67e6b00c1

Observation 3208f7cf-9a1d-4ab9-a034-33fd3735a309 · outbound

This paper cites SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models

Reference 23

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.102574Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:7dc7744e7e392ba5758e66fd3eb164d588f9f7ab19ef5866a643e529fa9da067

Observation cbc15f97-0e77-48d2-ad96-182161bfdd61 · outbound

This paper cites To trust or not to trust? enhancing large language models’ situated faithfulness to external contexts.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models To trust or not to trust? enhancing large language models’ situated faithfulness to external contexts

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.528737Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:b3642979ece68f010625f1a8193e95e21a5fb09f1ed9b0729cb74b5062a2f4a3

Observation e804e731-6ea5-46e4-97eb-fddc296e8a31 · outbound

This paper cites Recitation-augmented language models.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Recitation-augmented language models

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.523165Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:d90b1820eb01b033e9e7871110f7beb6d7cb693afd4ed25f001c29cd6ffed437

Observation fd3adb57-a287-4675-855a-d1dddb74d762 · outbound

This paper cites according to.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models according to

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.524991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:23122004522f45eec4118fe736171b6e6c5db7037e45d603b92d178cf72eeceb

Observation 1cc3cc3f-bc99-4f97-b250-049cdbd5f365 · outbound

This paper cites Generative retrieval with large language models.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Generative retrieval with large language models

Reference 27

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.112870Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:2db53ddb5e0d81d56bd2aa04d1faaed243336cbcb4e18a8a84c55290652bead1

Observation cdf67bc9-4956-4bdd-90a4-af86d849b592 · outbound

This paper cites Verifiable by design: Aligning language models to quote from pre-training data.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Verifiable by design: Aligning language models to quote from pre-training data

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.544526Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:2526807b684e485fd30815a2313f798f02f00a6ce4b2140078c83b55cc73febc

Observation 5b674af2-ecf0-4c95-a397-aa973fd8a6cd · outbound

This paper cites ASQA: Factoid questions meet long-form answers.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models ASQA: Factoid questions meet long-form answers

Reference 29

Resolution
malformed identifier
raw_fallback, observed 2026-05-19T07:42:09.542616Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:7f6c23f937e70cef02298209fcb4cca1ac6a94094ccef4296c93bca252545262

Observation 2939cd4d-4a1f-4389-b9bc-e577f1c21ae2 · outbound

This paper cites KILT: a benchmark for knowledge intensive language tasks.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models KILT: a benchmark for knowledge intensive language tasks

Reference 30

Resolution
verified exact
doi, observed 2026-05-19T07:42:08.666105Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:2f011fd076c6e75afa7aed450bca85adee0864109904345089f3122ed0fbef08

Observation 0263a68e-5b83-4df4-9389-5326a369f4be · outbound

This paper cites ELI5: long form question answering.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models ELI5: long form question answering

Reference 31

Resolution
verified exact
doi, observed 2026-05-19T07:42:08.695237Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:891686cd93a4d3d3e2b948976d4cf3b1a8a9503418327b9d805c16ca52c427ee

Observation 54a12944-831c-498f-954e-30d60c7d783e · outbound

This paper cites CCNet: Extracting high quality monolingual datasets from web crawl data.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models CCNet: Extracting high quality monolingual datasets from web crawl data

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.548757Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:544cc6650d2a3665bb491208523205b226d866b9f0d872e2a75f0140a393f320

Observation 6e12bf77-e684-457e-bef2-6d6a9ee9706c · outbound

This paper cites SciQAG: A Framework for Auto-Generated Science Question Answering Dataset with Fine-grained Evaluation.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models SciQAG: A Framework for Auto-Generated Science Question Answering Dataset with Fine-grained Evaluation

Reference 33

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.120088Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:4fb20f33ae28ac7eb00b8e28cf4b541bd3398f9cbe70bf04bbe81cbe6cb0f3c0

Observation ac9f67c2-a981-4a47-b536-67fff0119f13 · outbound

This paper cites Repliqa: A question-answering dataset for benchmarking llms on unseen reference content.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Repliqa: A question-answering dataset for benchmarking llms on unseen reference content

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.555104Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:90770199a7840e0b456199a43034e607fa2040193afa436534edd9491b1538a4

Observation bc43b1fb-81e0-470b-8682-a29b9860e31a · outbound

This paper cites F resh LLM s: Refreshing large language models with search engine augmentation.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models F resh LLM s: Refreshing large language models with search engine augmentation

Reference 35

Resolution
verified exact
doi, observed 2026-05-19T07:42:08.672781Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:c8dea108354094aebbc39a3b6e91ac8a0e7a3c85f264041103ac367bdb15276d

Observation c36e7561-ea94-4a79-b7ee-eabfb1c6e068 · outbound

This paper cites TrueTeacher: Learning factual consistency evaluation with large language models.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models TrueTeacher: Learning factual consistency evaluation with large language models

Reference 36

Resolution
verified exact
doi, observed 2026-05-19T07:42:08.692234Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:df8f4cfe17f49e298ade1710f787cc95c685f0b9d242344e8ffac8ff931de1bc

Observation dbeaa4b3-8670-43cd-aa0d-2beee9f61fc4 · outbound

This paper cites Physics of language models: Part 3.2, knowledge manipula- tion.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Physics of language models: Part 3.2, knowledge manipula- tion

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.513927Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:a1d2ab6c666067f52c80f94a8a41f36d0ad70a048eb7e21a972424907591acfb

Observation 8bbd180d-4fd8-46b5-a250-971683f5017f · outbound

This paper cites Synthetic continued pretraining.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Synthetic continued pretraining

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.515824Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:48cd121636139a88af7281a1892bfdaede64d452f579c4707b15746041d15324

Observation 2ba37672-2295-4ad6-8755-749972368473 · outbound

This paper cites an unresolved cited work.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-05-19T07:42:09.512047Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:6e1a7db2a037e9ae645a814de6f01fe23f3417b4a30ca8d2230b6ffaa2f4400f

Observation bc963ea6-2493-4f5c-a924-259207c1f221 · outbound

This paper cites Generalization v.s.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Generalization v.s

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.517649Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:f0dd549787c08d926b1d78ebc6842e18df43a36d5b406022daff4d9e1cccd62c

Observation 28723e93-7189-412a-9986-8d8a125430e4 · outbound

This paper cites The Web Is Your Oyster - Knowledge-Intensive NLP against a Very Large Web Corpus.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models The Web Is Your Oyster - Knowledge-Intensive NLP against a Very Large Web Corpus

Reference 41

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.098818Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:eb8018f23fd6197069e250cb3178dce11dcb5cb67863bc7f1bad703b74eacc5f

Observation 2125c8cf-d1a3-429a-808f-4b9310c920a2 · outbound

This paper cites Cohen, and Donald Met- zler.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Cohen, and Donald Met- zler

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.550958Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:981b346e8f734bd50b1ccb0b5e86cf18234360cdf5391a64840853bf7fe8a428

Observation 3fc9ffe8-21f9-4c56-8db2-7c9ce3e12972 · outbound

This paper cites From matching to generation: A survey on generative information retrieval.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models From matching to generation: A survey on generative information retrieval

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.510271Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:f85eb2036904db0df65009f0a49ed43b0a8f3cb6c48c5ff1993a74770d152d09

Observation 4a67887d-ac55-4e0e-8285-0e2a0b9e7f59 · outbound

This paper cites Corpuslm: Towards a unified language model on corpus for knowledge-intensive tasks.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Corpuslm: Towards a unified language model on corpus for knowledge-intensive tasks

Reference 44

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:08.679990Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:6a972f46527c628cf6009daaf9fc98f024757d04b78b938be65890cdd03acb7c

Observation fb41c95e-78a9-4c9a-b7bb-d2f668864b40 · outbound

This paper cites TRAK: attributing model behavior at scale.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models TRAK: attributing model behavior at scale

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.526852Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:2e8300c235f25590c6beaa3b1365f1f3ab786bc8c2da750857970d4114101aba

Observation d588323d-9c35-4118-80c5-80fc1a5cae88 · outbound

This paper cites Chang, Dheeraj Rajagopal, Tolga Bolukbasi, Lucas Dixon, and Ian Tenney.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Chang, Dheeraj Rajagopal, Tolga Bolukbasi, Lucas Dixon, and Ian Tenney

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.508274Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:47a00d257ba277aa73b06da96190d3f0506a65aa4d76f7f3d77d596d75ed4f47

Observation 606f78e2-fb7a-41ab-8a08-28c3f36683d9 · outbound

This paper cites CopyBench: Measuring Literal and Non-Literal Reproduction of Copyright-Protected Text in Language Model Generation.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models CopyBench: Measuring Literal and Non-Literal Reproduction of Copyright-Protected Text in Language Model Generation

Reference 47

Resolution
verified exact
arxiv_id, observed 2026-05-19T07:42:09.095208Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:b0fcabcf2d55ebfa5c9fd02f2d825731b196d6faa732d3234551ff8889d239d0

Observation 01165056-0679-4f71-89e7-9eb34785662b · outbound

This paper cites In-batch negatives for knowledge distilla- tion with tightly-coupled teachers for dense retrieval.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models In-batch negatives for knowledge distilla- tion with tightly-coupled teachers for dense retrieval

Reference 48

Resolution
verified exact
doi, observed 2026-05-19T07:42:08.686709Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:9a37911ee6f1e3244cb37d9e48215ee4b4d3c9c2a73fdc06ae24479b19a334e1

Observation 7d6b5253-8794-4f7b-9e14-ce504d9fbda9 · outbound

This paper cites The model is directly prompted to rank text titles given document content.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models The model is directly prompted to rank text titles given document content

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.499963Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:97668e8dccd48da5c34cd75e61bed754ea14095c6abbf5067c8848d08e778854

Observation 3451443d-a148-461c-a261-b5aaf5972115 · outbound

This paper cites This approach uses natural-language identifiers that align with the model’s training distribution.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models This approach uses natural-language identifiers that align with the model’s training distribution

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.502265Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:dec9ec7c3dcd3f0d5229ed1a7a52c4700af4f63a5022215d8d1ac3f9241c48f6

Observation 8de9d12b-c384-4b57-b61e-61a3726cc308 · outbound

This paper cites Documents are embedded and clustered using K-means into 10 top-level groups.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Documents are embedded and clustered using K-means into 10 top-level groups

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.504245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:e669250c46d175f56ea64aae1ea3cdbc50bbc34f81f2fb1feae5fa5c6bccca2b

Observation 51324288-6767-4e21-b507-b454c5f1a548 · outbound

This paper cites For each cluster, we use an LLM to generate a representative keyword based on its most salient documents.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models For each cluster, we use an LLM to generate a representative keyword based on its most salient documents

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.506344Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:6f3bfa031b89cb4db9404d091c5b27809697a8a52e8e44003e8426196dfe6062

Observation 9fa2aa74-5884-481f-beb9-8e177702223c · outbound

This paper cites Keywords appear first, followed by the broader domain label (e.g., entropy- energy-physics), emphasizing specificity before generality.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Keywords appear first, followed by the broader domain label (e.g., entropy- energy-physics), emphasizing specificity before generality

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.553141Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:ac29d1913cf2c20fd106a7b96f54acb826ed3e8660e7a4f2e100aac9d3ca495b

Observation 82914245-ae30-44a2-b21e-4ff617da371f · outbound

This paper cites This indicates that the model is capable of recalling parametric knowledge and integrating diverse sources during generation.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models This indicates that the model is capable of recalling parametric knowledge and integrating diverse sources during generation

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.557170Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:a42eb3c9f4b05c25f844248ae548edf1b6854b4377a7cb949bb18a3a87b44eaa

Observation 7274f9e2-1433-4c95-b0d3-9c2a9990d2a5 · outbound

This paper cites This suggests a mismatch between content planning and citation generation.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models This suggests a mismatch between content planning and citation generation

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.538475Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:19f35e3520e184c43b66f8b25394cfa6e011d2d981580cc7cab8a31922f0de8c

Observation 4c9509ec-f148-47c3-9a12-0edc8905b448 · outbound

This paper cites dry mouth.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models dry mouth

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.540752Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:11933d7c49494af3d5e573f6336dbc6f491871f3388fa1767dd0c7e97c96f874

Observation 2a3ea472-91a8-44e4-b1ba-03b2a05a0d91 · outbound

This paper cites Title Lure.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Title Lure

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.536527Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:f8568044045f4d0d69647b38e22b21e56a2af552454a3d491843ab6f57c6ec7c

Observation d657d6d1-cd8b-497a-b9fb-87e94c70a315 · outbound

This paper cites Near Miss.

Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models Near Miss

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-05-19T07:42:09.534643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T07:39:55.633854Z digest=sha256:7fb2e076e74b23f0e8315a99cfc4025adcb53ee6eebf095a060f821daeb996fb

Pith citing papers

Observation c2cf5f95-8b75-45eb-ac39-761d7574d32d · inbound

Train, Retrieve, or Both? A Four-Arm Head-to-Head for Correct Statutory Citation on the Ontario Residential Tenancies Act cites this paper.

Train, Retrieve, or Both? A Four-Arm Head-to-Head for Correct Statutory Citation on the Ontario Residential Tenancies Act Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models

Reference 1

Resolution
verified exact
local_arxiv, observed 2026-07-04T03:49:30.574597Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-06-26T17:36:30.486056Z digest=sha256:c6710f8abba6d3569924e98f84f125906e9139fc6d3533349a83b9ae684d5a06

Observation 81f94aed-631b-4a97-aab4-83145db597e1 · inbound

Prototype Language Models cites this paper.

Prototype Language Models Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models

Reference 162

Resolution
verified exact
local_arxiv, observed 2026-07-02T16:17:08.136738Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=arxiv_source observed=2026-07-02T16:13:43.039645Z digest=sha256:5b8f0b2af92ba33632beaf9f05c1b614fece5d7bd7e060d4f8983dbd73f99570