{"as_of":"2026-08-09T08:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eb91d29da5232d7b96cedafc59b16aacb21063415b1d5190bba7ce894d1e598e","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:16:36.698912Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.06257/citation-record","integrity":"/paper/2502.06257/integrity","json":"/paper/2502.06257/citation-record.json","paper":"/paper/2502.06257"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.519802Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.519802Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:19ae727f54c8b46d7693d87bf11b4884fb64d962774a196a5bcc4edb8dbd4b07","observation_id":"5f54fbe8-50f9-4049-b162-189d8aad7fb1","resolution":{"observed_at":"2026-08-08T16:16:36.519802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.529674Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.529674Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:8e78060ac7311f3b6f83b18de60d586fd9a513a73fc88ace738a974af0769887","observation_id":"0d942a0d-77c1-46e9-b53a-10bed9102918","resolution":{"observed_at":"2026-08-08T16:16:36.529674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T16:16:36.535029Z","title":"L.; Almeida, D.; Altenschmidt, J.; Altman, S.; Anadkat, S.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.535029Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:c1c61af4471fe3097d08ec2b0dcd4ed2e55e3f44f8d23d35a7e17c6889a20896","observation_id":"c3a5b5be-25c4-4b03-b5c0-abf0a25b65a5","resolution":{"observed_at":"2026-08-08T16:16:36.535029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.190297Z","title":null,"venue":null,"work_id":"5d43dcc6-23c6-4273-a2d7-f387353f02c9","year":2013},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.539379Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:a2d91be43d6e0fdccedfe4c2a668d42a8bde6bd3aa36c63f9693e5b64a5f40f3","observation_id":"c6e5b725-09aa-445b-9772-c184b6ac1a13","resolution":{"observed_at":"2026-08-08T16:16:37.193057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-08T16:16:36.543407Z","title":"D.; Chen, D.; and Dao, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.543407Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:edead3a8a742ed10899bb503c8b24b10510073a30d5e446e6ec63edd841977d2","observation_id":"4269d2fe-ffb2-421c-adba-2c2685c5170d","resolution":{"observed_at":"2026-08-08T16:16:36.543407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.181063Z","title":null,"venue":null,"work_id":"0b08af6f-709d-4cd7-ad16-9e9a47a87ca9","year":2022},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.547248Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:50fc674558ea3e83fb8ab319d994b35199d0049dc40c8964267524f797a99268","observation_id":"90c26cf6-0175-4020-94da-6491bd6c437f","resolution":{"observed_at":"2026-08-08T16:16:37.184545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.171916Z","title":null,"venue":null,"work_id":"411f5121-f443-4180-bb6b-c2483fd13423","year":2021},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.551455Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:4e75e88b63352ad21f078151c0520001092d1ececbea0977788cdf5256ac9ee8","observation_id":"f0b912d5-f39a-486f-b6c5-20cf5fa57e03","resolution":{"observed_at":"2026-08-08T16:16:37.175043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14454","last_updated":"2023-07-30T14:39:36Z","snapshot_observed_at":"2026-07-06T14:35:57.506538Z","submitted_at":"2022-12-29T20:49:58Z","title":"MEAformer: Multi-modal Entity Alignment Transformer for Meta Modality Hybrid","version":4},"cited_work":{"arxiv_id":"2212.14454","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.14454","snapshot_observed_at":"2026-08-08T16:16:36.897014Z","title":"MEAformer: Multi-modal Entity Alignment Transformer for Meta Modality Hybrid","venue":"cs.AI","work_id":"fcae5e9e-d1b8-4f95-bd1d-42bdc04d6e6b","year":2022},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.555568Z"},"links":{"cited_paper":"/paper/2212.14454","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:cd5a77266473c1af80704861948f17ec11102f601c95b3ff4bf1cf9739f65fda","observation_id":"7796b474-d29a-40aa-92e1-7699108d954b","resolution":{"observed_at":"2026-08-08T16:16:36.901236Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05391","last_updated":"2024-02-26T09:57:12Z","snapshot_observed_at":"2026-07-06T17:27:11.705550Z","submitted_at":"2024-02-08T04:04:36Z","title":"Knowledge Graphs Meet Multi-Modal Learning: A Comprehensive Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05391","snapshot_observed_at":"2026-08-08T16:16:36.559809Z","title":"Z.; Zhang, N.; and Chen, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.559809Z"},"links":{"cited_paper":"/paper/2402.05391","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:5461f88da52295e80df20dac92c33647236dbb5a73448945cbc34e74a1f7f472","observation_id":"c38c2171-3e12-4acf-a44b-5a5915be9d86","resolution":{"observed_at":"2026-08-08T16:16:36.559809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.163075Z","title":null,"venue":null,"work_id":"56165c07-44cd-4132-ae3b-6177f91964f4","year":2018},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.564218Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:feed2f8fac02f7c5eb42a10b24532c1844b3583c44f570eec42f17031471298a","observation_id":"f892a6de-9cf8-4044-8e6a-677c49e30711","resolution":{"observed_at":"2026-08-08T16:16:37.166173Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-08T16:16:36.568182Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.568182Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:289446aa2b288b669b55bd36fc0d14589f63561d07f1a61c777e1256d6e65290","observation_id":"bb21d432-2127-4d79-994a-72075d2fbc2e","resolution":{"observed_at":"2026-08-08T16:16:36.568182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.153866Z","title":null,"venue":null,"work_id":"f1c880eb-84d1-4a9a-b9b5-b9f4f416dddf","year":2018},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.572116Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:8854b68d9d9ed9c245998135b7a387685c22ee8bb7479c0f5b4959f3f1e54e7f","observation_id":"49c2612f-f083-4353-a929-128996e4e197","resolution":{"observed_at":"2026-08-08T16:16:37.157307Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-03T23:22:09.849239Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-08T16:16:36.576055Z","title":"Y.; Rozi \\` e re, B.; Lopez - Paz, D.; and Synnaeve, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.576055Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:6b6997ba5d9fd0c29380064ff6c4ebb4ea0e7feaac616b9dcd274f2a3475ab36","observation_id":"8f7d9997-4770-474e-8b70-d3a9e1695296","resolution":{"observed_at":"2026-08-08T16:16:36.576055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.143844Z","title":null,"venue":null,"work_id":"c1e33299-6134-4dbc-9380-ae35364774ff","year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.579889Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:c00a2017a206dc40763f256ab2af31159d5f7a5bab0f4c7218c3ed71fb0d4332","observation_id":"e0018805-22ac-412e-85e0-6fc92210dc5b","resolution":{"observed_at":"2026-08-08T16:16:37.147068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07526","last_updated":"2024-10-10T01:39:26Z","snapshot_observed_at":"2026-07-06T19:30:52.402150Z","submitted_at":"2024-10-10T01:39:26Z","title":"MKGL: Mastery of a Three-Word Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07526","snapshot_observed_at":"2026-08-08T16:16:36.583477Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.583477Z"},"links":{"cited_paper":"/paper/2410.07526","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:1802e43b34f438a5b4cf4929dca467d3d1a7dbd621d8ce3dc535d7d485649e89","observation_id":"b5536b72-5bf4-4ba9-8adf-243308dfac7d","resolution":{"observed_at":"2026-08-08T16:16:36.583477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.134174Z","title":null,"venue":null,"work_id":"87ad5f1e-5b0a-4cec-9592-2bc60831383b","year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.587422Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:f231678f9b76460465faef808ad9bf4dbbdfda1d4ce978ae5e75f584f7f7a9ab","observation_id":"9df841d8-7e07-439a-ab48-b73148e3fecb","resolution":{"observed_at":"2026-08-08T16:16:37.137624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.124754Z","title":null,"venue":null,"work_id":"e9713678-ae5f-49e8-8a28-ada42c6d3aa6","year":2019},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.591398Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:b1854b345b64daee06f8fcaf081c64c99af2d0338298db36fba877d6d6facc9e","observation_id":"e92d0d57-5c33-434b-aa3f-cb2bf2ba8039","resolution":{"observed_at":"2026-08-08T16:16:37.128196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.08114","last_updated":"2024-04-04T03:12:50Z","snapshot_observed_at":"2026-07-06T10:04:58.095213Z","submitted_at":"2020-10-16T02:31:22Z","title":"Distributed Representations of Entities in Open-World Knowledge Graphs","version":2},"cited_work":{"arxiv_id":"2010.08114","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.08114","snapshot_observed_at":"2026-08-08T16:16:36.848592Z","title":"Distributed Representations of Entities in Open-World Knowledge Graphs","venue":"cs.LG","work_id":"b7cbb4e6-e7f8-4a2e-bd16-8945afb92414","year":2020},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.595055Z"},"links":{"cited_paper":"/paper/2010.08114","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:32d8216439a15e20b5a0868492df455d6ebfba9237845ebf25783bd74d683095","observation_id":"91a655a2-6acb-4fa1-9f1c-babcf8639527","resolution":{"observed_at":"2026-08-08T16:16:36.852620Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10581","last_updated":"2022-02-18T06:40:51Z","snapshot_observed_at":"2026-08-04T01:59:09.583627Z","submitted_at":"2022-02-18T06:40:51Z","title":"Unleashing the Power of Transformer for Graphs","version":1},"cited_work":{"arxiv_id":"2202.10581","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.10581","snapshot_observed_at":"2026-08-08T16:16:36.831119Z","title":"Unleashing the Power of Transformer for Graphs","venue":"cs.LG","work_id":"c5157881-5a89-4a46-9297-363d5717ca5a","year":2022},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.598547Z"},"links":{"cited_paper":"/paper/2202.10581","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:76c895405b53155be3e23ff6180518f59df74e2b0da726881daf84e09601fb53","observation_id":"d9927123-422e-47fd-9528-95face7d54be","resolution":{"observed_at":"2026-08-08T16:16:36.837885Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.114307Z","title":null,"venue":null,"work_id":"788ee5c0-7c1e-4563-b2d4-74824b4a4efc","year":2022},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.601608Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:e80ea8903664e988398757dd4f4ae24db07e6feb05dd8b0120dc0dd3dc4115c9","observation_id":"94fe6f9e-d039-429c-85d7-6a3374007742","resolution":{"observed_at":"2026-08-08T16:16:37.117671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-08T16:16:36.604600Z","title":"J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.604600Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:2f47ceb7a15263d8f0c7b95b8a1e4168b3083f691ebd01e093d9a4197f4a7168","observation_id":"cf0b12d9-f901-4564-bee4-0a5a706c194c","resolution":{"observed_at":"2026-08-08T16:16:36.604600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.102987Z","title":"P.; and Ba, J","venue":null,"work_id":"8b61317b-37a7-418a-82f2-15da8fb3951b","year":2015},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.607597Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:a0af5bc77ee61a9d0de56b1ebdb9ee9bf0928cfd83f365ec3ae13376b31361ce","observation_id":"4e64e88b-dc7d-487b-ad39-6844a4f26b71","resolution":{"observed_at":"2026-08-08T16:16:37.106478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.092342Z","title":null,"venue":null,"work_id":"62118f6d-42e2-43f3-918d-602ed01f206e","year":1951},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.610355Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:5afe9f039b5d789ce1434de5950f404009e0b55448dd43e659da84a68d5c30a9","observation_id":"104e977f-7935-4d31-832e-92f211e399a9","resolution":{"observed_at":"2026-08-08T16:16:37.095817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.082687Z","title":null,"venue":null,"work_id":"fa78e406-f673-4fbc-88bd-e72afc6bf0a2","year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.613387Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:2c70edd32a42fbe0f3b69dc425768ea03c8aef0845a0da01da8cc99e45363463","observation_id":"9a37f950-ae8d-41ba-95c1-df2c4337a0e2","resolution":{"observed_at":"2026-08-08T16:16:37.086044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.072164Z","title":null,"venue":null,"work_id":"110e6cc9-edb5-4b12-adb5-ba04613912ca","year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.616364Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:65766ceb4ccc73b67993e08c7af0de649b4b038ef26a1c713792e8b56917a369","observation_id":"6b560982-fa4d-4a76-800a-6a77ee8eb037","resolution":{"observed_at":"2026-08-08T16:16:37.075784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.062422Z","title":null,"venue":null,"work_id":"b331868c-85d5-40d3-9305-ce6156474c5e","year":2019},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.619095Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:f07d4fa57193129dd4c5907c04dcda2a6d1d135fc32decaca412c5ea60511b10","observation_id":"d4658a4f-011e-4c1d-90a6-d3431f7a6693","resolution":{"observed_at":"2026-08-08T16:16:37.065713Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.053271Z","title":null,"venue":null,"work_id":"677b9eb7-6a2b-40ca-bdd6-23393ffd7171","year":2022},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.622130Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:102e41618f4680b2296bf337251e613c3095dbd51a3cc39585f88bd67ef3cfe5","observation_id":"4e75e512-cd77-4834-bee2-b02ced2d5ba6","resolution":{"observed_at":"2026-08-08T16:16:37.056100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06374","last_updated":"2023-08-11T20:16:57Z","snapshot_observed_at":"2026-07-06T16:05:27.901845Z","submitted_at":"2023-08-11T20:16:57Z","title":"Large Language Models and Knowledge Graphs: Opportunities and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06374","snapshot_observed_at":"2026-08-08T16:16:36.625269Z","title":"Z.; Razniewski, S.; Kalo, J.-C.; Singhania, S.; Chen, J.; Dietze, S.; Jabeen, H.; Omeliyanenko, J.; Zhang, W.; Lissandrini, M.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.625269Z"},"links":{"cited_paper":"/paper/2308.06374","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:488bcf70b67b990f6c834ba79d23c9de5d345f0a7263235238880f098b068dea","observation_id":"dd6917ad-6204-434b-94eb-52818003a7ea","resolution":{"observed_at":"2026-08-08T16:16:36.625269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.628896Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.628896Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:51426231b9071460b6f6b7f23cf9f9dba2f81b509e03c53de3a2b7bed46b3c76","observation_id":"40e01754-1723-475a-98e7-eaf786e1dd05","resolution":{"observed_at":"2026-08-08T16:16:36.628896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.038710Z","title":null,"venue":null,"work_id":"16d96196-29e7-45c3-bdbf-d2048a95831e","year":2019},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.632202Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:528d860fbff24834a5d6dfb1aec6297f5940a282157c22f0d7228ac75dbdbc7e","observation_id":"047c7e06-03b5-4b3e-bade-18232b762d87","resolution":{"observed_at":"2026-08-08T16:16:37.041520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T16:16:36.635408Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.635408Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:b665bfc61285f907fbb7faec01156b563f4101d1f94e61d3d0428e3a7a18dd01","observation_id":"96a2dfa9-f558-4784-a482-defcac628b5d","resolution":{"observed_at":"2026-08-08T16:16:36.635408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.030028Z","title":null,"venue":null,"work_id":"a2501b84-1b77-4998-8505-a91031996f49","year":2020},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.638902Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:b6734fadd89c118e4eb365eebbcdc0592cf409f85e41a1a6bf147902eb331c6c","observation_id":"c9f3ac37-4ef0-4d72-893d-7fe1a3d5f3a8","resolution":{"observed_at":"2026-08-08T16:16:37.033006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.018974Z","title":null,"venue":null,"work_id":"7f8eae6b-d08f-4d0e-b8c7-a7dc3b64c6ed","year":2021},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.642084Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:d54e969e16e638d0e1672aec9fbd4ac5ba657e51e395dfe505211240ce8080da","observation_id":"e48bacb5-656b-4f46-b13b-e89a205807de","resolution":{"observed_at":"2026-08-08T16:16:37.023245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:37.008612Z","title":null,"venue":null,"work_id":"2999979c-271f-4cea-92be-bc0aacef8ca8","year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.645351Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:c94ce5c6c06f61004c78350e40630347656e851c7d34198f277f6c0b65c233b2","observation_id":"ebacb04f-27d0-4379-94e5-a0873ec6ebfe","resolution":{"observed_at":"2026-08-08T16:16:37.012660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.997333Z","title":null,"venue":null,"work_id":"adbb2367-1886-445a-9c18-222d37d695ab","year":2019},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.648756Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:01fcba2537012e5df9363cba520f569a5efd66afa677cf8f59fb5555b5f79074","observation_id":"9cae55ae-873d-4a30-93b8-7beff9e69297","resolution":{"observed_at":"2026-08-08T16:16:37.002176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02389","last_updated":"2024-02-23T09:01:44Z","snapshot_observed_at":"2026-07-06T17:25:01.583656Z","submitted_at":"2024-02-04T08:01:07Z","title":"KICGPT: Large Language Model with Knowledge in Context for Knowledge Graph Completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02389","snapshot_observed_at":"2026-08-08T16:16:36.652322Z","title":"T.; and Zhang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.652322Z"},"links":{"cited_paper":"/paper/2402.02389","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:3bd0b26c5a9ba2a03ebbff1d64b94d664078df083f35ebc48c3bbe2ae2dffb3f","observation_id":"9e9d2a5e-a32b-49a6-9030-fc35f4eed1da","resolution":{"observed_at":"2026-08-08T16:16:36.652322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.986797Z","title":null,"venue":null,"work_id":"2e44dd88-0efb-4da9-ad16-3b975645a8aa","year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.655362Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:81743d10ebd1935b049e619bc34d84f0ae55dfdc7d86d82ab1dbbabcf5abcfc6","observation_id":"cd420d59-7ae4-4c24-9510-750bbe66e973","resolution":{"observed_at":"2026-08-08T16:16:36.990991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.975772Z","title":null,"venue":null,"work_id":"24f0acdc-e9ff-4d3a-bb1b-c418e01d781e","year":2017},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.658129Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:c7076633afb9b8ef8628b1d3752c6f68e36fd6eb0c29cca1d3574dcae7f73f30","observation_id":"5c0a5d46-86cb-4bdc-a21a-210c858b7bd7","resolution":{"observed_at":"2026-08-08T16:16:36.979346Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.966311Z","title":null,"venue":null,"work_id":"c9293ca1-beff-40d7-ada8-00fcb9efc958","year":2022},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.660857Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:6868a183b1b6bd5a38c5eed8b2f78658fa202f801e3c97748385e9eec57dfc07","observation_id":"14641152-a1cd-4d94-b322-31eb5dc2f8ce","resolution":{"observed_at":"2026-08-08T16:16:36.969219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.956459Z","title":null,"venue":null,"work_id":"ce815847-3239-4eca-8b63-7305a51ef4fe","year":2015},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.663614Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:ffa3c7f8cf7b10afacd0d751ccca1d3c3ab4477b481805b23548e7584880346b","observation_id":"545a5095-6f25-4090-8e4b-f1b9c0943222","resolution":{"observed_at":"2026-08-08T16:16:36.959989Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11489","last_updated":"2024-01-30T12:11:45Z","snapshot_observed_at":"2026-08-08T17:19:28.725711Z","submitted_at":"2023-06-20T12:21:06Z","title":"Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11489","snapshot_observed_at":"2026-08-08T16:16:36.666495Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.666495Z"},"links":{"cited_paper":"/paper/2306.11489","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:913a9785975b999ca3b296fd09e3196628e553a089c1d6a10a102e09a833d2a3","observation_id":"a621102b-5b3a-44d4-b485-5543006f219f","resolution":{"observed_at":"2026-08-08T16:16:36.666495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.03193","last_updated":"2019-09-11T06:03:30Z","snapshot_observed_at":"2026-07-06T08:19:51.929437Z","submitted_at":"2019-09-07T06:09:25Z","title":"KG-BERT: BERT for Knowledge Graph Completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.03193","snapshot_observed_at":"2026-08-08T16:16:36.669355Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.669355Z"},"links":{"cited_paper":"/paper/1909.03193","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:a00a609247457a11be9df6cda0becb8b59c8664f3b04912f6d8175f709867e17","observation_id":"808b2086-3abf-420a-b2a7-19f220692445","resolution":{"observed_at":"2026-08-08T16:16:36.669355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13916","last_updated":"2025-02-13T10:45:15Z","snapshot_observed_at":"2026-07-06T16:10:46.667938Z","submitted_at":"2023-08-26T16:51:17Z","title":"Exploring Large Language Models for Knowledge Graph Completion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13916","snapshot_observed_at":"2026-08-08T16:16:36.672396Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.672396Z"},"links":{"cited_paper":"/paper/2308.13916","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:fd2f2bc3922f0d1606d6e909d2f012db0a7b477ec8ef2fa8d085c3239af6a5f1","observation_id":"ed9d5922-bb10-473d-a985-c1968e4875f8","resolution":{"observed_at":"2026-08-08T16:16:36.672396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.02744","last_updated":"2023-05-17T16:34:49Z","snapshot_observed_at":"2026-07-06T14:14:42.689813Z","submitted_at":"2022-11-04T20:38:12Z","title":"KGLM: Integrating Knowledge Graph Structure in Language Models for Link Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.02744","snapshot_observed_at":"2026-08-08T16:16:36.675111Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.675111Z"},"links":{"cited_paper":"/paper/2211.02744","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:a48fa0cb34048ef7fcc4c41a75b5f0527d044ddc5be6ca3941c68b759da7f55c","observation_id":"8148078e-b3a0-4ed1-84e8-19db4a7bb3d1","resolution":{"observed_at":"2026-08-08T16:16:36.675111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.946142Z","title":null,"venue":null,"work_id":"26a870f4-06f3-4355-a7b6-779bbdbe0dd1","year":2019},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.678121Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:83198302606cd05569e4c53f01b2796dbf68340e054400c81c5cba93785f1563","observation_id":"ca197bd7-0b1e-4624-8654-f511b2331192","resolution":{"observed_at":"2026-08-08T16:16:36.949671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.936277Z","title":null,"venue":null,"work_id":"fccfd5b7-c094-4f18-b762-280044f6bca5","year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.681094Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:a6c2961446e4702cc65704c5db5b3d02ffe1248a7583b4fd77a2de385030251a","observation_id":"5ce91a5e-4808-4e05-b286-0166e9eb337d","resolution":{"observed_at":"2026-08-08T16:16:36.939503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16869","last_updated":"2025-04-06T09:08:09Z","snapshot_observed_at":"2026-07-06T18:20:22.759333Z","submitted_at":"2024-05-27T06:36:17Z","title":"Multiple Heads are Better than One: Mixture of Modality Knowledge Experts for Entity Representation Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16869","snapshot_observed_at":"2026-08-08T16:16:36.684256Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.684256Z"},"links":{"cited_paper":"/paper/2405.16869","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:d7ff26e413139582b535878dcfee2809997048f5c39f9b715b5df1099b99dc69","observation_id":"79626b68-a851-403b-acc9-dab416d9ef2b","resolution":{"observed_at":"2026-08-08T16:16:36.684256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:16:36.925712Z","title":null,"venue":null,"work_id":"5eb57ba4-b47d-449a-a4b4-0fce7ad849d4","year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.687810Z"},"links":{"citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:18d5722c61dafd9cda7f1fca8036c28c6fe84f02bf4c84f5672e48be95aba8f9","observation_id":"098cca89-c7d6-4286-a40e-8bf728cc603d","resolution":{"observed_at":"2026-08-08T16:16:36.929482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15444","last_updated":"2024-02-22T05:48:03Z","snapshot_observed_at":"2026-07-06T17:34:40.933767Z","submitted_at":"2024-02-22T05:48:03Z","title":"Unleashing the Power of Imbalanced Modality Information for Multi-modal Knowledge Graph Completion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15444","snapshot_observed_at":"2026-08-08T16:16:36.691769Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.691769Z"},"links":{"cited_paper":"/paper/2402.15444","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:683a4fcddb6a06abe0f9af51cbf3f48bf982a337a7b70172b4920241b3f661c4","observation_id":"153fd660-4738-4a9f-8bc2-2f55c3a2d946","resolution":{"observed_at":"2026-08-08T16:16:36.691769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06671","last_updated":"2024-04-14T05:30:19Z","snapshot_observed_at":"2026-07-06T16:30:33.889293Z","submitted_at":"2023-10-10T14:47:09Z","title":"Making Large Language Models Perform Better in Knowledge Graph Completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06671","snapshot_observed_at":"2026-08-08T16:16:36.695205Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.695205Z"},"links":{"cited_paper":"/paper/2310.06671","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:48d5e199c3e4c9af652c70a46b070c733bbe711a555cef1c59b937f772047fc2","observation_id":"50039150-e816-4462-a8c3-0a34b6ba004c","resolution":{"observed_at":"2026-08-08T16:16:36.695205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13168","last_updated":"2024-12-26T18:54:53Z","snapshot_observed_at":"2026-07-06T15:30:45.921201Z","submitted_at":"2023-05-22T15:56:44Z","title":"LLMs for Knowledge Graph Construction and Reasoning: Recent Capabilities and Future Opportunities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13168","snapshot_observed_at":"2026-08-08T16:16:36.698912Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-08T16:16:36.698912Z"},"links":{"cited_paper":"/paper/2305.13168","citing_paper":"/paper/2502.06257"},"observation_digest":"sha256:a4300664e4a2284947b806d2f94e0fc9b8b431efc40868e58cdbe8d472e129ed","observation_id":"fd8f68d1-ee43-4123-a196-9f6676113b39","resolution":{"observed_at":"2026-08-08T16:16:36.698912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.06257","last_updated":"2025-02-10T08:45:56Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T16:11:46.986273Z","submitted_at":"2025-02-10T08:45:56Z","title":"K-ON: Stacking Knowledge On the Head Layer of Large Language Model"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":47,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2502.06257."}