{"as_of":"2026-08-09T06:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f2daf262ec958807e63d8f16d00f1540ddaed538987a1d7093a6d45f939b67fb","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:59:56.975960Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09506/citation-record","integrity":"/paper/2507.09506/integrity","json":"/paper/2507.09506/citation-record.json","paper":"/paper/2507.09506"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-06T17:59:52.895636Z","title":"Hewett, Jamie Huynh, Mojan Javaheripi, Xin Jin, Piero Kauffmann, Nikos Karampatziakis, Dongwoo Kim, Mahoud Khademi, Lev Kurilenko, James R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:52.895636Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:79d835a4ca053b159b599ddf230200b5485d532f0bf8f72e2bbc0ef95f23806b","observation_id":"bb077e7a-11ba-4a27-acdf-cd29efcc3df6","resolution":{"observed_at":"2026-08-06T17:59:52.895636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.716230Z","title":null,"venue":null,"work_id":"6cbba188-3176-44d4-9262-58e530eb4e18","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:52.960245Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:18c312c22db467d8e930ac578e7b8054cd20df6f6f2b309eeda9d45e2fa096d7","observation_id":"8697caef-a484-4eab-818f-91812189f8f4","resolution":{"observed_at":"2026-08-06T18:00:00.768946Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.617353Z","title":null,"venue":null,"work_id":"ee5c401d-f2a7-4ad5-b9c5-1b101a23b57d","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.020821Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:8b34a6e7da7acb50c7c217814a4337b1225af3d1e33655cfff0acf5d2a2ca8c8","observation_id":"f73dd20a-2c8d-4640-99e2-6d0ec88420d7","resolution":{"observed_at":"2026-08-06T18:00:00.663910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.545243Z","title":null,"venue":null,"work_id":"e867fa48-301d-45fd-a273-1b5f7b64d747","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.178338Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:48d7d56d088ee284f4f4b3ee442411e9a70fbea1d40cc988cf029104ef63c282","observation_id":"505c07f8-3a21-4cee-bbc3-2d0249389bea","resolution":{"observed_at":"2026-08-06T18:00:00.581449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.429636Z","title":null,"venue":null,"work_id":"2d3bbebb-acda-47a0-8bf0-f7553bff3486","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.296176Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:5556eb5787e83e137f27c1f0fda960c616ce74b7edfc02c34772bae51b6c1ecd","observation_id":"8c678b6d-d86f-48b7-93b4-94e1db04af7a","resolution":{"observed_at":"2026-08-06T18:00:00.481780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.311347Z","title":null,"venue":null,"work_id":"a5f0d41a-3bf9-47fd-b57e-7b750e012f10","year":2021},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.402737Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:286791ac9b786c94d617ed2db031be158c07bd8fc040c52d5bdbe0f33843305d","observation_id":"c1d8474b-a273-4e66-b4e5-ee4eb8ca9464","resolution":{"observed_at":"2026-08-06T18:00:00.356532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:53.475072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.475072Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:f8ca7f07d09cf1ede55ab7b5eb449c54627d590b47486275acbdb5830f7ef700","observation_id":"2f659ed9-c18a-493e-ab87-d9716e803523","resolution":{"observed_at":"2026-08-06T17:59:53.475072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.187207Z","title":null,"venue":null,"work_id":"ca93226d-c1c6-47db-b1e4-0f9d5d3c0fed","year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.559851Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:73142ca12a2706349cbbec542cb03756370d7593159376a038fc2c71a3bbb001","observation_id":"9c3ceed1-9dc9-456d-a587-cbd59b6eb83b","resolution":{"observed_at":"2026-08-06T18:00:00.260214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T17:59:53.672437Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.672437Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:99121f2b97b9fb7aa5df01ffcd7155865e4734db140c27e51c82c9411141f9e0","observation_id":"7a996289-a6cd-4e4b-a9c6-99a98f4a0113","resolution":{"observed_at":"2026-08-06T17:59:53.672437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-06T17:59:53.794460Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.794460Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:6dde5ee92274e44a3b93b8400bbf2d27dc81729231c24b438058427fef9e9f6a","observation_id":"69910955-fcaf-4f33-907e-d5b232f3ff13","resolution":{"observed_at":"2026-08-06T17:59:53.794460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:53.888152Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.888152Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:54981a5c6fa49e4d65ad2879ef922c4175cff42b084bd4f8c0b8c24655f508b2","observation_id":"aa538448-6204-4225-9771-94b04474a304","resolution":{"observed_at":"2026-08-06T17:59:53.888152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T17:59:53.957827Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:53.957827Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:e1503d1b2c749fef8ca8e3a8ef6b6d939435bafc5ff94bf88b05ba70306f4a7b","observation_id":"5c3f7c0d-3659-47bc-a905-6fd47f029ec0","resolution":{"observed_at":"2026-08-06T17:59:53.957827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:00:00.056087Z","title":null,"venue":null,"work_id":"b5aef60c-ab0e-499a-a6e9-bdfc8904eedd","year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.062411Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:835a138f891986bfe531ae29b173927f1deab417256e802f0d70ab1dcb29d077","observation_id":"afe713a9-6687-41d2-bac4-f0744c85a1e5","resolution":{"observed_at":"2026-08-06T18:00:00.122762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.948020Z","title":null,"venue":null,"work_id":"2135352d-52fd-4bde-b977-9e2cfa5e8cac","year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.167070Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:e9a63096950d3d1a0f6a0dba8d4b99d7608350dce5d217f66707af4ce192343f","observation_id":"7c4558a2-af67-4c96-8e31-1cf99533af0c","resolution":{"observed_at":"2026-08-06T17:59:59.997001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.814455Z","title":null,"venue":null,"work_id":"245cacbb-6654-4445-9f69-735e36444948","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.294447Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:fb8d326d17df97f2855378929926b5309a31ae32369c7d082b5e20ecce69cedf","observation_id":"1b123c7b-4cd0-4e72-9da5-efb4c9077882","resolution":{"observed_at":"2026-08-06T17:59:59.863451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.663747Z","title":null,"venue":null,"work_id":"488b759e-084f-4a30-abb4-ecd611fe811a","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.397668Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:4624038e08b17a40c8f5fca3facda3e974263b6f575498ca4f5f81e320d94a55","observation_id":"0f7f95c4-12e5-4f46-92d8-29c264908d4a","resolution":{"observed_at":"2026-08-06T17:59:59.724619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:54.507763Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.507763Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:43c1b001af99f04306a702a99a3ebfbab8355abc504c7adbd70e44a6426093d4","observation_id":"81ba88a6-195c-4baa-9f09-d603e53cd95b","resolution":{"observed_at":"2026-08-06T17:59:54.507763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.478486Z","title":null,"venue":null,"work_id":"efe34f71-b1fb-4163-89ae-13be7a1f0c34","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.617255Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:2ea8c6f11e95a0c88ca7c69c3b04797323369e6858395077c089d0c8c87818e4","observation_id":"504a3fd0-add1-4af8-aa86-546a6f68611e","resolution":{"observed_at":"2026-08-06T17:59:59.573324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.271761Z","title":null,"venue":null,"work_id":"d3f9e0a3-bd2f-49b6-af1c-214791c7816f","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.677719Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:52e2bdc6b7106fc419b20956a3cab1d0e4d35e25015de91d72fea3bed2c860f3","observation_id":"91ab2477-3b1a-4cb3-b5a7-f579790fcb27","resolution":{"observed_at":"2026-08-06T17:59:59.369634Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:54.787439Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.787439Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:118253698f3e295d635996d4d0efc152b99a7f634b086225507889252ff5d3c7","observation_id":"edacdb47-961b-4acb-b92a-38c408e86286","resolution":{"observed_at":"2026-08-06T17:59:54.787439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:59.109122Z","title":null,"venue":null,"work_id":"357cdc83-a204-4c22-ad7d-0c3f92bdb440","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:54.890129Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:a4a13ec305898043f729449fa988c74f83be90d92d01a3e430115da469bcfe7e","observation_id":"2479cf2b-cddf-4770-83c0-e9ae65995a31","resolution":{"observed_at":"2026-08-06T17:59:59.157748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:55.020695Z","title":"Mmlongbench-doc: Benchmarking long-context document understanding with visualizations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.020695Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:18c4bf537ecec9796d848acfc54458d0d9063b86a63bef40722400b538f03d39","observation_id":"0481e7c8-909c-43b2-b014-f5c165db5eef","resolution":{"observed_at":"2026-08-06T17:59:55.020695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.896080Z","title":null,"venue":null,"work_id":"49802bc2-2e1d-4347-a01d-3da52b49c30b","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.134838Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:26d28c6033cc56b21418b92946a7f768d51cfffbaaeb9a32e272479dd503f7f5","observation_id":"2db68c4d-1840-452f-92a3-5d357cc53231","resolution":{"observed_at":"2026-08-06T17:59:58.999329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.744519Z","title":null,"venue":null,"work_id":"f9f0aaf3-f7c3-49b3-acaf-9a15f83d1210","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.225727Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:c4788699926ef928dddbf9facf0faa89525c0b7dd919f740ac7b4deff175e90d","observation_id":"e3c5325f-dfb2-488d-bbe2-253a90edfb16","resolution":{"observed_at":"2026-08-06T17:59:58.823847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.544372Z","title":"Needle threading: Can llms follow threads through near-million-scale haystacks? In The Thirteenth International Conference on Learning Representations","venue":null,"work_id":"e30b699f-366e-43e8-b049-7f1ce9ccaa92","year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.315523Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:3a75fbf33da597fa62f6bbffbe924571996a4315b1bdfb93999f9ad35e7a64f6","observation_id":"659102a9-322f-4d0b-90a9-2f51a1185a7d","resolution":{"observed_at":"2026-08-06T17:59:58.637960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11802","last_updated":"2024-12-24T01:41:28Z","snapshot_observed_at":"2026-07-06T17:46:20.935124Z","submitted_at":"2024-03-18T14:01:45Z","title":"Counting-Stars: A Multi-evidence, Position-aware, and Scalable Benchmark for Evaluating Long-Context Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11802","snapshot_observed_at":"2026-08-06T17:59:55.426052Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.426052Z"},"links":{"cited_paper":"/paper/2403.11802","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:1b044f4c2e81fab7c9bd38cac00f74419451675ce47c273b4aacb1c9a7cb835f","observation_id":"12fa92ed-3aa3-45b5-b1e3-ed4622414560","resolution":{"observed_at":"2026-08-06T17:59:55.426052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02115","last_updated":"2024-10-04T12:52:28Z","snapshot_observed_at":"2026-08-03T23:47:53.992083Z","submitted_at":"2024-10-03T00:38:12Z","title":"L-CiteEval: Do Long-Context Models Truly Leverage Context for Responding?","version":2},"cited_work":{"arxiv_id":"2410.02115","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02115","snapshot_observed_at":"2026-08-06T17:59:57.085523Z","title":"L-CiteEval: Do Long-Context Models Truly Leverage Context for Responding?","venue":"cs.CL","work_id":"4b64234c-b372-4edf-841c-1286f63e52d3","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.558000Z"},"links":{"cited_paper":"/paper/2410.02115","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:44e89c7ea23ccd146f92813db4bceb221fa6c052e39575e84098205334946c35","observation_id":"39a49d4b-aa91-461f-94b1-4c3e695d7ca2","resolution":{"observed_at":"2026-08-06T17:59:57.182657Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:55.657882Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.657882Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:2017e322d8655f48222ef5a20ad06a14a4e5c6dd29f77409eaa53f6d37b00be7","observation_id":"c6f54c84-1da5-48ec-af54-94c90fbf58e1","resolution":{"observed_at":"2026-08-06T17:59:55.657882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12640","last_updated":"2024-09-20T00:47:33Z","snapshot_observed_at":"2026-07-06T19:18:04.618039Z","submitted_at":"2024-09-19T10:38:01Z","title":"Michelangelo: Long Context Evaluations Beyond Haystacks via Latent Structure Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12640","snapshot_observed_at":"2026-08-06T17:59:55.769028Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.769028Z"},"links":{"cited_paper":"/paper/2409.12640","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:5704a6c81f4725552b2b4fef46520b1b4952693426baf29da95c8bbd395a831a","observation_id":"dfd620be-4ca2-4fe0-a787-8604388a9465","resolution":{"observed_at":"2026-08-06T17:59:55.769028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:55.835525Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.835525Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:806da162881d6e03f3cdf6858f2a6c8c0e0d77c598595f42e3f7115822504de7","observation_id":"47515034-963f-4721-8dee-f051e8c6c1ff","resolution":{"observed_at":"2026-08-06T17:59:55.835525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:55.971322Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:55.971322Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:8030704d801b76f8aefba97cd1b6fdd08cc9b4ace96d78b295beced5ce94c756","observation_id":"8aa57f2b-9cfc-4225-9988-2045d2457b0a","resolution":{"observed_at":"2026-08-06T17:59:55.971322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.342297Z","title":null,"venue":null,"work_id":"f7ce2dcf-045f-4074-97bd-0688bf69072b","year":2025},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.044794Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:050405fcb878bff16d4dc2cd1e2b129a67286081f0c45cdcd8410269ef29125e","observation_id":"7f340d44-47f5-44b6-b1d1-fba23f2eaaec","resolution":{"observed_at":"2026-08-06T17:59:58.438909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:58.169812Z","title":null,"venue":null,"work_id":"5cd7b25a-5f04-4099-9a2a-afbc8e5738f7","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.185711Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:8f5ea0e0ea3d9bbcf441a49512c738f2b0da0c43e89964241c281bedddc0dbd8","observation_id":"f7fa1a4b-f35c-4e67-aaa5-d810cfc42fed","resolution":{"observed_at":"2026-08-06T17:59:58.257412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02694","last_updated":"2025-03-06T18:41:54Z","snapshot_observed_at":"2026-08-06T10:41:12.245173Z","submitted_at":"2024-10-03T17:20:11Z","title":"HELMET: How to Evaluate Long-Context Language Models Effectively and Thoroughly","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02694","snapshot_observed_at":"2026-08-06T17:59:56.251833Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.251833Z"},"links":{"cited_paper":"/paper/2410.02694","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:7d32d3a8c9e74912c4220c4174a0a8e97728815099338544f75a01bafe5d2090","observation_id":"c53058d7-0c5f-4868-9881-57a94bea899b","resolution":{"observed_at":"2026-08-06T17:59:56.251833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:57.986370Z","title":null,"venue":null,"work_id":"db1003f4-de4a-4cd4-9958-6e4a7cbfe71b","year":2023},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.391825Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:5aaa2da051957843375265740458156cf787fcfcb151722df7fe61dd933f2ebe","observation_id":"64f71471-6d7d-4c91-bb05-39264fa9a6f6","resolution":{"observed_at":"2026-08-06T17:59:58.081869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:57.785763Z","title":null,"venue":null,"work_id":"4c30ed17-749b-42bb-a89f-6471638ef8c5","year":2025},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.484329Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:e70dc9d309fc7893d2aef88b5ef1a5ef05047d06beb7b70462be02eed58c106e","observation_id":"5ce3b21d-e3f6-4c63-bbe4-5d2b0090c863","resolution":{"observed_at":"2026-08-06T17:59:57.874288Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02897","last_updated":"2024-09-10T07:43:19Z","snapshot_observed_at":"2026-07-06T19:10:29.880696Z","submitted_at":"2024-09-04T17:41:19Z","title":"LongCite: Enabling LLMs to Generate Fine-grained Citations in Long-context QA","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02897","snapshot_observed_at":"2026-08-06T17:59:56.569009Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.569009Z"},"links":{"cited_paper":"/paper/2409.02897","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:e5453f05dda7e2054fc6dc6da309d1236b1fb2af00301a3e63a07ae98759447d","observation_id":"24a99fe2-bc9f-463c-858d-ead932f7ab0c","resolution":{"observed_at":"2026-08-06T17:59:56.569009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:57.641315Z","title":null,"venue":null,"work_id":"1d4d3999-4d1c-40df-a141-6a89c768c3cf","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.652817Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:19de3f6ad9da783f75d0510fd5020175b67acdd2bf307994796da2b20ca43f04","observation_id":"939bbddd-0b0f-4f2e-a76e-e124788d940f","resolution":{"observed_at":"2026-08-06T17:59:57.716593Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:57.461627Z","title":null,"venue":null,"work_id":"d845bdfb-dcf9-450e-a33c-1af571f1b990","year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.770202Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:935ba3082ba415f48cc7cb49b4174e8eba435231260fbe9f4fadac6828fcbad0","observation_id":"76290f73-abc8-4e66-ad3b-cc1c33d60175","resolution":{"observed_at":"2026-08-06T17:59:57.547853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-06T17:59:56.813814Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.813814Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:bd7cc2752d58ff3557d41cb9ae2543046dc283558c14c85ef0163d2a8084f969","observation_id":"a8f80821-cfb5-4d70-a2c0-0b0c546757c4","resolution":{"observed_at":"2026-08-06T17:59:56.813814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:56.869075Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.869075Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:a93346cb99d5ad777835c3b5ec6c15f8216dc8e861ff0afed1b3c46bb685e5b7","observation_id":"99fbf921-423e-4723-ad57-4dde3ceab7e1","resolution":{"observed_at":"2026-08-06T17:59:56.869075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:59:56.975960Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:56.975960Z"},"links":{"citing_paper":"/paper/2507.09506"},"observation_digest":"sha256:3a38fbf5dbe21cf88818d5de195a0835e585036f26cf6c421df21c6907b38634","observation_id":"7e07e9f0-5a79-444d-8452-18fee2fefcb0","resolution":{"observed_at":"2026-08-06T17:59:56.975960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.09506","last_updated":"2025-08-04T01:12:15Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T17:51:50.204391Z","submitted_at":"2025-07-13T06:17:53Z","title":"Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2507.09506."}