{"as_of":"2026-08-16T14:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7657a02807a7ac51ed522cbcd83d2636b29c4586038aad579a31121bd4689dc8","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:29:24.678833Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.11843/citation-record","integrity":"/paper/2608.11843/integrity","json":"/paper/2608.11843/citation-record.json","paper":"/paper/2608.11843"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:25.122524Z","title":"to sink” and “metal","venue":null,"work_id":"a94afaa4-5ab9-47d0-b2a0-8fbbdd0c06fd","year":2021},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.564293Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:ae3db9e83e62b55216fd8a739a621c9e5b5a51fa62f15386dd5348024a58aac2","observation_id":"456ebc48-7e36-4588-be78-5462102ec0aa","resolution":{"observed_at":"2026-08-16T00:29:25.126787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:25.107592Z","title":"Of 527 expert annotations, 31.1% lie outside the injection pipeline; for NER Recall the figure is 0%","venue":null,"work_id":"f65f76da-593c-431c-a94a-39516c7c0b01","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.570938Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:027d9320f2fbbba0306c6714c5cae7613c366d73db80505a4fba26a0ba486746","observation_id":"a0ca77cc-f4de-4245-9097-927595501918","resolution":{"observed_at":"2026-08-16T00:29:25.112703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:25.093379Z","title":null,"venue":null,"work_id":"1f3a1e9f-59b6-4dd3-a04c-506fe89ff4e4","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.576799Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:7b13dd3bf185a58dd9568bbe688d8e7cd19ac775cf4863190724b2685a3e63e1","observation_id":"f19a6dd4-958c-402c-8484-47fd3d1acb22","resolution":{"observed_at":"2026-08-16T00:29:25.098759Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:25.079867Z","title":"Hardening the scoring protocol (over-generation penalty, positional check) is left to §10 as future work","venue":null,"work_id":"c877e105-e992-4e54-bb07-237d562ab433","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.581693Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:93c6c53c7dcd8c5584574bea4bf43438beb68240eb6dda2d087d27d273346541","observation_id":"b9cda9b9-56cf-496b-b73c-331c1581d4c0","resolution":{"observed_at":"2026-08-16T00:29:25.084603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:25.064749Z","title":"Shared Heritage, Distinct Writing","venue":null,"work_id":"f23d9a92-fe3e-4858-a691-06e8c98af341","year":2021},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.586683Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:626ff08b5033fb0eebdd651dda4396cf6964435d89f47b77676b4d3085a0932d","observation_id":"557f1a6b-0ad8-48b6-934f-64cd3c19f09b","resolution":{"observed_at":"2026-08-16T00:29:25.069950Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.996319Z","title":"negligible transfer","venue":null,"work_id":"43006ba5-9703-4cfa-92b5-53d45cfbb7c4","year":2025},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.611903Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:3f7b61aae4fcc15e95b29c90097e8b066fdd86ba526b8aab3effbf09a222c9d8","observation_id":"7e9e6c58-1b0c-4c40-8dc4-c2f56502853d","resolution":{"observed_at":"2026-08-16T00:29:25.000418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:25.034326Z","title":"The injection and scoring pipelines, and the segment where they still share a resource","venue":null,"work_id":"c797dce8-4313-4992-a5d2-afad176b8edc","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.595900Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:870a6c05fe13cc4ba6f334fb2f22b2f3ab9547de6b12ab6fe5eb85e6ff1859d9","observation_id":"43569f80-a1f1-4979-b682-6b8f57e66cea","resolution":{"observed_at":"2026-08-16T00:29:25.039569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:25.021676Z","title":"All counts in §4 are stated over the 527 expert tags whose reading could be resolved","venue":null,"work_id":"b14589f2-b6fd-404c-9ddf-0278660e922c","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.601565Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:4efeb8cc4023583a9adf22f0b99b1f97a79a9465462eb9c1d9f3710ee84268cf","observation_id":"14e37933-3afe-449e-b915-1e8122512e77","resolution":{"observed_at":"2026-08-16T00:29:25.025941Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:25.008666Z","title":"of course there is no effect where nothing was injected","venue":null,"work_id":"b13c1556-06ed-4e1c-a0e5-b9fae8dbae2b","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.606371Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:cc5ee41b21d9f72d2611b8f42086f71e9fc879efcc66721a6b0e4af0f0d382c2","observation_id":"2b25a409-f24f-4a85-82bc-326efc619e04","resolution":{"observed_at":"2026-08-16T00:29:25.013230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.839257Z","title":"append the term at the end","venue":null,"work_id":"bde1c2f4-302a-4487-9824-a53939323fe8","year":2021},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.668216Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:1af8f378b97bbb9bd9f24660f3dd93360d20e4d7a89933a4077b7b89f98b73bf","observation_id":"72ef8bc9-382a-48b8-8bae-741c8bb17ded","resolution":{"observed_at":"2026-08-16T00:29:24.846194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.983098Z","title":null,"venue":null,"work_id":"e7a8a8dc-8d97-443f-9976-fca4903b5737","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.616930Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:3bf2aa468acc10b642038fd0a6f4d201445ff0f915b4094d5dd72ae66b172f91","observation_id":"d3085807-5170-493a-ad0c-254f6f43a838","resolution":{"observed_at":"2026-08-16T00:29:24.987849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.970373Z","title":null,"venue":null,"work_id":"7bb444f2-4439-420a-bbab-8f247015e27e","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.622145Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:2aa4ba5efc3ce8c0a0adc630755545ea89ba2a83174e9bfad8eb8871c8715b86","observation_id":"4da531d8-e6ac-473c-b60d-03963ea93fa0","resolution":{"observed_at":"2026-08-16T00:29:24.974670Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.955472Z","title":"But a zero budget also means no money for an expert gold standard, so a knowledge base is substituted — and that is exactly where the loop appears","venue":null,"work_id":"d85f73e7-8cbe-4a52-a869-88ab1a9cd40a","year":2023},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.627151Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:67412aa1ec63e186e635fa47b22975c23de0e952a87821f456b617bb9b581c60","observation_id":"a6ee4681-d080-4585-959a-7c4bbd77bfe7","resolution":{"observed_at":"2026-08-16T00:29:24.960458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.936948Z","title":"Here we injected from NER output and scored against expert annotations; once separated, an independence rate can be reported","venue":null,"work_id":"696288da-2853-4c83-8e88-2c2128647175","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.633605Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:ed5e85930793d52b989793343ade68e5f5478073ba0945862db3d120d829e3da","observation_id":"3f829e51-b65f-4327-8947-6d682b674390","resolution":{"observed_at":"2026-08-16T00:29:24.942098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.921455Z","title":null,"venue":null,"work_id":"339993ab-bbcb-458c-bb09-b91500b6d1a2","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.637489Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:0fd39356bfd1f4acf3d9b2333ea002db1af98a5bc5ff67b72bc00988bc3477cb","observation_id":"1df0b1b3-2d65-4bde-a5b4-212cf7206599","resolution":{"observed_at":"2026-08-16T00:29:24.926258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.902716Z","title":"Separate the segment whose gold overlaps the system’s resources from the segment that does not; this alone reproduces the difference-in-differences of §5.2","venue":null,"work_id":"b27d76b6-5671-4f87-8ec4-cb86cf7f3a77","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.642577Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:f8dad33439a704ed078830935aa3bd52490dfdf8e24e080a7562410219530b01","observation_id":"eb2465fd-50c0-4d92-9f5a-86228850168a","resolution":{"observed_at":"2026-08-16T00:29:24.909240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.887682Z","title":"If the gain approximates the complement of prior performance, it is likely an artefact of the measurement rather than an effect of the method","venue":null,"work_id":"27e302c4-40e5-4a32-aa5e-293fe742a365","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.651675Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:e638221462558242c1b709bbfa9b62e705068ec036d1de522723b4abfedd5ac2","observation_id":"c26d72bc-4943-48d2-81b9-419651c7bb7b","resolution":{"observed_at":"2026-08-16T00:29:24.893294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.872813Z","title":"As §5.5 shows, such a gold penalises the more competent model more heavily","venue":null,"work_id":"cfd0ea2f-80fb-4eac-a641-2fd9a60c1951","year":null},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.658868Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:214862eef4e8838a3f08d1dd7cf804d7a8f1b142577f5833446161094805dc17","observation_id":"86a8cdc3-1c2d-4703-a8fd-3c87149fc6f8","resolution":{"observed_at":"2026-08-16T00:29:24.878252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11891","last_updated":"2021-06-24T22:51:51Z","snapshot_observed_at":"2026-08-03T23:39:05.385259Z","submitted_at":"2021-06-22T15:59:32Z","title":"On the Evaluation of Machine Translation for Terminology Consistency","version":2},"cited_work":{"arxiv_id":"2106.11891","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.11891","snapshot_observed_at":"2026-08-16T00:29:24.820220Z","title":"On the Evaluation of Machine Translation for Terminology Consistency","venue":"cs.CL","work_id":"e85138a6-49c3-4cee-8c8f-d947ba7b2de3","year":2021},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.673313Z"},"links":{"cited_paper":"/paper/2106.11891","citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:31a2cdfd62e45d47c3e8c7a2c02485e01e0a588d5eede9f2cdcf087c80f949e6","observation_id":"f54c4c8c-1853-4543-9f08-26c45bb9a212","resolution":{"observed_at":"2026-08-16T00:29:24.827201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:25.048724Z","title":"circularity — leaking the evaluation signal into the system","venue":null,"work_id":"649af419-8cd9-4165-98c2-8baf00d2a8bd","year":2024},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.591626Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:7c6aca8a44192128b8cd6a8ea12a701ef93149530df05c4770a24bd6c22f4218","observation_id":"4136b8e5-9c4e-410e-80e4-a1a8db7e16c2","resolution":{"observed_at":"2026-08-16T00:29:25.054847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.857445Z","title":"Our contribution to that line is methodological: rather than adding a performance figure, we ask under what conditions such figures can be trusted","venue":null,"work_id":"b4ed2aeb-9d28-46a7-9e86-3a09c5483ac5","year":2022},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.662966Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:8fc17e04778dd13f41eb135948bed72b1e2378298b9cc558d324ff9a549a771a","observation_id":"72af93d5-998d-4f24-9d4e-8d573bb79ddd","resolution":{"observed_at":"2026-08-16T00:29:24.863275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:29:24.678833Z","title":"circularity — leaking the evaluation signal into the system","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation","version":1},"reference_index":2557,"source":"pdf_text","source_observed_at":"2026-08-16T00:29:24.678833Z"},"links":{"citing_paper":"/paper/2608.11843"},"observation_digest":"sha256:3a831e69f971aa82b5b7dff08bd699e6a881f4281e88ce32425ccd768f930176","observation_id":"a8004677-1726-4f44-a5bb-7ae133948a2f","resolution":{"observed_at":"2026-08-16T00:29:24.678833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.11843","last_updated":"2026-08-12T09:33:59Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:30:14.293324Z","submitted_at":"2026-08-12T09:33:59Z","title":"When the Knowledge Base Becomes the Gold Standard: Measuring Resource-Shared Evaluation Loops in Entity-Level Machine Translation"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":14},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2608.11843."}