{"as_of":"2026-08-14T02:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26bebf427b3f20cd97c47ec891acdb06772489302e159bdb470da07c457ad567","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T23:56:42.264337Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T05:09:49.727492Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T16:38:40.580304Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"cited_work":{"arxiv_id":"2605.02035","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.02035","snapshot_observed_at":"2026-07-03T16:38:40.580304Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","venue":"cs.CL","work_id":"0af6ca80-edc2-414e-8f4d-5abeea8957d4","year":2026},"citing_paper":{"arxiv_id":"2606.14383","last_updated":"2026-06-16T03:59:08Z","snapshot_observed_at":"2026-08-13T02:48:41.393159Z","submitted_at":"2026-06-12T12:18:00Z","title":"IndustryBench-MIPU: Benchmarking Multi-Image Attribute Value Extraction for Industrial Products","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T05:09:49.727492Z"},"links":{"cited_paper":"/paper/2605.02035","citing_paper":"/paper/2606.14383"},"observation_digest":"sha256:88eb868a09e4fa194746be28733905965e05e1ae8f6fafc9dd08c308ae14f5f4","observation_id":"8cc521f9-df80-4b74-87f6-cc2b362792ab","resolution":{"observed_at":"2026-07-03T16:38:40.581750Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.02035/citation-record","integrity":"/paper/2605.02035/integrity","json":"/paper/2605.02035/citation-record.json","paper":"/paper/2605.02035"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:06caa2593d1e732ffe959eb0297f19f9b27dee6fb5609aa67742531e5faab190","observation_id":"40070c17-38a2-4bbd-9434-1f7bbc3b90b3","resolution":{"observed_at":"2026-07-01T00:55:12.245563Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.965272Z","title":"Describe how these elements con- nect to the text","venue":null,"work_id":"c202b379-5815-420a-baf5-c61f1f26cde0","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:047d5804c72696aa42b036c584b69abc968fff409885d660b0cf48d6887cfb87","observation_id":"6bcec1fa-d70d-46f7-aec1-d6ac779e31c0","resolution":{"observed_at":"2026-07-07T09:43:36.966597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.970999Z","title":null,"venue":null,"work_id":"a2cd98e5-b472-4ce2-812f-790cc145168b","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:6e8e3e145c1391c5ed16569b71f98f56a99b7f0a0034ca064372580e64235489","observation_id":"ffa91c4a-1c91-4391-a7c7-77da7879cccf","resolution":{"observed_at":"2026-07-07T09:43:36.972270Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.978028Z","title":null,"venue":null,"work_id":"8b290c46-74db-424d-bd84-7310ab450db6","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:a076eaeeef68f53a854c9707ce5be0e97e0fea4a780d30ce9915f1b1e53dc85e","observation_id":"baee153e-901a-425d-ad53-6c829253415e","resolution":{"observed_at":"2026-07-07T09:43:36.979477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.974525Z","title":"While visual grounding establishes a mapping between the image and the text, the initial translation can still leave some ambiguities un- resolved","venue":null,"work_id":"25f93f34-8edb-4435-a8d8-6a6cad393bd8","year":2024},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:742039aaf39ff6da093130faab70c754d2dbc6dbdcd560ec9b9d05ff8cde42c9","observation_id":"29574f6d-5bd3-46c6-8a09-4f6879ed673f","resolution":{"observed_at":"2026-07-07T09:43:36.977469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.980098Z","title":"This constraint prevents unnecessary modifications to the sen- tence structure and helps maintain overall translation fluency","venue":null,"work_id":"b6415383-7ce8-420d-9152-9025b3eeb6cf","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:c9db26474ff071cc9c86d31347d39b1b612ca8b996cca20779c8416db9b43df6","observation_id":"875eb38f-105c-430d-a7f0-a4c8ea1d5f0c","resolution":{"observed_at":"2026-07-07T09:43:36.981451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.972794Z","title":"object\", which requires a concrete translation (","venue":null,"work_id":"fc5f0596-59be-4f10-9c34-59b971368619","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:1f33c3c099388f7926fed3bcd5557982a225a03cff9be7dd03c39bc2931a5419","observation_id":"b48a8437-c4ee-4ce1-b567-5695632c63c7","resolution":{"observed_at":"2026-07-07T09:43:36.974018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.967111Z","title":null,"venue":null,"work_id":"19bb3e26-ff9a-43b6-8b5b-1687f4786850","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:e6f3abf6ba0473177c84d314ab7a273b4a1972c21ffb554a2e09ffe83852cd16","observation_id":"ad34308f-39b0-4f85-9cfb-345dc6f6df02","resolution":{"observed_at":"2026-07-07T09:43:36.968371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.958500Z","title":"- The reason it is ambiguous (how multiple interpretations can arise)","venue":null,"work_id":"a3fcc409-b61a-4a4f-8f75-7540f04c8e98","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:f549a69d23f7f5a83a9f88584f1d55df061539447ece2bf02c8835bd9801b005","observation_id":"221f054e-3497-40db-8e25-77551046cd4e","resolution":{"observed_at":"2026-07-07T09:43:36.960769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.956602Z","title":"bank\" = financial institution vs. river bank). - Syntactic: the sentence structure permits multiple interpretations (e.g.,","venue":null,"work_id":"5e11a700-2d21-4c50-8942-ad4940b03199","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:0c05cdf567823a249d7e41c7f4da0c2c4d44a921992c2e44bc7b40919482e9ea","observation_id":"06bdd0a7-da72-4e84-b40a-cc6ebabc00e2","resolution":{"observed_at":"2026-07-07T09:43:36.957786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.961366Z","title":"- If two ambiguities from different models share the same type and describe the same underlying issue, merge them","venue":null,"work_id":"f47c37ca-4219-4442-9f59-dcf86bd8775a","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:d6c62bc5500aa4ee9dd04643f044135e48c8c29e0599adcfec6ac11046e55ae5","observation_id":"d8ede4db-61a6-4fbd-a108-621e0677ad06","resolution":{"observed_at":"2026-07-07T09:43:36.962785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.963468Z","title":"- translations: union the translation candidates from both sources, removing exact duplicates","venue":null,"work_id":"14afcf21-1d1f-4c78-b13b-845e95864710","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:b6bd48e89c0a2f1da0bc9c07fbd32346bcf9dc89c5cfa9b90e5033c880d7e127","observation_id":"74919a61-825b-479d-b46e-c9b955b201e0","resolution":{"observed_at":"2026-07-07T09:43:36.964745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.968990Z","title":"en\" field), extract the literal word(s) or phrase(s) that cause each ambiguity. - Save them into a new field","venue":null,"work_id":"379d462c-ab38-4b3a-a662-45ebe41a7a7c","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:3fe093134e1f39a475f36423168ccad6530000ff402171d1a352e5a99df9de7d","observation_id":"ab2db17e-0a7b-487a-8971-9a3cb49c586f","resolution":{"observed_at":"2026-07-07T09:43:36.970442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.948801Z","title":null,"venue":null,"work_id":"2ae864d2-18a9-48e8-ab74-30ff324fc8f4","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:d3cbf8eea432d258e7a48dedd43999a110aba6fce9427d33ce995980e716c943","observation_id":"152725d9-c327-405e-9904-14e46a9718b6","resolution":{"observed_at":"2026-07-07T09:43:36.949963Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.950512Z","title":null,"venue":null,"work_id":"dd111a7c-d893-4c85-896e-161e6d74fb09","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:57d81dbf15b68625b9a629d9e767d5a28eeb254a922af3d4898f220522aadd92","observation_id":"5a22858b-d367-42a3-86ce-ae2d2519272f","resolution":{"observed_at":"2026-07-07T09:43:36.952488Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.953196Z","title":"translation_zh","venue":null,"work_id":"0a7f9e18-82a8-4339-a957-80e79650d632","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:419dc53e4a22c53ec042447838e98daa4daf8c1031c5fa2e91a480261dda5f24","observation_id":"c2b33d34-f977-4857-8464-8ddb8647653a","resolution":{"observed_at":"2026-07-07T09:43:36.954434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.954972Z","title":null,"venue":null,"work_id":"d1b3f8fb-d2d0-4ca9-9ca2-3b8bdbf3b916","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:820986acc4f61382039945e116dbeab1c42c316473eb4135da577e270013fd04","observation_id":"1dcab501-e346-41ce-b94f-22acb1b1f775","resolution":{"observed_at":"2026-07-07T09:43:36.956081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.940625Z","title":null,"venue":null,"work_id":"1f6cdca1-9386-447a-b77d-1d98ee41a5e5","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:6c3f7968420898cd9f742f28797c9b6cd94d845c9165af5e78917dfc7aa042ed","observation_id":"7b87a4d7-ee60-48cc-882b-c10fcc79cae5","resolution":{"observed_at":"2026-07-07T09:43:36.942773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.943696Z","title":null,"venue":null,"work_id":"cc6e98a2-854d-4fc5-939b-db875aa0800b","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:bb4b0511aee530b39e2b71bc7062c219910860762f23a3b06f6ae5c23b47ab81","observation_id":"a777345e-1306-4bbc-9c06-b4fb0b6d47a2","resolution":{"observed_at":"2026-07-07T09:43:36.944875Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.947235Z","title":null,"venue":null,"work_id":"225edecc-25a9-4284-a52e-a66d0e11c4a8","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:f62f1d875aec9a5219b4d0b1d3a8330dc3a1e62a8d93eca2171b38a47aa33277","observation_id":"4d764595-56c8-4f82-b276-7baa8454d721","resolution":{"observed_at":"2026-07-07T09:43:36.948271Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T09:43:36.945423Z","title":"Correct\". - If the meaning is missing or distorted, return","venue":null,"work_id":"c22a8bac-1a09-4a15-9ec9-3819143a0154","year":null},"citing_paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:42.264337Z"},"links":{"citing_paper":"/paper/2605.02035"},"observation_digest":"sha256:bebb74dc1c302ca3fb1a58bf21e98e0bd398411990b69dbd16559c7b5082d25c","observation_id":"8f997998-ade7-4145-95ec-d873526a864a","resolution":{"observed_at":"2026-07-07T09:43:36.946680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.02035","last_updated":"2026-05-26T13:27:57Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T01:30:58.370887Z","submitted_at":"2026-05-03T19:55:06Z","title":"VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 1 inbound Pith citation observation for arXiv:2605.02035."}