{"as_of":"2026-08-23T17:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:95d4d9a2dc85785d01795f8e4a917d59dacd87565a9f37cdec009f7844797184","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T13:08:48.902025Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:30:16.403507Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-16T12:30:17.233809Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"cited_work":{"arxiv_id":"2502.02167","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.02167","snapshot_observed_at":"2026-08-16T12:30:17.233809Z","title":"Multilingual Attribute Extraction from News Web Pages","venue":"cs.CL","work_id":"00562feb-aa80-45a1-8447-abe856fbe260","year":2025},"citing_paper":{"arxiv_id":"2504.12682","last_updated":"2025-04-17T06:16:40Z","snapshot_observed_at":"2026-08-20T15:02:27.476571Z","submitted_at":"2025-04-17T06:16:40Z","title":"WebLists: Extracting Structured Information From Complex Interactive Websites Using Executable LLM Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T12:30:16.403507Z"},"links":{"cited_paper":"/paper/2502.02167","citing_paper":"/paper/2504.12682"},"observation_digest":"sha256:b8d4cebc7a1481d8c9243eb2f5abfe126b90f8ba09fe20a7cb0b59e92f570bec","observation_id":"ddd914dd-db45-4b85-a81d-33c9dba67433","resolution":{"observed_at":"2026-08-16T12:30:17.238147Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02167/citation-record","integrity":"/paper/2502.02167/integrity","json":"/paper/2502.02167/citation-record.json","paper":"/paper/2502.02167"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.924787Z","title":"Markuplm: Pre-training of text and markup language for visually rich document understanding,","venue":null,"work_id":"e7091387-75f0-47d9-9d9e-404947f53f30","year":2022},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.579317Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:137ad3461ba90840db3cc6bd594a65901f756483b2ae3465bed29ed267720f8e","observation_id":"03e96e32-03aa-4e15-baf1-34334b20e9ef","resolution":{"observed_at":"2026-08-09T13:08:49.928019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.10608","last_updated":"2022-01-25T20:10:32Z","snapshot_observed_at":"2026-08-19T23:43:32.275478Z","submitted_at":"2022-01-25T20:10:32Z","title":"DOM-LM: Learning Generalizable Representations for HTML Documents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.10608","snapshot_observed_at":"2026-08-09T13:08:48.619437Z","title":"Dom- lm: Learning generalizable representations for html documents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.619437Z"},"links":{"cited_paper":"/paper/2201.10608","citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:c3b4d2abff973758c5888ecf35bb849d7e49c6751d79b847e5eca4cf158fdc85","observation_id":"e0373d75-3f81-44f2-9f74-82877e0e448e","resolution":{"observed_at":"2026-08-09T13:08:48.619437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.912952Z","title":"From one tree to a forest: a unified solution for structured web data extraction,","venue":null,"work_id":"102b98f1-4fb5-4d4d-b566-98ef6d16b7a0","year":2011},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.624731Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:0f3fe3ff2089dc99fc7a7dd6e8ddc9577c5d60000ecadb0eed3e21e976211373","observation_id":"2dd98728-9837-4149-8187-09ba01206563","resolution":{"observed_at":"2026-08-09T13:08:49.917186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02168","last_updated":"2024-02-23T19:22:23Z","snapshot_observed_at":"2026-08-20T15:02:50.668626Z","submitted_at":"2021-11-03T12:13:52Z","title":"The Klarna Product Page Dataset: Web Element Nomination with Graph Neural Networks and Large Language Models","version":4},"cited_work":{"arxiv_id":"2111.02168","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.02168","snapshot_observed_at":"2026-08-09T13:08:49.113330Z","title":"The Klarna Product Page Dataset: Web Element Nomination with Graph Neural Networks and Large Language Models","venue":"cs.LG","work_id":"447a1bae-5dea-4907-8527-d4061b5c5fe4","year":2021},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.629398Z"},"links":{"cited_paper":"/paper/2111.02168","citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:605c0066574c4011629113db51902d978878f0212de95cf137c3c75e9b7d98cc","observation_id":"cf338c18-cf25-4114-b2fa-4a1c96946438","resolution":{"observed_at":"2026-08-09T13:08:49.177818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.12320","last_updated":"2021-10-24T00:21:46Z","snapshot_observed_at":"2026-08-21T19:33:29.930689Z","submitted_at":"2021-10-24T00:21:46Z","title":"CoVA: Context-aware Visual Attention for Webpage Information Extraction","version":1},"cited_work":{"arxiv_id":"2110.12320","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.12320","snapshot_observed_at":"2026-08-09T13:08:48.942000Z","title":"CoVA: Context-aware Visual Attention for Webpage Information Extraction","venue":"cs.CV","work_id":"359ecdbc-3dc9-420e-9dcc-74ebb83b0148","year":2021},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.635283Z"},"links":{"cited_paper":"/paper/2110.12320","citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:2555386709786dd2f47f6299c5355d39eecaff7e42ffd16153afcb2ca157ed3b","observation_id":"da61feb0-b491-473f-afbf-224dbb069da9","resolution":{"observed_at":"2026-08-09T13:08:49.031823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.702668Z","title":"A dataset for information extraction from news web pages,","venue":null,"work_id":"b24eb9fe-989d-4632-97a0-22d09b9b7021","year":2022},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.639951Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:0a1d94177147c052da4147f794ca3766252a14c485dec2af78e0ee19acd61461","observation_id":"77d64342-3736-4a6b-8fcc-de5408d31986","resolution":{"observed_at":"2026-08-09T13:08:49.823689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-09T13:08:48.644940Z","title":"Roberta: A robustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.644940Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:16bf84d5c8c19434327bf51f50988a94fe88cc81befc31f384debc43d0587f7b","observation_id":"680cef1e-e914-4eba-963e-9dea390b3c45","resolution":{"observed_at":"2026-08-09T13:08:48.644940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.689699Z","title":"Learning structural co-occurrences for structured web data extraction in low- resource settings,","venue":null,"work_id":"68df6b25-e3d4-4d7a-931f-a00b48e78c7c","year":2023},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.650530Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:19fbdbbc8922dd75ab5afccd21b6f231a46384f6e5d0edf535e629fa15a3236e","observation_id":"60552130-13a0-4004-976c-e339059d136e","resolution":{"observed_at":"2026-08-09T13:08:49.694676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.502902Z","title":"Hierarchi- cal multimodal pre-training for visually rich webpage understanding,","venue":null,"work_id":"e4ae12f2-53cf-45ce-b2b4-0f9fff703348","year":2024},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.655372Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:b163942018923501bb4aefddc355b2174ed6f6c97a6cb687c43591a3a46e6fc9","observation_id":"3ec5dff3-725c-41c9-b65e-d70c6de5f57d","resolution":{"observed_at":"2026-08-09T13:08:49.636022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.423511Z","title":"Label Studio: Data labeling software,","venue":null,"work_id":"bf42fcfd-756a-4976-affe-698b7ae2194e","year":2020},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.678412Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:648caed41731c38d76afa0ef9b008de3139bce9bae9eb3aa7f1d7e865fb16f2e","observation_id":"206ed75b-9da7-4a5c-b60d-ad4450579a4a","resolution":{"observed_at":"2026-08-09T13:08:49.427473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.411511Z","title":"Un- supervised cross-lingual representation learning at scale,","venue":null,"work_id":"d8cf622d-9d2a-4e54-a650-298adfe87417","year":2019},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.763569Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:00dd77e4e33dc1efed7849b9600cbbcb79c9a2c153192e9f96449812f4e6bcb0","observation_id":"81a6b8d9-f36a-4db8-b01d-33df71bc5dfe","resolution":{"observed_at":"2026-08-09T13:08:49.415588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.339050Z","title":"Neural machine translation with byte- level subwords,","venue":null,"work_id":"19203f7e-1f14-44eb-be0f-4aeee6a5f397","year":2020},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.894276Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:f2d5844819b20102d5e30b847a98de516c089fa8a0ce06e81862c9662e98c4a1","observation_id":"5b63ebbe-8f1c-437a-a651-efb203ed131e","resolution":{"observed_at":"2026-08-09T13:08:49.403821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.207115Z","title":"Trafilatura: A Web Scraping Library and Command-Line Tool for Text Discovery and Extraction,","venue":null,"work_id":"441b3f3a-e7ac-471b-86f2-6b8c9569e4b5","year":2021},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.898364Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:bcd4d097fbebe02f892ad76a79a7549ffab77cc5a190f95875e8745184db89e1","observation_id":"d7c63974-01b8-48ce-a83d-c3a74a98216b","resolution":{"observed_at":"2026-08-09T13:08:49.253528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:08:49.196014Z","title":"news-please: A generic news crawler and extractor,","venue":null,"work_id":"a10392fc-dbb1-497b-b0eb-6be05810d523","year":2017},"citing_paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T13:08:48.902025Z"},"links":{"citing_paper":"/paper/2502.02167"},"observation_digest":"sha256:0919f7f4b54c9968cf690bddd2b7a8136166d173d682528757545b3ba536c3a7","observation_id":"8bc3801a-862f-49ba-9fcc-48db1740c9c1","resolution":{"observed_at":"2026-08-09T13:08:49.199622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02167","last_updated":"2025-02-04T09:43:40Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-22T04:58:46.123377Z","submitted_at":"2025-02-04T09:43:40Z","title":"Multilingual Attribute Extraction from News Web Pages"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":2,"verified_fuzzy":10},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 1 inbound Pith citation observation for arXiv:2502.02167."}