{"as_of":"2026-08-07T18:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf351e9e14166b9722d28f29671bdc64c8b1d4c972647ea1542a2f0ed4ca411c","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:27:19.557506Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18105/citation-record","integrity":"/paper/2506.18105/integrity","json":"/paper/2506.18105/citation-record.json","paper":"/paper/2506.18105"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.397378Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.397378Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:94c6bf2de79775d8ddc3b97f4491136ff592aac253ec393f4c3d8286089f5abe","observation_id":"04413bc8-ef2d-46f2-8f86-defac231cffd","resolution":{"observed_at":"2026-08-06T23:27:19.397378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.402020Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.402020Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:bf77bdfdff8a8339fb721c3ad4a433c27ba8c9d11176ce4c00308ae2df9e3a3f","observation_id":"849161ce-f034-4894-8b50-ad5a1c43bf9f","resolution":{"observed_at":"2026-08-06T23:27:19.402020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.406440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.406440Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:d55073c4094f099347e1172d464cf336cce03d842b8a51804fd7adc2b3b73903","observation_id":"ac448605-d127-4f91-8f0f-eaeb41afbad7","resolution":{"observed_at":"2026-08-06T23:27:19.406440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.996250Z","title":null,"venue":null,"work_id":"55b31d4c-650c-43a2-a768-3e9b920a55bd","year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.411030Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:51e36fdab442dc91091ca304bbde3f85dd68d43f5249a8b9cebd89428a1ed0dd","observation_id":"35047579-0696-4bb0-8531-e816623e759c","resolution":{"observed_at":"2026-08-06T23:27:20.000812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T23:27:19.415168Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.415168Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:832b87353c34abe19c51c5642319440b620a9f9e01b3422b834e3d520dde21fc","observation_id":"f146693c-c2c7-42ec-b931-7daced7f5c54","resolution":{"observed_at":"2026-08-06T23:27:19.415168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09407","last_updated":"2024-10-12T07:28:10Z","snapshot_observed_at":"2026-08-03T14:20:40.236993Z","submitted_at":"2024-10-12T07:28:10Z","title":"CAMPHOR: Collaborative Agents for Multi-input Planning and High-Order Reasoning On Device","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09407","snapshot_observed_at":"2026-08-06T23:27:19.420079Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.420079Z"},"links":{"cited_paper":"/paper/2410.09407","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:3bef4c10e58f89c8bc5a40419e06ac5e91d9d2587051c0ba12e9f98b5b68dc80","observation_id":"ccadc2d8-02ee-40ce-984e-1df9d00c976f","resolution":{"observed_at":"2026-08-06T23:27:19.420079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.983910Z","title":null,"venue":null,"work_id":"061406c2-3877-4aa0-aca7-584c049ae7f8","year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.424225Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:25332c8642194a30a50fdcc0c36683f7b8a1c149d5d9742a23477eae5afb4fe5","observation_id":"f809f70e-d6ab-42bd-b67c-880ee6dd4e54","resolution":{"observed_at":"2026-08-06T23:27:19.988535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:27:19.428449Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.428449Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:366332ac08159c64a8c939720cb4916dc17eb5c738741cac2bfb71e4cb4a88af","observation_id":"efc816de-e1b5-4359-9e90-78a2eaa3dee9","resolution":{"observed_at":"2026-08-06T23:27:19.428449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.970454Z","title":null,"venue":null,"work_id":"6fdfce3d-5d91-4d5a-8b75-af5c238e0ed2","year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.432735Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:10d6ed730cbdbbaffc2a411ae73f94398a72b80260f062505a02bf1f8147421c","observation_id":"22ea5a89-3bb0-4648-a4fa-75790734a573","resolution":{"observed_at":"2026-08-06T23:27:19.975510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.957544Z","title":null,"venue":null,"work_id":"5782ab92-e547-4b49-b9dd-1050d4e6201c","year":2016},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.436610Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:33f9d55cd6f11476de52f44c9469862a6201ff7daf9381ce3f307ca7d676f73b","observation_id":"dceaf9eb-e7a9-415b-adc8-2964541a23e9","resolution":{"observed_at":"2026-08-06T23:27:19.961544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T23:27:19.440450Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.440450Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:1210e345ad0b8aab0303c9c6d8e7b19ee84a39f8ac7d223e4da222d19972f869","observation_id":"35d3ddb8-2ae8-49f8-a9dc-ab036894fc70","resolution":{"observed_at":"2026-08-06T23:27:19.440450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.945898Z","title":null,"venue":null,"work_id":"dedf00a3-a45c-412c-aed9-0966a2fa672e","year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.444781Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:409df4aee3fe5092682c0bf60d23f63646a94b7b9e8707cc580a06399d8ce3a0","observation_id":"9081a0d3-1eec-4a64-8759-10faa09f6064","resolution":{"observed_at":"2026-08-06T23:27:19.949598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T23:27:19.449045Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.449045Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:48afc17c144efc7e60577b64dcbb9c55d133735bf75f4a995cf6872e4b2e7f94","observation_id":"ba1ad1bd-04f2-4e23-ad95-fd2053997328","resolution":{"observed_at":"2026-08-06T23:27:19.449045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.934092Z","title":null,"venue":null,"work_id":"4a5d6c74-98cf-4a4c-9366-441543973b8b","year":2018},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.453364Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:0e0bcf2c2902620564db9bdb90c0a643526b730b73ba38352254857cab93b9d2","observation_id":"eead1e61-97ef-4f4f-aa7b-5deb68b8d0ef","resolution":{"observed_at":"2026-08-06T23:27:19.938059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.921921Z","title":null,"venue":null,"work_id":"977a59cd-19e9-49e5-8048-a163fae6e547","year":1991},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.456976Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:32c828aa614506ceda8fc74b8c3b08665801e84d607b7afafb4b755705481dc1","observation_id":"401143fa-1dc4-43c7-8e06-c6830a59730a","resolution":{"observed_at":"2026-08-06T23:27:19.926328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.910722Z","title":null,"venue":null,"work_id":"65add0c0-6fd5-4a33-84e3-b6a0cfe48d5d","year":2022},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.460875Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:b002c83f94221367ec87d1bc3b570be27b33dcff86a677775c9b0c8865bb4c8a","observation_id":"035a6d34-df02-4b63-84cb-db978f293733","resolution":{"observed_at":"2026-08-06T23:27:19.914368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.465510Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.465510Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:4b90109532ebf5d6e0c04106596f8144123b530c912f760f304d7e22972f3af7","observation_id":"d89bdce5-8eac-4bba-b641-83d347a71a66","resolution":{"observed_at":"2026-08-06T23:27:19.465510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-08-06T23:27:19.469771Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.469771Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:aa3f00275446336d8d7d422fe4914ffcb0a9906bd65848ba85b651d55f9e6fb8","observation_id":"525fa696-d1d1-4883-9e5b-9a68e08b77f1","resolution":{"observed_at":"2026-08-06T23:27:19.469771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.891110Z","title":null,"venue":null,"work_id":"e5252a42-c845-4898-a023-c0f1d409a507","year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.473823Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:b6818bc85ec6e72c23d3a02e4b4ea19ab4dc5b4e7035bcc249e3339d3a75760b","observation_id":"7761565b-a739-4122-a099-b71078d3d68d","resolution":{"observed_at":"2026-08-06T23:27:19.895050Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05459","last_updated":"2024-05-08T06:16:23Z","snapshot_observed_at":"2026-08-02T13:57:57.119489Z","submitted_at":"2024-01-10T09:25:45Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05459","snapshot_observed_at":"2026-08-06T23:27:19.477730Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.477730Z"},"links":{"cited_paper":"/paper/2401.05459","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:e1b2c6537400572d8752476f9eed549e244511ce953fe8ac0ec226df47fd2e50","observation_id":"b17ed3ff-c810-4bc7-b5b4-11140e475e74","resolution":{"observed_at":"2026-08-06T23:27:19.477730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.878719Z","title":null,"venue":null,"work_id":"600d8715-41c8-409d-aa01-787761942885","year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.482310Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:c7710f41d1d78d8ef9d89e13739d63529ad2fe99fa76ab1aea6b68b677a4c57b","observation_id":"9c0eab0a-2cf5-4b55-b0f0-7dd9750603ad","resolution":{"observed_at":"2026-08-06T23:27:19.882756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18743","last_updated":"2024-08-25T09:58:57Z","snapshot_observed_at":"2026-08-06T10:19:25.039692Z","submitted_at":"2023-11-30T17:41:30Z","title":"AlignBench: Benchmarking Chinese Alignment of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18743","snapshot_observed_at":"2026-08-06T23:27:19.485869Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.485869Z"},"links":{"cited_paper":"/paper/2311.18743","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:5364ab32928434b360760c7978db428c26ebdb1bb96512d52136e0f928a7e7e0","observation_id":"71fbc989-12a5-4017-a47c-e9e65b85ced1","resolution":{"observed_at":"2026-08-06T23:27:19.485869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.490352Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.490352Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:f0728e2b6d7f904784b2350a3608e7f8723147b8e5b82ac9e8bcc7b117db19cf","observation_id":"2b5bdc34-6c34-45f5-b31c-c27b129661bf","resolution":{"observed_at":"2026-08-06T23:27:19.490352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.07646","last_updated":"2018-02-20T07:21:43Z","snapshot_observed_at":"2026-07-06T06:10:30.224957Z","submitted_at":"2017-11-21T06:34:06Z","title":"Evaluating Machine Translation Performance on Chinese Idioms with a Blacklist Method","version":3},"cited_work":{"arxiv_id":"1711.07646","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.07646","snapshot_observed_at":"2026-08-06T23:27:19.693199Z","title":"Evaluating Machine Translation Performance on Chinese Idioms with a Blacklist Method","venue":"cs.CL","work_id":"6938bf76-fa78-4998-a2a0-ba3795815bf8","year":2017},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.498255Z"},"links":{"cited_paper":"/paper/1711.07646","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:111bbbd2016ae6bc35af5addb636dcd9d8ec2826f055a9901becc5005a8656ea","observation_id":"58a1e1d3-4ee7-44d6-b5fc-da1529c93754","resolution":{"observed_at":"2026-08-06T23:27:19.697757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.865812Z","title":null,"venue":null,"work_id":"eddd4518-0085-4d34-a67b-09d95eb2ea57","year":2022},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.502520Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:716b3ff726dc6e5cf8aeb82f401cb62f5c726198740d6ccb719fb993eca3b502","observation_id":"232e6b05-9031-4c55-a7e6-d8ee29b4c4f0","resolution":{"observed_at":"2026-08-06T23:27:19.869494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.853623Z","title":null,"venue":null,"work_id":"b3d497b6-b589-47c5-b6a4-15e76de321f4","year":2021},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.507082Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:0c0ecc9f602b18bf04587fdf2c9d77914de8a529d9c9d107f5f6d2e6924562ce","observation_id":"76c217ea-250b-416e-a495-705ac9a684e2","resolution":{"observed_at":"2026-08-06T23:27:19.857454Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T23:27:19.513072Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.513072Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:eb082c88bf8539b064e01ad50aced5109ef7e4c3274d8e98b8d9d6bccefccddc","observation_id":"e40132cc-39a2-4757-b0e1-009bbf52f393","resolution":{"observed_at":"2026-08-06T23:27:19.513072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.840399Z","title":null,"venue":null,"work_id":"74e329f9-2d28-484b-b740-87c7f41c639a","year":2011},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.517628Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:cc8c75acaf4190c44bf49f1a4c3207bb0ac2344402b7197d64362c1771d347e2","observation_id":"a641bedc-4a20-4f61-bfca-d341e55646fe","resolution":{"observed_at":"2026-08-06T23:27:19.844750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00289","last_updated":"2026-05-15T17:29:44Z","snapshot_observed_at":"2026-07-06T21:01:59.107101Z","submitted_at":"2025-03-31T23:19:08Z","title":"Do Chinese models speak Chinese languages?","version":3},"cited_work":{"arxiv_id":"2504.00289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.00289","snapshot_observed_at":"2026-08-06T23:27:19.662909Z","title":"Do Chinese models speak Chinese languages?","venue":"cs.CL","work_id":"693c47a6-1bdc-4b69-b6c6-563219f339bd","year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.522151Z"},"links":{"cited_paper":"/paper/2504.00289","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:e9c9485ae545fcb37b21aa931e77cd511df2dd5001ba2f90d85b6ba2d252ff45","observation_id":"487b6ad6-c921-4738-af1d-1361b9aa09b4","resolution":{"observed_at":"2026-08-06T23:27:19.668179Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.827846Z","title":null,"venue":null,"work_id":"0182a56e-d883-4089-9f18-6d4271bb12e4","year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.526144Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:30f54ab21b8cd899e038a036e467f6d29f032c9454a50f14fe07dbb883bb612f","observation_id":"42d29557-68b5-421b-a1c8-eae26eaeab31","resolution":{"observed_at":"2026-08-06T23:27:19.832004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.11131","last_updated":"2021-01-26T23:16:29Z","snapshot_observed_at":"2026-08-05T01:25:56.830724Z","submitted_at":"2021-01-26T23:16:29Z","title":"CLiMP: A Benchmark for Chinese Language Model Evaluation","version":1},"cited_work":{"arxiv_id":"2101.11131","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.11131","snapshot_observed_at":"2026-08-06T23:27:19.642794Z","title":"CLiMP: A Benchmark for Chinese Language Model Evaluation","venue":"cs.CL","work_id":"6765d8a4-237a-4872-aec3-7f16489565d8","year":2021},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.530607Z"},"links":{"cited_paper":"/paper/2101.11131","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:9f367984f96b576f27c4ccee5f39e41983648e78883bb29531d6da911679a80e","observation_id":"0cdb88b6-2129-48cd-9880-b5f906f3b90d","resolution":{"observed_at":"2026-08-06T23:27:19.649033Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05986","last_updated":"2020-11-05T14:46:45Z","snapshot_observed_at":"2026-07-06T09:11:58.924192Z","submitted_at":"2020-04-13T15:02:29Z","title":"CLUE: A Chinese Language Understanding Evaluation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05986","snapshot_observed_at":"2026-08-06T23:27:19.534563Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.534563Z"},"links":{"cited_paper":"/paper/2004.05986","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:9230dda3525ab378f70e60aee3ff9369efe7b82191930f39fc35b6d2adde78fd","observation_id":"fbe35e14-7b6a-4b41-a36e-39b84838104d","resolution":{"observed_at":"2026-08-06T23:27:19.534563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T23:27:19.539565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.539565Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:90a374077cb8910b23d38a7ba2a3f1e70d8aa87bf73b017f2314cdbc44b449da","observation_id":"a28b2128-4da8-4007-b8bf-3ccb1833a011","resolution":{"observed_at":"2026-08-06T23:27:19.539565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.815224Z","title":null,"venue":null,"work_id":"fe241d04-8fad-4b76-9858-e3e6d5886ac2","year":2006},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.543359Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:1b8c8859a2ddbb39e928aec16fb44c65be65eaae7457cbdc7af6da05ef8796b5","observation_id":"2e57d838-b2c7-4689-9e23-79b0a374ceea","resolution":{"observed_at":"2026-08-06T23:27:19.819433Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-06T23:27:19.548426Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.548426Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:f58f174030efdd3626c222c58e6603dda4a6a24c1580196143133d594978e873","observation_id":"5ef479e5-2345-4011-aa44-e23cdc1a126e","resolution":{"observed_at":"2026-08-06T23:27:19.548426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-08-07T02:34:49.424222Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-08-06T23:27:19.553332Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.553332Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:6eb39f21ab6281d9feec6ee4471345bd2d1c1960610be634eaee123d0738adf5","observation_id":"29c79227-7137-4cda-a89f-732ea61f9406","resolution":{"observed_at":"2026-08-06T23:27:19.553332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.557506Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.557506Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:d54cf4c05b524d3e43402e9039fa7a5c88c0bba340e7a2028f008922fa5c608b","observation_id":"d211fab5-57cc-4f54-b746-98ad62c25e72","resolution":{"observed_at":"2026-08-06T23:27:19.557506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T23:20:58.123658Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2506.18105."}