{"as_of":"2026-08-18T17:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:859b64e547527630f4e58c057561eb2faf81a0fd7bcb637ba3265aa5ea5d77b8","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:47:10.110189Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T18:35:01.478866Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T18:43:50.944898Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"cited_work":{"arxiv_id":"2504.14690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14690","snapshot_observed_at":"2026-06-29T18:43:50.944898Z","title":null,"venue":null,"work_id":"acc065d5-b84b-40b0-b668-6a8f5df0b8cf","year":2025},"citing_paper":{"arxiv_id":"2605.27015","last_updated":"2026-05-26T13:34:19Z","snapshot_observed_at":"2026-08-15T00:09:55.029100Z","submitted_at":"2026-05-26T13:34:19Z","title":"PersLitEval: Fine-grained Benchmark and Evaluation of LLMs on Persian Literature Questions","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-29T18:35:01.478866Z"},"links":{"cited_paper":"/paper/2504.14690","citing_paper":"/paper/2605.27015"},"observation_digest":"sha256:175384da34c96f82c28c771f3c23ea16c5646afaf14e4e389a12a5b6c0ee6de0","observation_id":"231f45ac-fcec-4c96-a1c2-8a5993b213e1","resolution":{"observed_at":"2026-06-29T18:43:50.946196Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.14690/citation-record","integrity":"/paper/2504.14690/integrity","json":"/paper/2504.14690/citation-record.json","paper":"/paper/2504.14690"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.08978","last_updated":"2024-10-01T01:40:14Z","snapshot_observed_at":"2026-08-16T13:25:56.576431Z","submitted_at":"2024-08-16T19:01:52Z","title":"See What LLMs Cannot Answer: A Self-Challenge Framework for Uncovering LLM Weaknesses","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08978","snapshot_observed_at":"2026-08-16T11:47:09.960333Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.960333Z"},"links":{"cited_paper":"/paper/2408.08978","citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:aabb6fe55d8e2b18b60deb7dcd370b18f560a92013aacd5aeed559f7802898fd","observation_id":"6347cc36-c502-45c9-8c9a-ea51f27ab4ee","resolution":{"observed_at":"2026-08-16T11:47:09.960333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:09.965077Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.965077Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:b93ca4fce1cd2d310eef981748d27fb4d444ab92d331ec4595e4ae9f7fef1aae","observation_id":"828b7fa5-8eac-409a-9a6b-e886c83433aa","resolution":{"observed_at":"2026-08-16T11:47:09.965077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:09.969522Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.969522Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:c5f8bcd2c970ef5fe11306607036bf1b841b26bca6b6efb61b683332850e5422","observation_id":"df121626-7434-4257-bce8-c92cb5eefbc0","resolution":{"observed_at":"2026-08-16T11:47:09.969522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.695922Z","title":null,"venue":null,"work_id":"16dac66c-7205-4ddf-882d-2fe9cdcf10a2","year":2019},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.973148Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:501406f252a17591fc239bb2de827b93877c4dd8274d522529c46976e95dd62d","observation_id":"0d19a405-8855-4b40-90b5-48bf771ebbe1","resolution":{"observed_at":"2026-08-16T11:47:10.699848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:09.976936Z","title":"& Choi, Y","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.976936Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:e5107de23e83c5bcacaee19b87043821244b8bb612d80200e1d0454ae2919eaa","observation_id":"19d8bac6-0896-4f0e-9e14-79daf9b635c2","resolution":{"observed_at":"2026-08-16T11:47:09.976936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.684813Z","title":null,"venue":null,"work_id":"d9845639-dba4-4d96-9b74-6c485e942eac","year":2021},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.980494Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:146e84dbd3842235d4e32d35ba0ac879cabcf41e5db52ae724cccc839b6d658f","observation_id":"e8dbfb08-9939-4b0a-8094-3b62393d42b0","resolution":{"observed_at":"2026-08-16T11:47:10.688252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-17T13:17:07.963143Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-16T11:47:09.984488Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.984488Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:e00c4547334061259c2e85ae503b44c30d8691a68db8df581ec8e2928b8b1579","observation_id":"05047fc1-6a1c-4abc-995c-5e73909052b0","resolution":{"observed_at":"2026-08-16T11:47:09.984488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:09.988354Z","title":"& Evans, O","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.988354Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:1277257c908323b928e4268d183506c7295a0dbecc99ffae6df07d432238bf3d","observation_id":"0fcac788-7bfd-44d2-bfa4-4dc57084fd52","resolution":{"observed_at":"2026-08-16T11:47:09.988354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.673832Z","title":null,"venue":null,"work_id":"0dc7d944-b23d-496a-a433-0d3cc9d40b8b","year":2023},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.991887Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:3dc4337b96c28560c74766c02a145bad5f79eaeb5ea3411092a5cd99f30a697e","observation_id":"ad00e964-f317-40a5-9402-053c48067da6","resolution":{"observed_at":"2026-08-16T11:47:10.677835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-16T11:47:09.996193Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:09.996193Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:62b4c683e2bfe9f542c33725a29fa1a5bb1bcfad548089d0cbe7335f9c1e7738","observation_id":"0961d143-6f64-4c50-985e-aec82a16c75b","resolution":{"observed_at":"2026-08-16T11:47:09.996193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.664024Z","title":null,"venue":null,"work_id":"86c5b04a-bbbe-44bb-acfb-b934ff01004a","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.000133Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:6e8d1b79cd20d373dafb88e58aee60461ac382ffabb8f73469f0efd756ffb302","observation_id":"12f73ee1-dc14-43ad-8fe5-1dea119a0e6f","resolution":{"observed_at":"2026-08-16T11:47:10.667296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.654536Z","title":null,"venue":null,"work_id":"32933d87-1385-413e-b8b3-b5f2a39d3f6f","year":2020},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.004216Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:8f7dc6c77f1b2f81a68f8777d4c797f9d5e7e7a599c060c9f16b0c37968d6ab7","observation_id":"9dede914-330e-4ae1-8063-6f269b456eec","resolution":{"observed_at":"2026-08-16T11:47:10.657821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.644037Z","title":null,"venue":null,"work_id":"75cf978f-8467-4683-90aa-204e1bc6db32","year":2021},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.009336Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:7b9ee04f6f4b92a91a3048efa11f4e1081fc3e5f9bb3d1ff7a4e9e0e5c42c1f7","observation_id":"34eb86f3-3794-4c63-bd09-259fb5e6d06d","resolution":{"observed_at":"2026-08-16T11:47:10.647624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.012978Z","title":"& Sun, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.012978Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:00b0869997065bbb1177fe85ffbc8d18a77403549c03e66b41a9e5f77bec798e","observation_id":"2df063e8-7d45-4681-83b5-d871dfa9cae1","resolution":{"observed_at":"2026-08-16T11:47:10.012978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.633100Z","title":null,"venue":null,"work_id":"679eb068-ec3c-4ee1-add9-94dd39cfab58","year":2025},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.016525Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:f7efb01a9a61b1cd6673118773ce4142f39ace36a7d6cc29d5dd52ca1d0d5c1e","observation_id":"f418e4d6-7805-4dd3-aec2-58e1567a99a4","resolution":{"observed_at":"2026-08-16T11:47:10.636805Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.622309Z","title":null,"venue":null,"work_id":"94381291-61b4-4353-a4d4-1be52292ad20","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.019538Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:71ea6a804c25dcb96c98aa73c9ee1e5ff4f6bfbb29460799acad76db5ddd1aae","observation_id":"6bf0f6e9-7555-43f7-8af0-663814fbff75","resolution":{"observed_at":"2026-08-16T11:47:10.625961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.612310Z","title":"& Atarodi, A","venue":null,"work_id":"48cc3c66-c617-41f8-9e5b-3a307f459e41","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.022741Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:9faeb49fb526670230166528560ca8ee231315974f758d69b16e2064b96bbc72","observation_id":"8af07fbc-99bf-4325-87f5-635c64e696fe","resolution":{"observed_at":"2026-08-16T11:47:10.615705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.602613Z","title":null,"venue":null,"work_id":"8127d579-ad5b-427f-9aa8-41dfa66ea6f1","year":2023},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.026040Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:a10df18a17119694659c3a126b7fc42ad44ea02ceb656632d4d4f34d4bcda69d","observation_id":"e186d4cd-3867-4c15-8cbd-659abb14e477","resolution":{"observed_at":"2026-08-16T11:47:10.606088Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.592823Z","title":null,"venue":null,"work_id":"042af74b-517a-4b16-aeca-a050532bb797","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.029174Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:a6a98973d6c26b0fe8fd7ae24c5d44a8e1676f471080192cbf42112f10bb3faf","observation_id":"de5dfb1a-f4dc-4cc3-862e-442518b75df3","resolution":{"observed_at":"2026-08-16T11:47:10.595585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.583954Z","title":null,"venue":null,"work_id":"15945730-6f5a-4817-9613-9ed37079658c","year":2021},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.032828Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:dd276d7bbbc4579485ff5991e4a4bf75bc84d3e14ad2474e4027fbda133dea7b","observation_id":"da5f1934-7584-471a-8731-3f9451aee6ec","resolution":{"observed_at":"2026-08-16T11:47:10.586693Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.573649Z","title":"https://github.com/ParsBench/ParsBench (2024)","venue":null,"work_id":"7e78f10e-c4f5-4b9f-b31c-bec69fe699d3","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.035881Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:3c4f859f74a9141638c5d4f1eda6f4fb12066e9305ee43e4dcd950937d208729","observation_id":"3116b5dd-bbb7-4ebd-8cd6-c67182a554f2","resolution":{"observed_at":"2026-08-16T11:47:10.577471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06154","last_updated":"2021-07-13T17:02:32Z","snapshot_observed_at":"2026-08-16T18:59:19.670034Z","submitted_at":"2020-12-11T06:31:42Z","title":"ParsiNLU: A Suite of Language Understanding Challenges for Persian","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.06154","snapshot_observed_at":"2026-08-16T11:47:10.038637Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.038637Z"},"links":{"cited_paper":"/paper/2012.06154","citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:5165e796ad256a20ad4efad01d4e98eb6c18b067c1b1ab0ad2a02ece8effba7b","observation_id":"1821a485-c560-4bd4-9375-665447b33a9e","resolution":{"observed_at":"2026-08-16T11:47:10.038637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.042471Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.042471Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:ffdf626f37787133bd2a208c78beba094a67a7a9550134fe03dfa1911e5283d1","observation_id":"88256256-c945-4b81-9f53-6d1365a631d5","resolution":{"observed_at":"2026-08-16T11:47:10.042471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.562477Z","title":"https://www.databricks.com/blog/2023/04/12/dolly-first-open-commercially-viable-instruction-tuned- llm","venue":null,"work_id":"2d161f60-12cc-448c-90ee-2542d2a1cfdb","year":2023},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.046566Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:4f0dd3b13d3a430f4026bb174cbc4868f4034b56400edf3a00c5d88cb70e9b0c","observation_id":"5b5bbf41-2523-417c-87ea-e32e57cba889","resolution":{"observed_at":"2026-08-16T11:47:10.566216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.551718Z","title":null,"venue":null,"work_id":"66545ff4-72ff-40e2-ae86-9340cb84a788","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.050233Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:7ecb095eddde7ed512036b0efa9cf10473458b25847bab4b9ad4e8d25436f047","observation_id":"a9000bae-8495-4232-ad10-516c575b0f9b","resolution":{"observed_at":"2026-08-16T11:47:10.555132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.539863Z","title":null,"venue":null,"work_id":"4c1b0633-72d6-416a-82b2-a18f58d5a348","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.053849Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:7b2a3cd6cf52bb31b92d9715e6a6abe07b996fdd10f2f0c9aab80b3a76b5fde2","observation_id":"6f581229-091d-4950-b37b-d6359939aaff","resolution":{"observed_at":"2026-08-16T11:47:10.543873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.058425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.058425Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:9e0c0ace06c73d3815948067e1150be404d1432598355b0cf957e2d845e5713e","observation_id":"0a85a3e9-d4a3-47ad-ac6b-ed354799f61e","resolution":{"observed_at":"2026-08-16T11:47:10.058425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.529156Z","title":"https://huggingface.co/spaces/PartAI/open-persian-llm- leaderboard (2024)","venue":null,"work_id":"fb05a8e3-3f68-48e8-8f09-36acbaefe08b","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.062686Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:8d0ed52dc42eea541a40631b1925b82b12d7ea92ceabcb49ff1d35fa1d5ab5fc","observation_id":"f614aec3-eb77-49c2-bd55-d5c2cfa2f3b5","resolution":{"observed_at":"2026-08-16T11:47:10.532895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.519856Z","title":"Advancing Persian LLM Evaluation","venue":null,"work_id":"b452f54a-8008-4bc2-aa51-cada2f027bb4","year":2025},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.066343Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:0ea9a333fe620302ab8b9b9e2e642d4d19e6ebc0fc129692265089e0da2a2c95","observation_id":"db1885c1-23e9-46a3-8fde-025151b475a8","resolution":{"observed_at":"2026-08-16T11:47:10.523062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.509393Z","title":null,"venue":null,"work_id":"c7654009-f077-4f04-9843-bfb6caf59a1d","year":2022},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.069967Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:f2f0e84bd833e6075fb23ff46266fa65e096e6137052e2043a71be68331ad9e7","observation_id":"0e3bd920-f58a-4874-bb6f-1054d85bbd6c","resolution":{"observed_at":"2026-08-16T11:47:10.512718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02362","last_updated":"2021-11-03T17:26:52Z","snapshot_observed_at":"2026-08-16T17:44:15.553518Z","submitted_at":"2021-11-03T17:26:52Z","title":"HmBlogs: A big general Persian corpus","version":1},"cited_work":{"arxiv_id":"2111.02362","doi":"10.48550/arxiv.2111.02362","metadata_source":"pith","pith_arxiv_id":"2111.02362","snapshot_observed_at":"2026-08-16T12:16:17.039197Z","title":"HmBlogs: A big general Persian corpus","venue":"cs.CL","work_id":"cdc501d0-a6d6-45ed-bcd9-7aed6f6544bb","year":2021},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.073532Z"},"links":{"cited_paper":"/paper/2111.02362","citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:8ff578281b7c95f218732a9ad31c70da3d06732d1b18cc4c3076c0533018743b","observation_id":"9087df04-7753-43dc-b3d8-0c8e65404460","resolution":{"observed_at":"2026-08-16T11:47:10.199596Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11808","last_updated":"2022-07-24T20:35:23Z","snapshot_observed_at":"2026-08-16T16:43:43.814979Z","submitted_at":"2022-07-24T20:35:23Z","title":"ArmanEmo: A Persian Dataset for Text-based Emotion Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11808","snapshot_observed_at":"2026-08-16T11:47:10.077570Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.077570Z"},"links":{"cited_paper":"/paper/2207.11808","citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:a09fca130adcb2aaf6e754fcc94903950e18d3f93d3351d9a66737e24dad7416","observation_id":"65a4a7e2-6769-49f3-bd69-aa754860c548","resolution":{"observed_at":"2026-08-16T11:47:10.077570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.498597Z","title":null,"venue":null,"work_id":"c6f87740-7bb3-485d-8d67-4bbc5c31b74c","year":2020},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.081381Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:de207d3603a72de192a9c8f344dccaec1084eb6cd504ecb89ae01bf04a46c6fb","observation_id":"275e2633-5d37-4cf1-8a89-8a5b1f311cca","resolution":{"observed_at":"2026-08-16T11:47:10.502137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.486209Z","title":null,"venue":null,"work_id":"c624f456-867c-40d0-bcca-1be70c0949be","year":2022},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.084701Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:1cf7220586ca28e13016c226b8cbfbd2415e8a4c2677c753b16632a6cc85d1ad","observation_id":"bd592cc7-afe4-4b67-8696-44c88ebe49e7","resolution":{"observed_at":"2026-08-16T11:47:10.490315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.474874Z","title":null,"venue":null,"work_id":"9b63cd3d-ab2b-4ced-ac35-bb304358cb3d","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.087730Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:bac06c4bc3ef0158942617da927e882c2f72ba71f9abd0db9ececcc4fa0d378a","observation_id":"f037849d-9dbc-491e-9117-386e9b089144","resolution":{"observed_at":"2026-08-16T11:47:10.478569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05336","last_updated":"2023-08-10T04:57:34Z","snapshot_observed_at":"2026-08-16T15:09:29.287726Z","submitted_at":"2023-08-10T04:57:34Z","title":"Developing an Informal-Formal Persian Corpus","version":1},"cited_work":{"arxiv_id":"2308.05336","doi":"10.48550/arxiv.2308.05336","metadata_source":"pith","pith_arxiv_id":"2308.05336","snapshot_observed_at":"2026-08-16T12:16:17.039197Z","title":"Developing an Informal-Formal Persian Corpus","venue":"cs.CL","work_id":"829dd9cc-d789-4c62-8cf0-00a03f418b0a","year":2023},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.091107Z"},"links":{"cited_paper":"/paper/2308.05336","citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:44329dec0ef025ab4788dff4d5e02a53c7421c839e2354bbf233f293848ef348","observation_id":"ca787d7f-654b-49f6-9849-01ab3d563e1a","resolution":{"observed_at":"2026-08-16T11:47:10.174466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.094600Z","title":"& Dixon, L","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.094600Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:16fccd30a09f91af89ebc83dcbfb5ba3a55851654b5eb098a37fb2d8c8cc9e96","observation_id":"15221d5e-0a32-4841-8dbd-2e73bfb540d7","resolution":{"observed_at":"2026-08-16T11:47:10.094600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.097790Z","title":"& Vasserman, L","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.097790Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:121be99c2248eb125f34d6b899096d67307737b41c73d3c4116aa9dffb706326","observation_id":"6768d437-f8f7-4d79-ae21-35fe1a277bf2","resolution":{"observed_at":"2026-08-16T11:47:10.097790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.100931Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.100931Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:cac829af112dda6233adf420df33398c71efd770d325914d991eba1c71a62264","observation_id":"fa235464-77f7-4e82-85a4-d583c07a6964","resolution":{"observed_at":"2026-08-16T11:47:10.100931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T11:47:10.104095Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.104095Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:2494bd283d918d1d3f2954fb39cfe5cfc96663e280ca7fe35873be74745c05ef","observation_id":"9ed46c6e-1ff4-4a6d-b311-3324a44e4471","resolution":{"observed_at":"2026-08-16T11:47:10.104095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06466","last_updated":"2024-01-12T09:24:10Z","snapshot_observed_at":"2026-08-16T14:28:00.424951Z","submitted_at":"2024-01-12T09:24:10Z","title":"PersianMind: A Cross-Lingual Persian-English Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06466","snapshot_observed_at":"2026-08-16T11:47:10.107127Z","title":"& Dousti, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.107127Z"},"links":{"cited_paper":"/paper/2401.06466","citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:691ccb2f43a962d0ba8e9f38301d6ad1f49aac983bf7c1ee7a46787cedcdff53","observation_id":"95210e1f-fffd-49a2-a1e7-6b20ba70e4fb","resolution":{"observed_at":"2026-08-16T11:47:10.107127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:47:10.464489Z","title":"https://huggingface.co/PartAI/Dorna-Llama3-8B-Instruct (2024)","venue":null,"work_id":"b75393f3-09f2-40e7-b0a0-e1979cf82b6f","year":2024},"citing_paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:47:10.110189Z"},"links":{"citing_paper":"/paper/2504.14690"},"observation_digest":"sha256:0472460689227432d9915ed77c3c3a4701832d7af0806e698072348dab249976","observation_id":"5b46af84-ef75-4ed1-9bb6-5b9dfe19991d","resolution":{"observed_at":"2026-08-16T11:47:10.467596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.14690","last_updated":"2025-04-20T17:43:47Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T11:40:48.921784Z","submitted_at":"2025-04-20T17:43:47Z","title":"FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":2,"verified_fuzzy":6},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2504.14690."}