Pith. sign in

Paper Citation Record · LEDGER

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models

As of 18 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2504.14690.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2504.14690 v1

Coverage vector

measured 42 of 42 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T11:47:10.110189Z

measured 43 of 43 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-18T06:34:40.430872+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-29T18:35:01.478866Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-29T18:43:50.944898Z

Reference resolution

42 of 42 outbound references displayed

  • verified exact2
  • verified fuzzy6
  • unresolved34
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 6347cc36-c502-45c9-8c9a-ea51f27ab4ee · outbound

This paper cites See What LLMs Cannot Answer: A Self-Challenge Framework for Uncovering LLM Weaknesses.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models See What LLMs Cannot Answer: A Self-Challenge Framework for Uncovering LLM Weaknesses

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.960333Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.960333Z digest=sha256:aabb6fe55d8e2b18b60deb7dcd370b18f560a92013aacd5aeed559f7802898fd

Observation 828b7fa5-8eac-409a-9a6b-e886c83433aa · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.965077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.965077Z digest=sha256:b93ca4fce1cd2d310eef981748d27fb4d444ab92d331ec4595e4ae9f7fef1aae

Observation df121626-7434-4257-bce8-c92cb5eefbc0 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.969522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.969522Z digest=sha256:c5f8bcd2c970ef5fe11306607036bf1b841b26bca6b6efb61b683332850e5422

Observation 0d19a405-8855-4b40-90b5-48bf771ebbe1 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.699848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:09.973148Z digest=sha256:501406f252a17591fc239bb2de827b93877c4dd8274d522529c46976e95dd62d

Observation 19d8bac6-0896-4f0e-9e14-79daf9b635c2 · outbound

This paper cites & Choi, Y.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Choi, Y

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.976936Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.976936Z digest=sha256:e5107de23e83c5bcacaee19b87043821244b8bb612d80200e1d0454ae2919eaa

Observation e8dbfb08-9939-4b0a-8094-3b62393d42b0 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.688252Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:09.980494Z digest=sha256:146e84dbd3842235d4e32d35ba0ac879cabcf41e5db52ae724cccc839b6d658f

Observation 05047fc1-6a1c-4abc-995c-5e73909052b0 · outbound

This paper cites MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.984488Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.984488Z digest=sha256:e00c4547334061259c2e85ae503b44c30d8691a68db8df581ec8e2928b8b1579

Observation 0fcac788-7bfd-44d2-bfa4-4dc57084fd52 · outbound

This paper cites & Evans, O.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Evans, O

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.988354Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.988354Z digest=sha256:1277257c908323b928e4268d183506c7295a0dbecc99ffae6df07d432238bf3d

Observation ad00e964-f317-40a5-9402-053c48067da6 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.677835Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:09.991887Z digest=sha256:3dc4337b96c28560c74766c02a145bad5f79eaeb5ea3411092a5cd99f30a697e

Observation 0961d143-6f64-4c50-985e-aec82a16c75b · outbound

This paper cites Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.996193Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.996193Z digest=sha256:62b4c683e2bfe9f542c33725a29fa1a5bb1bcfad548089d0cbe7335f9c1e7738

Observation 12f73ee1-dc14-43ad-8fe5-1dea119a0e6f · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.667296Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.000133Z digest=sha256:6e8d1b79cd20d373dafb88e58aee60461ac382ffabb8f73469f0efd756ffb302

Observation 9dede914-330e-4ae1-8063-6f269b456eec · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.657821Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.004216Z digest=sha256:8f7dc6c77f1b2f81a68f8777d4c797f9d5e7e7a599c060c9f16b0c37968d6ab7

Observation 34eb86f3-3794-4c63-bd09-259fb5e6d06d · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.647624Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.009336Z digest=sha256:7b9ee04f6f4b92a91a3048efa11f4e1081fc3e5f9bb3d1ff7a4e9e0e5c42c1f7

Observation 2df063e8-7d45-4681-83b5-d871dfa9cae1 · outbound

This paper cites & Sun, D.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Sun, D

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.012978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.012978Z digest=sha256:00b0869997065bbb1177fe85ffbc8d18a77403549c03e66b41a9e5f77bec798e

Observation f418e4d6-7805-4dd3-aec2-58e1567a99a4 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.636805Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.016525Z digest=sha256:f7efb01a9a61b1cd6673118773ce4142f39ace36a7d6cc29d5dd52ca1d0d5c1e

Observation 6bf0f6e9-7555-43f7-8af0-663814fbff75 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.625961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.019538Z digest=sha256:71ea6a804c25dcb96c98aa73c9ee1e5ff4f6bfbb29460799acad76db5ddd1aae

Observation 8af07fbc-99bf-4325-87f5-635c64e696fe · outbound

This paper cites & Atarodi, A.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Atarodi, A

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.615705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.022741Z digest=sha256:9faeb49fb526670230166528560ca8ee231315974f758d69b16e2064b96bbc72

Observation e186d4cd-3867-4c15-8cbd-659abb14e477 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.606088Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.026040Z digest=sha256:a10df18a17119694659c3a126b7fc42ad44ea02ceb656632d4d4f34d4bcda69d

Observation de5dfb1a-f4dc-4cc3-862e-442518b75df3 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.595585Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.029174Z digest=sha256:a6a98973d6c26b0fe8fd7ae24c5d44a8e1676f471080192cbf42112f10bb3faf

Observation da5f1934-7584-471a-8731-3f9451aee6ec · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.586693Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.032828Z digest=sha256:dd276d7bbbc4579485ff5991e4a4bf75bc84d3e14ad2474e4027fbda133dea7b

Observation 3116b5dd-bbb7-4ebd-8cd6-c67182a554f2 · outbound

This paper cites https://github.com/ParsBench/ParsBench (2024).

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models https://github.com/ParsBench/ParsBench (2024)

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.577471Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.035881Z digest=sha256:3c4f859f74a9141638c5d4f1eda6f4fb12066e9305ee43e4dcd950937d208729

Observation 1821a485-c560-4bd4-9375-665447b33a9e · outbound

This paper cites ParsiNLU: A Suite of Language Understanding Challenges for Persian.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models ParsiNLU: A Suite of Language Understanding Challenges for Persian

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.038637Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.038637Z digest=sha256:5165e796ad256a20ad4efad01d4e98eb6c18b067c1b1ab0ad2a02ece8effba7b

Observation 88256256-c945-4b81-9f53-6d1365a631d5 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.042471Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.042471Z digest=sha256:ffdf626f37787133bd2a208c78beba094a67a7a9550134fe03dfa1911e5283d1

Observation 5b5bbf41-2523-417c-87ea-e32e57cba889 · outbound

This paper cites https://www.databricks.com/blog/2023/04/12/dolly-first-open-commercially-viable-instruction-tuned- llm.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models https://www.databricks.com/blog/2023/04/12/dolly-first-open-commercially-viable-instruction-tuned- llm

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.566216Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.046566Z digest=sha256:4f0dd3b13d3a430f4026bb174cbc4868f4034b56400edf3a00c5d88cb70e9b0c

Observation a9000bae-8495-4232-ad10-516c575b0f9b · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.555132Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.050233Z digest=sha256:7ecb095eddde7ed512036b0efa9cf10473458b25847bab4b9ad4e8d25436f047

Observation 6f581229-091d-4950-b37b-d6359939aaff · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.543873Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.053849Z digest=sha256:7b2a3cd6cf52bb31b92d9715e6a6abe07b996fdd10f2f0c9aab80b3a76b5fde2

Observation 0a85a3e9-d4a3-47ad-ac6b-ed354799f61e · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.058425Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.058425Z digest=sha256:9e0c0ace06c73d3815948067e1150be404d1432598355b0cf957e2d845e5713e

Observation f614aec3-eb77-49c2-bd55-d5c2cfa2f3b5 · outbound

This paper cites https://huggingface.co/spaces/PartAI/open-persian-llm- leaderboard (2024).

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models https://huggingface.co/spaces/PartAI/open-persian-llm- leaderboard (2024)

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.532895Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.062686Z digest=sha256:8d0ed52dc42eea541a40631b1925b82b12d7ea92ceabcb49ff1d35fa1d5ab5fc

Observation db1885c1-23e9-46a3-8fde-025151b475a8 · outbound

This paper cites Advancing Persian LLM Evaluation.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Advancing Persian LLM Evaluation

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.523062Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.066343Z digest=sha256:0ea9a333fe620302ab8b9b9e2e642d4d19e6ebc0fc129692265089e0da2a2c95

Observation 0e3bd920-f58a-4874-bb6f-1054d85bbd6c · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.512718Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.069967Z digest=sha256:f2f0e84bd833e6075fb23ff46266fa65e096e6137052e2043a71be68331ad9e7

Observation 9087df04-7753-43dc-b3d8-0c8e65404460 · outbound

This paper cites HmBlogs: A big general Persian corpus.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models HmBlogs: A big general Persian corpus

Reference 31

Resolution
verified exact
local_arxiv, observed 2026-08-16T11:47:10.199596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.073532Z digest=sha256:8ff578281b7c95f218732a9ad31c70da3d06732d1b18cc4c3076c0533018743b

Observation 65a4a7e2-6769-49f3-bd69-aa754860c548 · outbound

This paper cites ArmanEmo: A Persian Dataset for Text-based Emotion Detection.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models ArmanEmo: A Persian Dataset for Text-based Emotion Detection

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.077570Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.077570Z digest=sha256:a09fca130adcb2aaf6e754fcc94903950e18d3f93d3351d9a66737e24dad7416

Observation 275e2633-5d37-4cf1-8a89-8a5b1f311cca · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.502137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.081381Z digest=sha256:de207d3603a72de192a9c8f344dccaec1084eb6cd504ecb89ae01bf04a46c6fb

Observation bd592cc7-afe4-4b67-8696-44c88ebe49e7 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.490315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.084701Z digest=sha256:1cf7220586ca28e13016c226b8cbfbd2415e8a4c2677c753b16632a6cc85d1ad

Observation f037849d-9dbc-491e-9117-386e9b089144 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.478569Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.087730Z digest=sha256:bac06c4bc3ef0158942617da927e882c2f72ba71f9abd0db9ececcc4fa0d378a

Observation ca787d7f-654b-49f6-9849-01ab3d563e1a · outbound

This paper cites Developing an Informal-Formal Persian Corpus.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Developing an Informal-Formal Persian Corpus

Reference 36

Resolution
verified exact
local_arxiv, observed 2026-08-16T11:47:10.174466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.091107Z digest=sha256:44329dec0ef025ab4788dff4d5e02a53c7421c839e2354bbf233f293848ef348

Observation 15221d5e-0a32-4841-8dbd-2e73bfb540d7 · outbound

This paper cites & Dixon, L.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Dixon, L

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.094600Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.094600Z digest=sha256:16fccd30a09f91af89ebc83dcbfb5ba3a55851654b5eb098a37fb2d8c8cc9e96

Observation 6768d437-f8f7-4d79-ae21-35fe1a277bf2 · outbound

This paper cites & Vasserman, L.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Vasserman, L

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.097790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.097790Z digest=sha256:121be99c2248eb125f34d6b899096d67307737b41c73d3c4116aa9dffb706326

Observation fa235464-77f7-4e82-85a4-d583c07a6964 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.100931Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.100931Z digest=sha256:cac829af112dda6233adf420df33398c71efd770d325914d991eba1c71a62264

Observation 9ed46c6e-1ff4-4a6d-b311-3324a44e4471 · outbound

This paper cites The Llama 3 Herd of Models.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models The Llama 3 Herd of Models

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.104095Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.104095Z digest=sha256:2494bd283d918d1d3f2954fb39cfe5cfc96663e280ca7fe35873be74745c05ef

Observation 95210e1f-fffd-49a2-a1e7-6b20ba70e4fb · outbound

This paper cites PersianMind: A Cross-Lingual Persian-English Large Language Model.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models PersianMind: A Cross-Lingual Persian-English Large Language Model

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.107127Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.107127Z digest=sha256:691ccb2f43a962d0ba8e9f38301d6ad1f49aac983bf7c1ee7a46787cedcdff53

Observation 5b46af84-ef75-4ed1-9bb6-5b9dfe19991d · outbound

This paper cites https://huggingface.co/PartAI/Dorna-Llama3-8B-Instruct (2024).

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models https://huggingface.co/PartAI/Dorna-Llama3-8B-Instruct (2024)

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.467596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-16T11:47:10.110189Z digest=sha256:0472460689227432d9915ed77c3c3a4701832d7af0806e698072348dab249976

Pith citing papers

Observation 231f45ac-fcec-4c96-a1c2-8a5993b213e1 · inbound

PersLitEval: Fine-grained Benchmark and Evaluation of LLMs on Persian Literature Questions cites this paper.

PersLitEval: Fine-grained Benchmark and Evaluation of LLMs on Persian Literature Questions FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-06-29T18:43:50.946196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-06-29T18:35:01.478866Z digest=sha256:175384da34c96f82c28c771f3c23ea16c5646afaf14e4e389a12a5b6c0ee6de0