Pith. sign in

Paper Citation Record · LEDGER

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models

As of 18 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2504.14690.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2504.14690 v1

Coverage vector

measured 42 of 42 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T11:47:10.110189Z

measured 43 of 43 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-29T18:35:01.478866Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-29T18:43:50.944898Z

Reference resolution

42 of 42 outbound references displayed

  • verified exact2
  • verified fuzzy6
  • unresolved34
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 6347cc36-c502-45c9-8c9a-ea51f27ab4ee · outbound

This paper cites See What LLMs Cannot Answer: A Self-Challenge Framework for Uncovering LLM Weaknesses.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models See What LLMs Cannot Answer: A Self-Challenge Framework for Uncovering LLM Weaknesses

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.960333Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.960333Z digest=sha256:aabb6fe55d8e2b18b60deb7dcd370b18f560a92013aacd5aeed559f7802898fd

Observation 828b7fa5-8eac-409a-9a6b-e886c83433aa · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.965077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.965077Z digest=sha256:b93ca4fce1cd2d310eef981748d27fb4d444ab92d331ec4595e4ae9f7fef1aae

Observation df121626-7434-4257-bce8-c92cb5eefbc0 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.969522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.969522Z digest=sha256:c5f8bcd2c970ef5fe11306607036bf1b841b26bca6b6efb61b683332850e5422

Observation 0d19a405-8855-4b40-90b5-48bf771ebbe1 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.699848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:09.973148Z digest=sha256:32f1595fa70addb0c044a34c5a2e1b9595010d9cf981211c3759569985217db1

Observation 19d8bac6-0896-4f0e-9e14-79daf9b635c2 · outbound

This paper cites & Choi, Y.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Choi, Y

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.976936Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.976936Z digest=sha256:e5107de23e83c5bcacaee19b87043821244b8bb612d80200e1d0454ae2919eaa

Observation e8dbfb08-9939-4b0a-8094-3b62393d42b0 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.688252Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:09.980494Z digest=sha256:173a8117ba7c2e6f7d91b900b698c536130e04c84e542a001b330ff4e57cc366

Observation 05047fc1-6a1c-4abc-995c-5e73909052b0 · outbound

This paper cites MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.984488Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.984488Z digest=sha256:e00c4547334061259c2e85ae503b44c30d8691a68db8df581ec8e2928b8b1579

Observation 0fcac788-7bfd-44d2-bfa4-4dc57084fd52 · outbound

This paper cites & Evans, O.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Evans, O

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.988354Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.988354Z digest=sha256:1277257c908323b928e4268d183506c7295a0dbecc99ffae6df07d432238bf3d

Observation ad00e964-f317-40a5-9402-053c48067da6 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.677835Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:09.991887Z digest=sha256:46bd3ab7758f82152caec39aea5476268471cfb6f965fcf17d6a4f66c1f4fbf6

Observation 0961d143-6f64-4c50-985e-aec82a16c75b · outbound

This paper cites Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:09.996193Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:09.996193Z digest=sha256:62b4c683e2bfe9f542c33725a29fa1a5bb1bcfad548089d0cbe7335f9c1e7738

Observation 12f73ee1-dc14-43ad-8fe5-1dea119a0e6f · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.667296Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.000133Z digest=sha256:7119619b6ad1de0bf3ef4079624e84872b22605bbba0d5bcf5936dd9214a3cf9

Observation 9dede914-330e-4ae1-8063-6f269b456eec · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.657821Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.004216Z digest=sha256:40329dad9cab766ea669ee5d23ee85a939624e27691274f2a0377942c2b258a4

Observation 34eb86f3-3794-4c63-bd09-259fb5e6d06d · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.647624Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.009336Z digest=sha256:99513d0a7614180cbfb84c8ea61eb5659e47d0d611858d23487229f38aa4d69d

Observation 2df063e8-7d45-4681-83b5-d871dfa9cae1 · outbound

This paper cites & Sun, D.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Sun, D

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.012978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.012978Z digest=sha256:00b0869997065bbb1177fe85ffbc8d18a77403549c03e66b41a9e5f77bec798e

Observation f418e4d6-7805-4dd3-aec2-58e1567a99a4 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.636805Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.016525Z digest=sha256:7b88fac221fd1a3ef3877e32fb2288b492a447dce2649471f7f6450f3f292704

Observation 6bf0f6e9-7555-43f7-8af0-663814fbff75 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.625961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.019538Z digest=sha256:00f65c64763c719cad37be65a746141a62d5ff628b2d54bb14f139726037b627

Observation 8af07fbc-99bf-4325-87f5-635c64e696fe · outbound

This paper cites & Atarodi, A.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Atarodi, A

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.615705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.022741Z digest=sha256:1996ad820878fd66b4bb9c5572ea1e0bcfc06eb8d3277895e2848ae31a547d1f

Observation e186d4cd-3867-4c15-8cbd-659abb14e477 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.606088Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.026040Z digest=sha256:7ec7c966022d3848d027cdd41c4a464f8b9aaa3f5cc55605d379558fc08a517a

Observation de5dfb1a-f4dc-4cc3-862e-442518b75df3 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.595585Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.029174Z digest=sha256:5b3cdac2aa013a388ef41fc85222890b1310ee72d769467e3aba47a0927c42c1

Observation da5f1934-7584-471a-8731-3f9451aee6ec · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.586693Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.032828Z digest=sha256:b7b38cf0bcb6adcf347eddb308b70209b7bd071933fc2df8b2ab48f1e653f8a5

Observation 3116b5dd-bbb7-4ebd-8cd6-c67182a554f2 · outbound

This paper cites https://github.com/ParsBench/ParsBench (2024).

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models https://github.com/ParsBench/ParsBench (2024)

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.577471Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.035881Z digest=sha256:bbc9e3d33fe8679513dc6718f9089029a8979ca2da489778485767b1d706f8d9

Observation 1821a485-c560-4bd4-9375-665447b33a9e · outbound

This paper cites ParsiNLU: A Suite of Language Understanding Challenges for Persian.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models ParsiNLU: A Suite of Language Understanding Challenges for Persian

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.038637Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.038637Z digest=sha256:5165e796ad256a20ad4efad01d4e98eb6c18b067c1b1ab0ad2a02ece8effba7b

Observation 88256256-c945-4b81-9f53-6d1365a631d5 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.042471Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.042471Z digest=sha256:ffdf626f37787133bd2a208c78beba094a67a7a9550134fe03dfa1911e5283d1

Observation 5b5bbf41-2523-417c-87ea-e32e57cba889 · outbound

This paper cites https://www.databricks.com/blog/2023/04/12/dolly-first-open-commercially-viable-instruction-tuned- llm.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models https://www.databricks.com/blog/2023/04/12/dolly-first-open-commercially-viable-instruction-tuned- llm

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.566216Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.046566Z digest=sha256:f720620e73e689b8fbae246dfdd84fd51a225035f066357f3eff6a58ba828031

Observation a9000bae-8495-4232-ad10-516c575b0f9b · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.555132Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.050233Z digest=sha256:c941048413ad7210802d969fc4cd982de7c52a1699f311e35bc25d486c541815

Observation 6f581229-091d-4950-b37b-d6359939aaff · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.543873Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.053849Z digest=sha256:67017f71dbe609672e2fc7a64277128309a773862c61fe93bc1e24166aba19cd

Observation 0a85a3e9-d4a3-47ad-ac6b-ed354799f61e · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.058425Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.058425Z digest=sha256:9e0c0ace06c73d3815948067e1150be404d1432598355b0cf957e2d845e5713e

Observation f614aec3-eb77-49c2-bd55-d5c2cfa2f3b5 · outbound

This paper cites https://huggingface.co/spaces/PartAI/open-persian-llm- leaderboard (2024).

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models https://huggingface.co/spaces/PartAI/open-persian-llm- leaderboard (2024)

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.532895Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.062686Z digest=sha256:7900fbc36b2d5e1b935bb4da088794831bb6fdb76f2c96dc15a577905f1d4e66

Observation db1885c1-23e9-46a3-8fde-025151b475a8 · outbound

This paper cites Advancing Persian LLM Evaluation.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Advancing Persian LLM Evaluation

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.523062Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.066343Z digest=sha256:1d0b430a5cd510fe950956913c43377fbb29929b19cb037ff293455cd159508a

Observation 0e3bd920-f58a-4874-bb6f-1054d85bbd6c · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.512718Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.069967Z digest=sha256:6e1841a5e14ad7a4d8cf6d7d2f33c6541af87a7b268ac7b3b8558aed377dcd73

Observation 9087df04-7753-43dc-b3d8-0c8e65404460 · outbound

This paper cites HmBlogs: A big general Persian corpus.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models HmBlogs: A big general Persian corpus

Reference 31

Resolution
verified exact
local_arxiv, observed 2026-08-16T11:47:10.199596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.073532Z digest=sha256:9263fa594915fb18d3b75a0f9138b504187bb3ab02232dc625e3d486d00a528f

Observation 65a4a7e2-6769-49f3-bd69-aa754860c548 · outbound

This paper cites ArmanEmo: A Persian Dataset for Text-based Emotion Detection.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models ArmanEmo: A Persian Dataset for Text-based Emotion Detection

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.077570Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.077570Z digest=sha256:a09fca130adcb2aaf6e754fcc94903950e18d3f93d3351d9a66737e24dad7416

Observation 275e2633-5d37-4cf1-8a89-8a5b1f311cca · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.502137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.081381Z digest=sha256:dc873d24d68f2e1338e156021e62eaf3202ee7cc69c919aeda4e63609696f6fd

Observation bd592cc7-afe4-4b67-8696-44c88ebe49e7 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.490315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.084701Z digest=sha256:12cb50c716bf35bf6bce3058dd01d82f8288affbdf936ff7d0640b5f0673fbb0

Observation f037849d-9dbc-491e-9117-386e9b089144 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:47:10.478569Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.087730Z digest=sha256:8280ecf8e9e5726f2d35c53b935fe6e1f2f33e9486a02f9e67e44ff5f2ad9c36

Observation ca787d7f-654b-49f6-9849-01ab3d563e1a · outbound

This paper cites Developing an Informal-Formal Persian Corpus.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Developing an Informal-Formal Persian Corpus

Reference 36

Resolution
verified exact
local_arxiv, observed 2026-08-16T11:47:10.174466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.091107Z digest=sha256:9239aad5fd8ced31b214f506e63923ace4b7a4f0ad8797ca4b8d05cd1bc57d82

Observation 15221d5e-0a32-4841-8dbd-2e73bfb540d7 · outbound

This paper cites & Dixon, L.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Dixon, L

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.094600Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.094600Z digest=sha256:16fccd30a09f91af89ebc83dcbfb5ba3a55851654b5eb098a37fb2d8c8cc9e96

Observation 6768d437-f8f7-4d79-ae21-35fe1a277bf2 · outbound

This paper cites & Vasserman, L.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models & Vasserman, L

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.097790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.097790Z digest=sha256:121be99c2248eb125f34d6b899096d67307737b41c73d3c4116aa9dffb706326

Observation fa235464-77f7-4e82-85a4-d583c07a6964 · outbound

This paper cites an unresolved cited work.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models Unresolved cited work

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.100931Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.100931Z digest=sha256:cac829af112dda6233adf420df33398c71efd770d325914d991eba1c71a62264

Observation 9ed46c6e-1ff4-4a6d-b311-3324a44e4471 · outbound

This paper cites The Llama 3 Herd of Models.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models The Llama 3 Herd of Models

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.104095Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.104095Z digest=sha256:2494bd283d918d1d3f2954fb39cfe5cfc96663e280ca7fe35873be74745c05ef

Observation 95210e1f-fffd-49a2-a1e7-6b20ba70e4fb · outbound

This paper cites PersianMind: A Cross-Lingual Persian-English Large Language Model.

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models PersianMind: A Cross-Lingual Persian-English Large Language Model

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-16T11:47:10.107127Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:47:10.107127Z digest=sha256:691ccb2f43a962d0ba8e9f38301d6ad1f49aac983bf7c1ee7a46787cedcdff53

Observation 5b46af84-ef75-4ed1-9bb6-5b9dfe19991d · outbound

This paper cites https://huggingface.co/PartAI/Dorna-Llama3-8B-Instruct (2024).

FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models https://huggingface.co/PartAI/Dorna-Llama3-8B-Instruct (2024)

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:47:10.467596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T11:47:10.110189Z digest=sha256:4ff9e98b5b41a284c7a58312476680021edbaa057ed88dcd2f3a76aabaeeb6be

Pith citing papers

Observation 231f45ac-fcec-4c96-a1c2-8a5993b213e1 · inbound

PersLitEval: Fine-grained Benchmark and Evaluation of LLMs on Persian Literature Questions cites this paper.

PersLitEval: Fine-grained Benchmark and Evaluation of LLMs on Persian Literature Questions FarsEval-PKBETS: A new diverse benchmark for evaluating Persian large language models

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-06-29T18:43:50.946196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-06-29T18:35:01.478866Z digest=sha256:cb864292ce70b7e9d79b11085a417976061986cb620b1786ff46174aa5f4c52a