{"as_of":"2026-08-10T21:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0aafffec510f90c6ffd830d6e4e356ab6dcc35dbb7e0892195dad613ce402d21","coverage":[{"denominator":166,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:20:37.705197Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06609/citation-record","integrity":"/paper/2608.06609/integrity","json":"/paper/2608.06609/citation-record.json","paper":"/paper/2608.06609"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.400902Z","title":"International Journal of Research in Marketing , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.400902Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:9c9e594d27c17cf7b89002006950152d2ba980404049aa45abb2e9f5d9dc89cb","observation_id":"62504018-28ab-48b7-928c-ec18f97e4230","resolution":{"observed_at":"2026-08-10T04:20:37.400902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.404987Z","title":"Proceedings of the 2024 AAAI Conference on Artificial Intelligence , series =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.404987Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:483f07b86f20f33825194e87fc076b5e224155f2abbf8096b68e24ba57e6346a","observation_id":"162581c9-9e43-4c38-8b53-5fab8b128f5d","resolution":{"observed_at":"2026-08-10T04:20:37.404987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.408595Z","title":"Educational Measurement: Issues and Practice , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.408595Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:aa9db86be6acee6fbd53290dacf489172e59d0f5560914429fa4a2fb35806ed8","observation_id":"c5497de0-16fd-47af-91ef-e5e8e308f3e5","resolution":{"observed_at":"2026-08-10T04:20:37.408595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/0-306-47531-6_1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"and Pashley, Peter J","venue":null,"work_id":"e708250f-e73e-44db-864e-5a6e33c07689","year":2000},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.412414Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:096b76c424eeada0617c6f1b3e916add94b1c1546374642b3bda68408e1b1bdb","observation_id":"73ca9f31-4f4d-4965-b707-025894ec3005","resolution":{"observed_at":"2026-08-10T04:20:38.065881Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T15:38:34.616146+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:34.616146+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:34.616146+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.416109Z","title":"2020 , doi =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.416109Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:bc0775b2583d7a280d423fba46dba210866b378159d7b36d8a6a4faebbee4f5a","observation_id":"70f7a3f9-7271-46f7-a437-53cd141b1297","resolution":{"observed_at":"2026-08-10T04:20:37.416109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24827","last_updated":"2026-07-05T14:51:01Z","snapshot_observed_at":"2026-08-09T18:00:15.187880Z","submitted_at":"2026-04-27T15:46:23Z","title":"Incompressible Knowledge Probes: Estimating Black-Box LLM Parameter Counts via Factual Capacity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.24827","snapshot_observed_at":"2026-08-10T04:20:37.419663Z","title":"Incompressible Knowledge Probes: Estimating Black-Box","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.419663Z"},"links":{"cited_paper":"/paper/2604.24827","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:8a5a49f7fcf4abc6d386784fab3045948f8fc8f3a82c245c70638e4b0dc4e69f","observation_id":"579ab3ea-53ae-4564-aa25-cab1e533250d","resolution":{"observed_at":"2026-08-10T04:20:37.419663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.423676Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.423676Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:e30983649e379a48b2233832e2e78cabd936597b9f5f967f72c30ce4fc11687c","observation_id":"f60fbdf4-9ebc-4601-a4c6-8ca2722862ea","resolution":{"observed_at":"2026-08-10T04:20:37.423676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.427415Z","title":"Journal of Educational Data Mining , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.427415Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:bc720e6164dad73b9382eba90c52af9a7cf7592225b172c968907c0c244f6659","observation_id":"5b422e63-f371-4352-a14f-f1ecab27c66c","resolution":{"observed_at":"2026-08-10T04:20:37.427415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.431165Z","title":"The Routledge International Handbook of Automated Essay Evaluation , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.431165Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:166e2af6ddeaa412e6ad631748ab6a8dc560e5e6b84b03e401a74d598e976d0a","observation_id":"a46c98ee-fef8-4b99-8907-662cf0e2b1e5","resolution":{"observed_at":"2026-08-10T04:20:37.431165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.434471Z","title":"Using generated rubrics to provide a window into item evaluation with multi-agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.434471Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:485edc13bd5c3023a25935a41757f4f846914dfc5d576d78f32b3020aecf610c","observation_id":"1a2214cf-c030-4676-b570-a1bad58f19b0","resolution":{"observed_at":"2026-08-10T04:20:37.434471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/9780197807309.003.0010","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Automatic Item Generation, Evaluation, and Scale Construction of Non-Cognitive Measures with Generative Language Models , booktitle =","venue":null,"work_id":"d5d8e14e-03da-4363-824e-f7e4e809bdd3","year":2026},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.437990Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:ad4a0bc79b8a43f6bc058c75f8026d6362ed59715b3f3bc0fd471cf23bcf9463","observation_id":"cf7e2ea7-553b-4cff-b411-8e3daefcfe81","resolution":{"observed_at":"2026-08-10T04:20:38.057353Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T15:38:34.699666+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:34.699666+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:34.699666+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.441336Z","title":"Electronics , VOLUME =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.441336Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:870e7b66e11d2752cc1d7073a75cc511b46b04dc5d4fe808cb21fbdb59dd07b5","observation_id":"86730784-ebe4-4af7-bf06-8969aa11506a","resolution":{"observed_at":"2026-08-10T04:20:37.441336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.444593Z","title":"and Monday, Onoja Abah , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.444593Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:86939bc064735949133f685ea71d8bf2e55f422d5197f58071078ae735a07713","observation_id":"9eff31ea-dbeb-4b6f-b2f7-9cc78a6d9a9e","resolution":{"observed_at":"2026-08-10T04:20:37.444593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.447532Z","title":"International Journal of Assessment Tools in Education , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.447532Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:0376e6a58a96eb9563c7b0bd980c42c5a74a00d6d161dee71e138593dbceeb65","observation_id":"e65b8de3-46f3-4989-9bab-40ba54258cda","resolution":{"observed_at":"2026-08-10T04:20:37.447532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.450276Z","title":"Advances in Health Sciences Education , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.450276Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:c3407003ae9e90e67a50049c9fa3047e8da9c7879d3c9be46660e9ff8254d60d","observation_id":"2b7ba151-f800-4472-9baf-73f902bccf81","resolution":{"observed_at":"2026-08-10T04:20:37.450276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-10T04:20:37.456148Z","title":"arXiv preprint arXiv:2410.21276 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.456148Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:02db9307fb252d3890efbd85077e28c1713c4f638541f81786168b678bb60d34","observation_id":"8e144199-f575-4aa4-a9a7-80288a7db190","resolution":{"observed_at":"2026-08-10T04:20:37.456148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.459713Z","title":null,"venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.459713Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:c492bcf891a834a161c09b89875863d096bb43adb2896dc75df719d5e52fd2de","observation_id":"920b4be3-8593-465d-b5b4-747359bf56d2","resolution":{"observed_at":"2026-08-10T04:20:37.459713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.462784Z","title":"2023 , journal=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.462784Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:8d69164e9baa77470973aebb4624847b2bf6b7f51d433d807ae1a747f5c2e657","observation_id":"2274647f-bac5-4f14-9b36-444c5302c9b7","resolution":{"observed_at":"2026-08-10T04:20:37.462784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00214","last_updated":"2025-06-30T19:34:57Z","snapshot_observed_at":"2026-08-06T21:19:06.340648Z","submitted_at":"2025-06-30T19:34:57Z","title":"Two-Stage Reasoning-Infused Learning: Improving Classification with LLM-Generated Reasoning","version":1},"cited_work":{"arxiv_id":"2507.00214","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.00214","snapshot_observed_at":"2026-08-10T04:20:38.770680Z","title":"Two-Stage Reasoning-Infused Learning: Improving Classification with LLM-Generated Reasoning","venue":"cs.CL","work_id":"d2775270-9ba4-408c-95f0-824da433ac89","year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.465711Z"},"links":{"cited_paper":"/paper/2507.00214","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:a3e688674864893b1e92730d1199c5c00db12fdc51307893efbd279aa9acae70","observation_id":"9e0e56dc-e793-4bab-aeee-06f6687bb1b0","resolution":{"observed_at":"2026-08-10T04:20:38.775257Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08551","last_updated":"2025-03-11T15:39:43Z","snapshot_observed_at":"2026-08-07T17:12:36.923428Z","submitted_at":"2025-03-11T15:39:43Z","title":"Reasoning and Sampling-Augmented MCQ Difficulty Prediction via LLMs","version":1},"cited_work":{"arxiv_id":"2503.08551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.08551","snapshot_observed_at":"2026-08-10T04:20:38.757473Z","title":"Reasoning and Sampling-Augmented MCQ Difficulty Prediction via LLMs","venue":"cs.AI","work_id":"4890e25c-13d7-4e38-bb92-a858d416f3eb","year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.469039Z"},"links":{"cited_paper":"/paper/2503.08551","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:2531d4406d264a59bef868f0729ab7bbc6467f3f58f5f30071fe27ba6aeadd24","observation_id":"59286acf-659a-4e39-959a-fb227d199fe2","resolution":{"observed_at":"2026-08-10T04:20:38.761407Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.472307Z","title":"2025 , howpublished =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.472307Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:dcbbd20cb52a404b59ef826c59826d08257c2dbcca805126e187834d7c148bae","observation_id":"d5a189f4-9f71-4ae6-a8a5-3bb4f441cf00","resolution":{"observed_at":"2026-08-10T04:20:37.472307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.475528Z","title":"2026 , journal=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.475528Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:7fb79f8067e28f51584f5f2967ec9c3caa48bc9136cdb187b649449f27ec0d92","observation_id":"a63f67a6-0392-4a75-9ca7-ca4c90f0521e","resolution":{"observed_at":"2026-08-10T04:20:37.475528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.479081Z","title":"2024 , journal=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.479081Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:9210323d7bd2e82e3d2747741f86acb988e6a809b624a2be5d08e992dc4cb4de","observation_id":"71ecb2ef-b535-42fe-8194-2d4d0fb167c1","resolution":{"observed_at":"2026-08-10T04:20:37.479081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.482543Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.482543Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:addfe3edf16c847dedab8faf1d5139709a53589fa1fb4ac79aece645e929747e","observation_id":"482c9a2a-cf9a-429d-8360-e887cc6d6cdb","resolution":{"observed_at":"2026-08-10T04:20:37.482543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2605.18562","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:38.741086Z","title":"arXiv preprint arXiv:2605.18562 , year=","venue":null,"work_id":"cbce3311-e5c7-4735-b104-a97f8d20a1e6","year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.485801Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:4defbdedabf7a1842786d01922f824a35b642d8f31c8a138e32bc66440d643df","observation_id":"d8984650-9b2a-49c9-8f30-4d7962897e4c","resolution":{"observed_at":"2026-08-10T04:20:38.746748Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.489102Z","title":"Review of educational research , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.489102Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:9b4c4c28cfe9db39deec666ac8993640d7fa4d71b1957ed99f35b84b29fa75b0","observation_id":"02871b59-4601-4541-987b-982cec816368","resolution":{"observed_at":"2026-08-10T04:20:37.489102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.492478Z","title":"educational measurement: issues and practice , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.492478Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:ed38e2be29d78e7ba933c20bbe7e868ae29709e56f69c9bb0ed4bdc7ac9fb43d","observation_id":"47a4a239-298c-4ceb-a4e2-8ba5f89e3af9","resolution":{"observed_at":"2026-08-10T04:20:37.492478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.495650Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.495650Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:a88c0723eea6c813e9af2a1f03f170f9954bad741962d087798b49dd09786def","observation_id":"f0a7ccb5-da3a-490a-9f1b-cf12dd933b6b","resolution":{"observed_at":"2026-08-10T04:20:37.495650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.499029Z","title":"Humanities and Social Sciences Communications , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.499029Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b7cd41d62004b821a0b377ac97b05e5b4f247bd6d39f4857ff512466201c26c4","observation_id":"d169160c-ce10-40d6-925d-340bb9f08859","resolution":{"observed_at":"2026-08-10T04:20:37.499029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.502437Z","title":"Journal of Development and Social Sciences , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.502437Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:49bb3905a777872390948c827f2e3be9c497ce9841b7b24d6e34aebcf95e9eb0","observation_id":"d6283690-5502-4329-92f1-402be8ba19f4","resolution":{"observed_at":"2026-08-10T04:20:37.502437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.505745Z","title":"Haladyna and Steven M","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.505745Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:25774511ab886b05977847ed7fbd537d2622153076ee7c82fedb18015c8bf53f","observation_id":"41a8d118-a3e5-44a1-a158-9e97afd2f220","resolution":{"observed_at":"2026-08-10T04:20:37.505745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.509187Z","title":"Haladyna and Steven M","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.509187Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:568840172d9e5c3108cf74c51e9e47d4e454fa0e277ad1fff6e314c52528d72c","observation_id":"5537b4d9-ad59-47da-a572-af61b0c64f29","resolution":{"observed_at":"2026-08-10T04:20:37.509187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/00131644261460779","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:38.040025Z","title":"Educational and Psychological Measurement , year =","venue":null,"work_id":"494facec-69d8-4432-a7a7-0e8c5c910e7f","year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.512532Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b77c1d4b7f7a3fb95b2e4d26243f5f843dedf426aa7a6540ec39dd65fc83391f","observation_id":"73fb16ff-6ba0-49b1-a026-f0dbc30abef5","resolution":{"observed_at":"2026-08-10T04:20:38.043130Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T15:38:34.827277+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:34.827277+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:34.827277+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.515919Z","title":"2026 , journal=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.515919Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:207cb3c77181ee136477d237172bff5a9788e77dba8d4f96bf56a3d4610f939e","observation_id":"b8d8e431-c658-427c-a4f3-d6cbab93f443","resolution":{"observed_at":"2026-08-10T04:20:37.515919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.519275Z","title":"Predicting Item Survival for Multiple Choice Questions in a High-Stakes Medical Exam","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.519275Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:9e3fc770ec880b56991ff07a76aa19a6d8658602fe583fb894963732fa0151b5","observation_id":"4ec5a0d2-ad69-4748-85e0-869e6d2a7b8c","resolution":{"observed_at":"2026-08-10T04:20:37.519275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.522686Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.522686Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:585044f127a7a95e4f422259d700c6158332828167014e55631a3a34d62a25f6","observation_id":"4be007ed-7c10-46e9-84b1-fc74794e2012","resolution":{"observed_at":"2026-08-10T04:20:37.522686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.525930Z","title":"Advances in Health Sciences Education , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.525930Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:dffd417ca90b1d31e89a047d46ac2adb493ce059bc4b22cf4bcd1d2efb70c4c2","observation_id":"8cc17301-e534-496b-a6e3-df472a6c3bda","resolution":{"observed_at":"2026-08-10T04:20:37.525930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06465","last_updated":"2025-04-08T22:08:37Z","snapshot_observed_at":"2026-08-07T16:07:22.339147Z","submitted_at":"2025-04-08T22:08:37Z","title":"Analyzing Examinee Comments using DistilBERT and Machine Learning to Ensure Quality Control in Exam Content","version":1},"cited_work":{"arxiv_id":"2504.06465","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.06465","snapshot_observed_at":"2026-08-10T04:20:38.676383Z","title":"Analyzing Examinee Comments using DistilBERT and Machine Learning to Ensure Quality Control in Exam Content","venue":"cs.CL","work_id":"90651923-07b2-46b0-a239-733323f96cc3","year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.529314Z"},"links":{"cited_paper":"/paper/2504.06465","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5bb0f7fa2cf86a68440bfed8f849918c9a93a9a8b4fd3fbe402ac63b1288470e","observation_id":"13a216b9-3cc8-411a-9507-d8347b765476","resolution":{"observed_at":"2026-08-10T04:20:38.679845Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.533077Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.533077Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:52ff56935e07b354d7b2d4107574315ff1e93c4919f7c6a70b6ef7bdfcec877c","observation_id":"53c5b216-ab00-4578-8914-f4523bb48b7f","resolution":{"observed_at":"2026-08-10T04:20:37.533077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.536564Z","title":"Journal of Educational Measurement , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.536564Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:28516e611f503057eedc3e3bf8be11dfd148d0b9951855f4a1244b57097e5567","observation_id":"b44288ff-3aec-44ee-9878-8193fcd13a39","resolution":{"observed_at":"2026-08-10T04:20:37.536564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.539997Z","title":"2023 , journal=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.539997Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:4fcb871fef080bdc964b1b18107b7a3ca5c6ddcc0460670330d9f89e8325e0f7","observation_id":"3f22d0b8-de2f-44ff-a5b9-823d56844e15","resolution":{"observed_at":"2026-08-10T04:20:37.539997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.543333Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.543333Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:7336f60f319233ff81c5ce0ab67b9432db7b160efece0323cbf04c7fa196b0ae","observation_id":"2e49e606-19cf-4adf-87a1-9152628dc486","resolution":{"observed_at":"2026-08-10T04:20:37.543333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.546587Z","title":"Information Fusion , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.546587Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:0fbb26657184e27268bc35d192cb388b258934aba53f8049da54d32e5a829a2a","observation_id":"b864182d-997c-4ab5-8b7a-403aaed88ea7","resolution":{"observed_at":"2026-08-10T04:20:37.546587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.549346Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.549346Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b61a9d87bc7819876b1ea193bf2bace8cb438fb959b1b0e9c5e45bf0af5c97c9","observation_id":"f0ece7b6-a65b-4aa4-a33e-fc8c93569893","resolution":{"observed_at":"2026-08-10T04:20:37.549346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.552122Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.552122Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:7e56ccf2a0d428288e471105c7e651e0ccb94708c883c53984fcd16b2d3bf681","observation_id":"3eafa73e-bcf9-40ce-a62c-591638bb715a","resolution":{"observed_at":"2026-08-10T04:20:37.552122Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.554790Z","title":"Research and practice in technology enhanced learning , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.554790Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:b61864ecd0e5887270558aea9d4f5554e7d647dc16eebc4caad93f595e63bb81","observation_id":"648fbc7e-df0c-48d1-a94f-ded601dbd51b","resolution":{"observed_at":"2026-08-10T04:20:37.554790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.557635Z","title":"International conference on artificial intelligence in education , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.557635Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:9ae30836528f7998d8fe57bc6ee57f527710d2c2d2bf8b6799638de31cfaae28","observation_id":"709c76d1-379e-414c-b624-6280c16cd9d8","resolution":{"observed_at":"2026-08-10T04:20:37.557635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.560427Z","title":"Proceedings of the 10th EAI International Conference on Mobile Multimedia Communications , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.560427Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:aa0486fc4294336f5c21a942e07e6bf514404dedd3ee40cd14c3b7befbc2b62b","observation_id":"2044b4c8-a9aa-480c-9c74-42553250df00","resolution":{"observed_at":"2026-08-10T04:20:37.560427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.562844Z","title":"2026 , booktitle=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.562844Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5ed6e3029bf7e93cef0aea374cfbcd858e889268c346cc92aab95a4b6077e5ca","observation_id":"7461c1b2-1bf4-4ad1-bb9b-17e65b115d45","resolution":{"observed_at":"2026-08-10T04:20:37.562844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.565383Z","title":"Statistical theories of mental test scores , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.565383Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:dab2823905e5676751e1b8b1130a8947a4e91ed6f4fd942bf32b7dc0a2cc0a5d","observation_id":"835ec6a5-2e7a-44aa-8b46-b6c008251a32","resolution":{"observed_at":"2026-08-10T04:20:37.565383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.567759Z","title":"ETS Research Report Series , volume=","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.567759Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:2bd3c7d08d3f2262aec67bda5fca10d3b9495f70c94e0087c8efea722486bb9a","observation_id":"cfaa9dde-49cb-4e04-a665-11ef2178258c","resolution":{"observed_at":"2026-08-10T04:20:37.567759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.570200Z","title":"IEEE transactions on pattern analysis and machine intelligence , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.570200Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:e8e94bea0be676a37c637e2b6ab59f5e4d3e547ba51c0142cca52463fa795bab","observation_id":"ddf9ab88-f2d6-43f1-8de0-a5c1317ce627","resolution":{"observed_at":"2026-08-10T04:20:37.570200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.572649Z","title":", author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.572649Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:78efed5e87996079641f93e5a189f9ed8ea7bfc61fdb11bfbe6ef1279a6a4cac","observation_id":"b221de83-0a65-4fd6-ab6e-ed913db71e12","resolution":{"observed_at":"2026-08-10T04:20:37.572649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.574943Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.574943Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:6a4559ba40354c6b6a9fdfd57862d316d0732ebd9f5291ccfde4f822274c1699","observation_id":"5aa3a294-1543-48d3-9196-137e201c8912","resolution":{"observed_at":"2026-08-10T04:20:37.574943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.577567Z","title":"Ninth international conference on document analysis and recognition (ICDAR 2007) , volume=","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.577567Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:e6f9ca52e6a254ae6690e32397c97e5127e7ca827d5147524827d008869f3a7c","observation_id":"4f2e750e-d4e7-40af-9744-46d93f8b811c","resolution":{"observed_at":"2026-08-10T04:20:37.577567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.580282Z","title":"The Cambridge handbook of multimedia learning , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.580282Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:243e138cbbe44882ad39e025dd33fe3a60457c3f8e52326d81991e8036a09408","observation_id":"227666b1-1d56-42c7-a327-6aa772b281cf","resolution":{"observed_at":"2026-08-10T04:20:37.580282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.582906Z","title":"Psychology of learning and motivation , volume=","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.582906Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:a81bafd9ef26fe8758ccd8597af65bd69a8a3b8c5cbceade93080cbfc00242cc","observation_id":"3533f789-4077-4773-b24c-4ca7cdac6f7e","resolution":{"observed_at":"2026-08-10T04:20:37.582906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.585580Z","title":"1990 , publisher=","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.585580Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:90ac11592513779b93159e15fb3527d527c22e4fa7019a3c2372408f04be7796","observation_id":"c97f19a8-7ad7-4033-a794-9498b1111a70","resolution":{"observed_at":"2026-08-10T04:20:37.585580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.588098Z","title":"Proceedings of the tenth international conference on learning analytics & knowledge , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.588098Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:35ddd08269282b1e50953be86ab09429e467117c41efd87c2e4dbc0496189ed9","observation_id":"e75d20f5-2c59-4910-b6cc-c469388ba5e7","resolution":{"observed_at":"2026-08-10T04:20:37.588098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-10T04:20:37.590798Z","title":"arXiv preprint arXiv:2304.07193 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.590798Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:23d4d6d0623350eb9a4b9c8837034b2bfdc82d3ac5d44a5d7e71a4277c5b34a7","observation_id":"79d7ad11-f9a5-43b2-a0b5-0c938dd7369e","resolution":{"observed_at":"2026-08-10T04:20:37.590798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.593817Z","title":"Artificial Intelligence Review , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.593817Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:d669590a7128abc35cf0f8e9d4e5b3cf2be5ddb45821fb96ac92208b19da8bbb","observation_id":"94e087e8-83a1-48f2-b8db-5289b35a900d","resolution":{"observed_at":"2026-08-10T04:20:37.593817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.596369Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.596369Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:327bc6860af6b6ee6a92471ba3d4cf62556720019de856c26d436eec2972a7b6","observation_id":"6f3ce8ad-500b-4a94-ae29-6ba61814a44e","resolution":{"observed_at":"2026-08-10T04:20:37.596369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.599017Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.599017Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:5b99e1121455574369783b83925c3c70b17cdd16f561b8fb42512588ae7e63ad","observation_id":"e91b10e4-eb32-44cf-951c-3c18ab902014","resolution":{"observed_at":"2026-08-10T04:20:37.599017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.602252Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.602252Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:1a5124021fa98c1d1cb54b90e970ea17c03bc108adaea4532d5bc13bd4169d4f","observation_id":"88700261-6326-47d8-b27c-8e0cdd771514","resolution":{"observed_at":"2026-08-10T04:20:37.602252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.605374Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.605374Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:d54b79001f5090527e1eaebc9e99d2ee1457a7a645fd959be968aface2f62c01","observation_id":"fd94df4a-f225-437d-8eed-081a9b7fc16b","resolution":{"observed_at":"2026-08-10T04:20:37.605374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-10T04:20:37.608380Z","title":"arXiv preprint arXiv:1907.11692 , year=","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.608380Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:43ad1872432f259803aa8bdd28465e46bb673b16c1d9da7e165706267e829965","observation_id":"df7594a5-8028-4571-b789-725daf204af1","resolution":{"observed_at":"2026-08-10T04:20:37.608380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.611649Z","title":"Computers & Education , volume=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.611649Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:500577d80b6139a6832fdb897c82325dd38af025a34558d01c73c02f1a821c1b","observation_id":"999d24e4-7c4d-4a7b-a5c2-4fc301c2471a","resolution":{"observed_at":"2026-08-10T04:20:37.611649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.614768Z","title":"Information Processing & Management , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.614768Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:cea493aaf1d43e9a72b0d5511e6b3b21b5b6bb85f0fcdc2835550065e91da7c9","observation_id":"269073ec-33ce-47b6-81d7-4d7278ec75d2","resolution":{"observed_at":"2026-08-10T04:20:37.614768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.617965Z","title":"Educational and Psychological Measurement , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.617965Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:6c448dd004391c0ec6f5123661d437a50ecfa43a9f9d5f4384c8e2f59f960184","observation_id":"891b217b-c6dc-4ba3-8f96-f58bb92d9905","resolution":{"observed_at":"2026-08-10T04:20:37.617965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.620904Z","title":"CBE—Life Sciences Education , volume=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.620904Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:1594a5c1003e36156b12c66e3ec971f1fd851090dd5a7e6d2fa0d925cbf93139","observation_id":"c1a17bf8-fbd4-4213-b73c-b94b4e40d24c","resolution":{"observed_at":"2026-08-10T04:20:37.620904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.623911Z","title":"Journal of Microbiology and Biology Education , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.623911Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:9823edede6db5cab7fd526ed55751208a2f40e49c17801f9c0aecae45928c3eb","observation_id":"f200e7f4-458e-4f36-8a39-6a790f413ba3","resolution":{"observed_at":"2026-08-10T04:20:37.623911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.627263Z","title":"The Curriculum Journal , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.627263Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:076b0e8fe86278f48dd129f49978ad1bb1f940c7d6f39dfa132caf4ccd651dcd","observation_id":"ae9fd239-4c65-45a5-9296-a1ff6d815ef9","resolution":{"observed_at":"2026-08-10T04:20:37.627263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.630312Z","title":"Mathematics , VOLUME =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.630312Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:3ca608a0fe5e3358a81e55ec8d4718059a777faa3dc1ed8ec2ce989d9d03c4a5","observation_id":"de23d965-87ce-47d5-8927-67245b6355fe","resolution":{"observed_at":"2026-08-10T04:20:37.630312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.633239Z","title":"arXiv preprint arXiv:2509.23486 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.633239Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:096ce19e4d9e46b99e57ed093fa5d723bf0fdc16645054a127b29fa7bca0b59e","observation_id":"a0252aaa-7f32-483f-827a-bf97caf581a2","resolution":{"observed_at":"2026-08-10T04:20:37.633239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.636306Z","title":"Information Sciences , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.636306Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:645c5cea6df4a57f7cc3a90b306bfd52a0972ede032adab657c05e600d3db700","observation_id":"93e9ee46-c5f0-4105-9817-d1c614aa1b63","resolution":{"observed_at":"2026-08-10T04:20:37.636306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15698","last_updated":"2023-09-27T14:40:12Z","snapshot_observed_at":"2026-08-04T10:16:25.449869Z","submitted_at":"2023-09-27T14:40:12Z","title":"Deep Model Fusion: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15698","snapshot_observed_at":"2026-08-10T04:20:37.639405Z","title":"arXiv preprint arXiv:2309.15698 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.639405Z"},"links":{"cited_paper":"/paper/2309.15698","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:dc05660ba43a97d49cdd3022f8f4bd5ef8d941de48840f4eb9750df59c197b57","observation_id":"e131c470-6399-4207-b102-8a0e936c0a43","resolution":{"observed_at":"2026-08-10T04:20:37.639405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.642618Z","title":"Neural computation , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.642618Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:86fba5f74ba96e2e348817c4acbadf2fb220340332a2fba538576f56aa3c6b7c","observation_id":"3cf1a69b-137b-4743-a5f9-9adcfd26c6ec","resolution":{"observed_at":"2026-08-10T04:20:37.642618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-10T04:20:37.645527Z","title":"arXiv preprint arXiv:2508.10104 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.645527Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:d2cfc6fd741d5d059ff9b3430b15c98a90a293f0c83d55cd6ff33444c646e013","observation_id":"71efec10-ce10-4c9c-a218-b14a500af653","resolution":{"observed_at":"2026-08-10T04:20:37.645527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.648744Z","title":", author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.648744Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:41bd4ece1e315aafa6f853cdabca43369e97758a6965f8efae5ea8214e1f4096","observation_id":"8b9484b5-d813-46cd-984b-aff0a0ee34ae","resolution":{"observed_at":"2026-08-10T04:20:37.648744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.652085Z","title":"ACM Computing Surveys , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.652085Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:54a089b90acdb443f7b29f5d17d038014151f645fbef0bd38622fb05d8ed8b97","observation_id":"6c543ca9-94fc-462d-b337-e19c3245eb22","resolution":{"observed_at":"2026-08-10T04:20:37.652085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.655101Z","title":"International Journal of Artificial Intelligence in Education , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.655101Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:e3513647f7923109a4dac1566e8158bb047a3f591494bec8bf885db4cc3790e6","observation_id":"6648051a-f5a0-46cb-89e4-d4b801dfac53","resolution":{"observed_at":"2026-08-10T04:20:37.655101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.657639Z","title":"Proceedings of the Artificial Intelligence in Measurement and Education Conference (AIME-Con): Full Papers , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.657639Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:86ad3950bf2c107c1e268020ea2d438ca0ed14b60a4f3b4ea35bd461423d5df0","observation_id":"2867657a-65db-4ac3-9f48-9413a76e1d0d","resolution":{"observed_at":"2026-08-10T04:20:37.657639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.660328Z","title":"Discover Computing , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.660328Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:cca726ec29947f5b272c16c93ae40c8350a380ae201c3e9ee9bfa7234b5f26cf","observation_id":"b30512fc-c554-4a8f-87d6-9a1b17316891","resolution":{"observed_at":"2026-08-10T04:20:37.660328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.662902Z","title":"Science Progress , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.662902Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:a37cf2c09539dea91365ad68d178cd9e4ea941769780e037f5b5de7c8c64d24d","observation_id":"7bc93020-9b42-4329-a44b-a352384c256e","resolution":{"observed_at":"2026-08-10T04:20:37.662902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.compedu.2015.01.007","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"2015 , issn =","venue":"Computers & Education","work_id":"94d59a17-ed61-4731-9fc7-dc96251ee7ba","year":2015},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.665737Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:f7a062d400a6fde74ef4f0db475920dbaa40ef9d5bb299b7ab5ed8053c3992d9","observation_id":"095ee977-3004-4557-93a6-50d88c3e4939","resolution":{"observed_at":"2026-08-10T04:20:38.033947Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T15:38:34.88608+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:34.88608+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:34.88608+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.668513Z","title":"ETS Research Report Series , volume =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.668513Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:137b622c5b22ec14f29a91a72b75685206c2f0976e236f83315f84c058b2ea13","observation_id":"d1f00099-b323-46f5-b515-18f1e85f1579","resolution":{"observed_at":"2026-08-10T04:20:37.668513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.671033Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.671033Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:ce9eb2aaad758bf034374475ea46ce52f69f1adb16c3e8572e0ea225483259f1","observation_id":"bff5342d-0eee-43b4-9117-55947dcbb4bd","resolution":{"observed_at":"2026-08-10T04:20:37.671033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.673760Z","title":"International Journal of Artificial Intelligence in Education , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.673760Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:9b597e67d9e3e31f8d4d9625dd3a196d54c3264d4d77820aad94e73bfd170330","observation_id":"fb2e5438-9f8d-4468-8b35-55f5247fc83b","resolution":{"observed_at":"2026-08-10T04:20:37.673760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/00131644241280400","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Educational and Psychological Measurement , year =","venue":"Educational and Psychological Measurement","work_id":"4b597173-c6c3-474d-9ed3-5a2548495929","year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.676215Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:377b49fb8e22b7fd83e6e80852ae8b197aced15ce19c8630da13c78f8121fc98","observation_id":"fa9feaa3-f8d3-478b-81c6-8bae6c720b56","resolution":{"observed_at":"2026-08-10T04:20:38.024098Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T15:38:34.962821+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:34.962821+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:34.962821+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.678720Z","title":"2020 , journal=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.678720Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:07a6eb488af0bd6976dc25144d09a7e986b30b3697f3dc8bfedb888a6cbfcf26","observation_id":"426aa737-b9e4-4c11-b27e-1bf0febacd11","resolution":{"observed_at":"2026-08-10T04:20:37.678720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.681363Z","title":"Gierl and Hollis Lai and Simon R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.681363Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:0ad65feb0d56405926048b9d6c6bc88ef4db9d1299743cc2301de122e837bee4","observation_id":"71a92535-b145-47e1-8497-0a65d02fc530","resolution":{"observed_at":"2026-08-10T04:20:37.681363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.684075Z","title":"Psychological Test and Assessment Modeling , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.684075Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:4040205270b0e268d0e2f78551c8e1a761436e9e8be0df1e9cda7be22d0d2fd6","observation_id":"28c00a05-a00d-4e15-a4e9-a41c588e595d","resolution":{"observed_at":"2026-08-10T04:20:37.684075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.686592Z","title":"2024 , journal=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.686592Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:02025c4200606e45a983bca5d121b2914d3ddd26c4b3047ebaf5791a429d1c70","observation_id":"aac8282c-09ef-48c8-8098-cdc254a8d19d","resolution":{"observed_at":"2026-08-10T04:20:37.686592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.689141Z","title":"Advancing natural language processing in educational assessment , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.689141Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:e2e9470b9d493dc299d30114f1f3802cfee5ad3754dcde16ee8768a32952e572","observation_id":"143a9b6c-5a99-463e-9ad7-95e1a4a23afb","resolution":{"observed_at":"2026-08-10T04:20:37.689141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1111/emip.12602","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"and Yaneva, Victoria and Lottridge, Susan and von Davier, Matthias and Harris, Deborah J","venue":"Educational Measurement Issues and Practice","work_id":"5695d06f-7069-4dea-b469-45533000a9ff","year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.691830Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:3e9a1d1599adc9adf814887b14b789dcee47c7d52c0cb3be65909e61de217208","observation_id":"464bbb7b-bc4f-4778-9790-39b4b593635b","resolution":{"observed_at":"2026-08-10T04:20:38.014277Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T15:38:35.076997+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:35.076997+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:35.076997+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.694836Z","title":"Applied Psychological Measurement , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.694836Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:f87304a8c25605b8c7e61f5cd7045d4af56ebf68cb2dd5d0e7ffd93c159c275a","observation_id":"e24e8605-1cf3-4a2f-81c2-f3654a8b5879","resolution":{"observed_at":"2026-08-10T04:20:37.694836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.697423Z","title":"Frontiers in Education , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.697423Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:4e0d306fcfc7e62024ac867d786fcdec593436459411ab5d06d45de6b8107d13","observation_id":"7ddb0928-59c7-4547-9441-240b65e55c72","resolution":{"observed_at":"2026-08-10T04:20:37.697423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.700168Z","title":"British Journal of Psychology , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.700168Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:32421c86570643ca4d71364246e743540d9ab6313b090ddce5b9a0345b873679","observation_id":"ad2c2842-2252-4cb5-a0f6-541eaca7f3b3","resolution":{"observed_at":"2026-08-10T04:20:37.700168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.702703Z","title":"Spearman , doi =","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.702703Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:6c9101bcd7c62e983a7f26d867729fb9769d687b3a8add6547dc76b4528dda5f","observation_id":"755a229f-9d63-4338-aa79-a42cf2597b3f","resolution":{"observed_at":"2026-08-10T04:20:37.702703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:20:37.705197Z","title":"2021 , journal=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:37.705197Z"},"links":{"citing_paper":"/paper/2608.06609"},"observation_digest":"sha256:4407cf73ac78b406bfaf5f1e1bbc36387d1116bb3a06f4f78e18b3f9f3677dff","observation_id":"34afd62b-1629-4eda-851c-f8d1b3aa593f","resolution":{"observed_at":"2026-08-10T04:20:37.705197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06609","last_updated":"2026-08-06T21:52:18Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T21:10:24.946065Z","submitted_at":"2026-08-06T21:52:18Z","title":"Automated item evaluation: Predicting item acceptance and rejection using LLM-generated critiques"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":1,"unresolved":89,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":166},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 166 outbound references and 0 inbound Pith citation observations for arXiv:2608.06609."}