{"as_of":"2026-08-07T19:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:89875be616602c027b8dbaa7e7c65b6d7105c7f347bf264b463d00cffb7d15f8","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:14:43.862454Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04554/citation-record","integrity":"/paper/2608.04554/integrity","json":"/paper/2608.04554/citation-record.json","paper":"/paper/2608.04554"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.18709","last_updated":"2026-08-05T07:41:17Z","snapshot_observed_at":"2026-08-07T18:16:46.796499Z","submitted_at":"2026-06-17T05:43:37Z","title":"LLMs Struggle to Measure What Distinguishes Students of Different Proficiency Levels: A Study of Item Discrimination in Reading Comprehension Assessment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.18709","snapshot_observed_at":"2026-08-06T22:14:41.784243Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.784243Z"},"links":{"cited_paper":"/paper/2606.18709","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:0e8d39e11637424decaed0305f474c82b13f312d88bc214a1a3bc4f067d19b0c","observation_id":"4042e9c9-f6d4-4c71-b957-e8d44ce87d35","resolution":{"observed_at":"2026-08-06T22:14:41.784243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9420.5011","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:44.535837Z","title":"Blank-image predictions are constant within each image-only seed, so their Spearman correlation is undefined","venue":null,"work_id":"7d8a7d51-03e7-4715-848e-615d94c161f4","year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.695320Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:2e8ae3d3b4e58fe9c48e426946dab66c27e32f134c104d994cec0a61cf770e40","observation_id":"a6332e64-bdbf-4d17-8ae2-44d2873e786b","resolution":{"observed_at":"2026-08-06T22:14:44.621129Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0320.5059","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:44.770415Z","title":"Qwen-VL and PaliGemma use their packaged image preprocessing; InternVL uses a448× 448image transform and the model’s image-context tokens","venue":null,"work_id":"2aaa281a-ae29-4f36-9dbf-261c5d19b9ce","year":2021},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.591827Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:eb2a0e7f561832ef71ef53a0287e7f0d6cdbf00d6b7def8a9c3a171057206653","observation_id":"933109e8-e99b-4bb6-be81-0ab93f9e4ec1","resolution":{"observed_at":"2026-08-06T22:14:44.833055Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T22:14:42.056734Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.056734Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:a0042b07b4be9a4dbc589fc214c88e7e37b5a45e71f94a02e140a7c75b793e5d","observation_id":"50655e06-b89e-497d-ae9a-f9873f088bc8","resolution":{"observed_at":"2026-08-06T22:14:42.056734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.440957Z","title":"Jump-starting item parameters for adaptive language tests","venue":null,"work_id":"1a2d25d0-45e8-4fa8-86ec-04df2d1f1803","year":2021},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.239779Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:824903af26b126867096f8b1aebcb77d65e600b6a7dd654eec39fcd6f8ad2153","observation_id":"1e9bb733-7e0b-43f3-b23e-d9678e638fca","resolution":{"observed_at":"2026-08-06T22:14:46.571597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T22:14:42.480552Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.480552Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:553a3e33bc5e5942b73b06d1e69447688ecc9defaddd2ff82f7c06c3e318e02f","observation_id":"4a692e18-eb14-4d07-a3ab-9257d176d774","resolution":{"observed_at":"2026-08-06T22:14:42.480552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T22:14:42.532662Z","title":"Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.532662Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:eae57e7de924604bf8fb0a0647b77e545fa192739b1aab57346656240b2f66d8","observation_id":"74348b13-8884-4c25-a219-332c13d771fb","resolution":{"observed_at":"2026-08-06T22:14:42.532662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.151837Z","title":"Unibucllm: Harnessing llms for automated prediction of item difficulty and response time for multiple-choice questions","venue":null,"work_id":"5b9206af-d524-48d2-aca1-c4d6bab20eb2","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.594467Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:000d4d4de470a80c90573db798ee8c356afd2b9de57f942612696774760ecbbf","observation_id":"9a63e776-51f4-48fc-a5b2-628d25d4e0b1","resolution":{"observed_at":"2026-08-06T22:14:46.240931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.055057Z","title":null,"venue":null,"work_id":"0cccae20-d07d-4a3a-9a15-005c4722a845","year":2025},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.664243Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:9b0f1ae6b59986c0cece4e8ddbca01b9123cd72ccb96a6a50928e3693bddd3a7","observation_id":"ab5fa2c9-f0ff-4b99-92b8-b77ee8609d1a","resolution":{"observed_at":"2026-08-06T22:14:46.092650Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03555","snapshot_observed_at":"2026-08-06T22:14:42.703573Z","title":"Paligemma 2: A family of versatile vlms for transfer.arXiv preprint arXiv:2412.03555,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.703573Z"},"links":{"cited_paper":"/paper/2412.03555","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:5ede0e5921173daa741c14326e4dc1a5caeb03eecbeef11c2bf10a32746a4a56","observation_id":"dedf64f9-f21f-4dbb-8a3d-57ea7704004f","resolution":{"observed_at":"2026-08-06T22:14:42.703573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.791275Z","title":"Large language model-based pipeline for item difficulty and response time estimation for educational assessments","venue":null,"work_id":"7f0d1ff0-4221-4dd9-9db4-fee57dc48b59","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.824243Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:c6608161683a82017d80ec0d041326050b865764bdf84aa58f5a989f60100b41","observation_id":"29481127-f033-41f9-8ccf-824b126e6213","resolution":{"observed_at":"2026-08-06T22:14:45.840147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.28186","last_updated":"2026-07-11T22:18:18Z","snapshot_observed_at":"2026-07-16T23:17:54.586391Z","submitted_at":"2026-06-26T15:32:17Z","title":"Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction","version":2},"cited_work":{"arxiv_id":"2606.28186","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.28186","snapshot_observed_at":"2026-08-06T22:14:45.065305Z","title":"Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction","venue":"cs.CL","work_id":"45f67259-41fe-4200-bb05-cfcf92ddf8aa","year":2026},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.879017Z"},"links":{"cited_paper":"/paper/2606.28186","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:415b4b1b45de3e51391bc5efd9a4061d021d0b9f0915d426adc826a7022b6cd1","observation_id":"61b6b596-afe7-4864-9bab-5ccfeca145cf","resolution":{"observed_at":"2026-08-06T22:14:45.108666Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-06T22:14:42.928682Z","title":"Internvl3","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.928682Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:a4027114915490c7e6fdcbdad344eb8ef6536ccfeff986d565e22bf81bd3f500","observation_id":"6ddbd1a3-fae9-4e1e-8107-e828b428a4f4","resolution":{"observed_at":"2026-08-06T22:14:42.928682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T22:14:43.143417Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.143417Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:f86fe161414a7a116737ce29e7af7e4beed275fe21d43067949ac40c9fb56cab","observation_id":"4859f4c9-044b-4f07-9c06-408af74ef0c7","resolution":{"observed_at":"2026-08-06T22:14:43.143417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:43.204466Z","title":"Towards valid student simulation with large language models.arXiv preprint arXiv:2601.05473,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.204466Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:1dda60919292c8652c9ec42c5b8ae8b74073b056be28a3ae4b40ad1ca41b2e0d","observation_id":"8ec5f49b-827a-41e8-b580-090a63ba1648","resolution":{"observed_at":"2026-08-06T22:14:43.204466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T22:14:43.288809Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models.arXiv preprint arXiv:2504.10479,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.288809Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:35ce950aa1bc8cfd18abea5b50fd6f7cf71b7bc562cc45ca383a9a64185d92ff","observation_id":"95409a96-ec0c-46c7-9479-43cf4cc02bda","resolution":{"observed_at":"2026-08-06T22:14:43.288809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.581415Z","title":"3 3.2 Difficulty Labels","venue":null,"work_id":"230609f4-3fbd-40c5-8a4e-c9bdbb13dfa1","year":1995},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.357568Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:1a399ef3a0a61e8f2590b72e752cb94f3cb5eba54444da6faf6bb9bcce1cf649","observation_id":"dc2df163-b325-4164-b994-8d17164bcfbb","resolution":{"observed_at":"2026-08-06T22:14:45.629862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.462958Z","title":"Visual textualization and image-native modeling impose different representational bottlenecks","venue":null,"work_id":"1d103e39-2885-44d6-adde-b243197f6fc1","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.432073Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:ce5e71c5b7ce3205321825bfa8a5809f78d1c6a03fe8ba5143dfd0f92a21ddf1","observation_id":"aa9a3b01-bb03-450a-99af-9d8a6774b9fb","resolution":{"observed_at":"2026-08-06T22:14:45.530690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.375622Z","title":"The first pass extracts the question and identifies any additional visual component; the second checks the extraction against the same source image","venue":null,"work_id":"cb3f5c64-7e03-4a0e-8cfb-0e675eb0daef","year":2026},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.510098Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:6b8a322e765d2d7ebdda4df2cb4e70ee953ab1923ac3916632deec3fa1e51a1e","observation_id":"ab27c39d-b6aa-4ebe-b7ec-8fa2a3cfa6c9","resolution":{"observed_at":"2026-08-06T22:14:45.409774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4820.3090","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:44.326780Z","title":"Their fixed equal-weight average requires no fitted fusion parameters and reaches 0.4780 RMSE, but its paired intervals relative to either component cross zero","venue":null,"work_id":"3e9c3d07-6901-4fe3-9bc9-a53a9c662bf1","year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.777152Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:f00f6e82e55c46689651800e1a6c1ed8cbb01f529fe99eceba3c35e132fd0666","observation_id":"90b2eeb5-5ce5-454c-b667-171a4c3629ab","resolution":{"observed_at":"2026-08-06T22:14:44.413204Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2220.1360","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:44.089152Z","title":"The complete group is shown in Table 21; withn= 4, its aggregate ordering is not a stable estimate of a population effect","venue":null,"work_id":"e9ae0d4d-59fe-43a3-b4b2-a43bc143a769","year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":227,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.862454Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:a5d6666c421f4704584bcba447b0fb57dfb4b1fa82b167efcca08b274a73c172","observation_id":"50e53fcb-2e65-4ccd-a2bd-21fdb7002b07","resolution":{"observed_at":"2026-08-06T22:14:44.168609Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:42.425904Z","title":"Text-based approaches to item difficulty modeling in large-scale assessments: A systematic review.arXiv preprint arXiv:2509.23486,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":1995,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.425904Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:1c86acf4d779a8dc277e9981b41593636870fe6cb3b7ae4e97061243e3b41c40","observation_id":"bada4227-35fd-45f3-8f01-b32ab37598a2","resolution":{"observed_at":"2026-08-06T22:14:42.425904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.928587Z","title":"Upn-icc at bea 2024 shared task: Leveraging llms for multiple-choice questions difficulty prediction","venue":null,"work_id":"360dfb08-8aae-4451-89a0-c213c2850fc5","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.947120Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:cb7e57e63939ad66377534cfb977e7a8380131c8b5c2e58680402b556ef5df3a","observation_id":"db0ccafa-0121-4b8c-8271-50e31ff37395","resolution":{"observed_at":"2026-08-06T22:14:46.984440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.923528Z","title":"Itec at bea 2024 shared task: Predicting difficulty and response time of medical exam questions with statistical, machine learning, and language models","venue":null,"work_id":"e0f39751-6131-4e2f-924b-5e4320398409","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.766515Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:7b80517e0ae93165c4b90c7f8345bc4b2f16ba8223e14e2f18d6d8e6e138493a","observation_id":"06cfef41-6ed2-4ae9-a3f9-8a8918e138c0","resolution":{"observed_at":"2026-08-06T22:14:45.969488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.686935Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts","venue":null,"work_id":"896bebb9-8965-4b38-85d6-ad563664e21d","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.154492Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:b6f20d1ae9cd14fd6c4b74cfc6ada540b1a1da9f6225fe58f94c5b57ac6923e0","observation_id":"dbe14f68-7146-471a-bdf7-6beb39fd66b5","resolution":{"observed_at":"2026-08-06T22:14:46.752576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.18880","last_updated":"2026-05-10T20:55:34Z","snapshot_observed_at":"2026-07-06T22:39:43.359149Z","submitted_at":"2025-12-21T20:41:36Z","title":"Can LLMs Estimate Student Struggles? Human-AI Difficulty Alignment with Proficiency Simulation for Item Difficulty Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.18880","snapshot_observed_at":"2026-08-06T22:14:42.098999Z","title":"Can llms estimate student struggles? human- ai difficulty alignment with proficiency simulation for item difficulty prediction.arXiv preprint arXiv:2512.18880, 2025a","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.098999Z"},"links":{"cited_paper":"/paper/2512.18880","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:79074019b35f30c91bb6a48b68103fc23a48f6a423d1ee64a10840b2ed61d9a9","observation_id":"1e35b22c-56f3-4ced-8e4e-2d405770b86d","resolution":{"observed_at":"2026-08-06T22:14:42.098999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:45.680777Z","title":"Findings from the first shared task on automated prediction of difficulty and response time for multiple-choice questions","venue":null,"work_id":"cd31080d-becf-4aba-8495-4829f4f7c415","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.061599Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:444c8109ee9d47167096050d4f937cd0cdbcbae8812b91cc3f8827f6c4026dba","observation_id":"50f12ec2-a5d3-4be4-8314-d03d8652eedf","resolution":{"observed_at":"2026-08-06T22:14:45.723412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18589","last_updated":"2025-05-13T06:32:02Z","snapshot_observed_at":"2026-08-07T15:59:38.409028Z","submitted_at":"2025-04-24T06:16:38Z","title":"Benchmarking Multimodal Mathematical Reasoning with Explicit Visual Dependency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18589","snapshot_observed_at":"2026-08-06T22:14:43.010301Z","title":"Benchmarking multimodal mathematical reasoning with explicit visual dependency.arXiv preprint arXiv:2504.18589, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:43.010301Z"},"links":{"cited_paper":"/paper/2504.18589","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:e10574d658358ade88b3b47252b70323af5cca794e44c13840189403f875a29d","observation_id":"6c60d004-d4e4-40e4-ba33-741b9556fb0e","resolution":{"observed_at":"2026-08-06T22:14:43.010301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-06T22:14:41.888312Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling.arXiv preprint arXiv:2412.05271,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.888312Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:b6558ce42d363bf399a3f3024cf46f557cb58d758bb0a9b3a979bfe4d41e051f","observation_id":"edefa4ec-cb67-4ec7-8919-ee6a1ab7dcae","resolution":{"observed_at":"2026-08-06T22:14:41.888312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T22:14:42.314157Z","title":"GPT-5.5 System Card, 2026.https://openai.com/index/gpt-5-5-system-card/","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.314157Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:a7da2549cd0f6cb70dc80df067a8c3cd810a19fc62e1afe7fee5b82c6d90622e","observation_id":"3f79b8d6-8391-4e01-a64b-78c0565ce311","resolution":{"observed_at":"2026-08-06T22:14:42.314157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.330758Z","title":"Large language models are students at various levels: Zero-shot question difficulty estimation","venue":null,"work_id":"83583968-18be-4621-b2f5-e96a9374263f","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.372717Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:e35c7bee603952794aec9b8e29cd06376ac6f733e0992eaa17263bb97db39cf8","observation_id":"f775a61b-6148-4ee8-8ec8-5558b4a5a38d","resolution":{"observed_at":"2026-08-06T22:14:46.391100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T22:14:41.746790Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.746790Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:7b848b9f27c21b29473aaec7266c27d593cf74e2d82fec23fb411c08d5a9afb4","observation_id":"9d261d2a-9061-44d3-a16c-074588c9455d","resolution":{"observed_at":"2026-08-06T22:14:41.746790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:46.799743Z","title":"Utilizing machine learning to predict question difficulty and response time for enhanced test construction","venue":null,"work_id":"d37b5778-044e-42e8-8ff4-2ed6d67c95d5","year":2024},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:42.002766Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:2fb2fd32e4ae0cfb3f04a25ccc5cf9fe778e7773b63792b7bb49a2406006c367","observation_id":"bd1f35c3-6685-44ca-b59a-31fc5afdaa51","resolution":{"observed_at":"2026-08-06T22:14:46.861974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:14:47.041092Z","title":"Geoqa: A geometric question answering benchmark towards multimodal numerical reasoning","venue":null,"work_id":"75ad39f7-edec-4026-b232-074be0eb9daf","year":2021},"citing_paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T22:14:41.835610Z"},"links":{"citing_paper":"/paper/2608.04554"},"observation_digest":"sha256:158363504f464d523579aa0bfe4be2e295d66e6c19dcc82a006e95b25f895ade","observation_id":"357b56c4-fdb2-418b-90ed-5656ae20e6ba","resolution":{"observed_at":"2026-08-06T22:14:47.064968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04554","last_updated":"2026-08-05T07:47:34Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T18:17:49.445764Z","submitted_at":"2026-08-05T07:47:34Z","title":"Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":5,"verified_fuzzy":13},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2608.04554."}