{"as_of":"2026-08-17T08:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d7fb2e59aa821f29e54da4d050c3c2b8db310a4024cd5aa9eaeee7d6dfda108","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:34:14.322352Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.19662/citation-record","integrity":"/paper/2506.19662/integrity","json":"/paper/2506.19662/citation-record.json","paper":"/paper/2506.19662"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.817699Z","title":"Education Sciences13(12), 1216 (2023) https://doi.org/10.3390/educsci13121216 EISSN 2227-7102","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.817699Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:d958017c8639109c213f8e21064e195349f5a95634dcae5d67f7274fecb57929","observation_id":"7f0a4165-2bb1-4003-8d26-31ab636798f0","resolution":{"observed_at":"2026-08-15T18:34:13.817699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.609704Z","title":"IEEE Transactions on Learning Technologies17, 12–31 (2024)","venue":null,"work_id":"a4740386-2236-47a6-9b27-afd1cea1fab2","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.825621Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:d0dcfbfb923b2706c2cb1762a2b8e5e8b144057a2aaac117bc87b6981a79a42f","observation_id":"fa532326-5028-443d-a20f-26a1ead85886","resolution":{"observed_at":"2026-08-15T18:34:16.616323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09748","last_updated":"2025-03-12T18:47:07Z","snapshot_observed_at":"2026-08-16T12:50:37.543791Z","submitted_at":"2025-03-12T18:47:07Z","title":"Advancing Education through Tutoring Systems: A Systematic Literature Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09748","snapshot_observed_at":"2026-08-15T18:34:13.832750Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.832750Z"},"links":{"cited_paper":"/paper/2503.09748","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:ed7a735c36d7da22b861df4e48c918e7a612411287821d5e03f7fb8926dc5db7","observation_id":"6f8a1633-d3ba-4c31-836a-85f66125bda8","resolution":{"observed_at":"2026-08-15T18:34:13.832750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.587047Z","title":"Computer Science & IT Research Journal4(3), 185–199 (2023)","venue":null,"work_id":"f7983ffd-0ebd-493c-b99c-f39c5f23330e","year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.843378Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:776c37b433e665d32bf9f89f2fc28885a24e87762741f831c9eaec916da7b578","observation_id":"26d92742-06c9-4c82-9552-fe748b23e0e1","resolution":{"observed_at":"2026-08-15T18:34:16.595088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.569702Z","title":"Language Education & Technology (LET Journal)3(2), 96–109 (2023)","venue":null,"work_id":"7d59302d-27f5-4e8b-be56-0d4dcf89681d","year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.851754Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:dc4475ea6e3b6dfb1baa7d91f86032f73a34e03588ff5c96429058d079e643e3","observation_id":"a492459c-6e0e-406b-a07d-f63b899f63ce","resolution":{"observed_at":"2026-08-15T18:34:16.575193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.858752Z","title":"European Journal of Physics45(2), 025701 (2024) https://doi.org/10.1088/1361-6404/ad1420","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.858752Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:2f07962135b27c029542f9a51bc6419b29dc3c005bf08aac988149434f43e665","observation_id":"d78644f5-cbc7-4186-9276-b99a81f46c91","resolution":{"observed_at":"2026-08-15T18:34:13.858752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17080","last_updated":"2024-06-05T04:05:42Z","snapshot_observed_at":"2026-08-16T14:31:08.951193Z","submitted_at":"2023-12-28T15:49:43Z","title":"MR-GSM8K: A Meta-Reasoning Benchmark for Large Language Model Evaluation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17080","snapshot_observed_at":"2026-08-15T18:34:13.864631Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.864631Z"},"links":{"cited_paper":"/paper/2312.17080","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:8c27ad3d91bddbf610d0c1ec74f0e2e06154fc1f68049791831bcd7e30b5418c","observation_id":"90254395-1384-45be-af8c-6e84967999e5","resolution":{"observed_at":"2026-08-15T18:34:13.864631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10497","last_updated":"2025-05-26T17:20:21Z","snapshot_observed_at":"2026-08-16T12:50:19.312921Z","submitted_at":"2025-03-13T15:59:20Z","title":"MMLU-ProX: A Multilingual Benchmark for Advanced Large Language Model Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10497","snapshot_observed_at":"2026-08-15T18:34:13.869768Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.869768Z"},"links":{"cited_paper":"/paper/2503.10497","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:f5f7aea58c3b7a94384b9f0016c07bb9be7861121789d52a784b9b28eb6505e8","observation_id":"14f40808-586a-466a-b62c-7d7f60dc7391","resolution":{"observed_at":"2026-08-15T18:34:13.869768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.874587Z","title":"Physical Review Physics Education Research21(2), 020157 (2025) https: //doi.org/10.1103/6fmx-bsnl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.874587Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:2d806b073b2a8bc218a9233de90d63ef25456a9f17039509b66d6e2a7e2d3592","observation_id":"9191599c-79e1-4008-a101-b9e52c436982","resolution":{"observed_at":"2026-08-15T18:34:13.874587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.881281Z","title":"Physics Education59(2), 025010 (2024) https://doi.org/10.1088/1361-6552/ad1fa2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.881281Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:a5536a0e20bdc51dd6ff267ace736190ae70c2fcc7ad070880cb149f2b5615a7","observation_id":"539d7c26-0749-4958-8908-e20b39d47fbd","resolution":{"observed_at":"2026-08-15T18:34:13.881281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04538","last_updated":"2023-06-21T12:19:09Z","snapshot_observed_at":"2026-08-16T15:25:46.749139Z","submitted_at":"2023-06-07T15:44:14Z","title":"Evaluation of ChatGPT and Microsoft Bing AI Chat Performances on Physics Exams of Vietnamese National High School Graduation Examination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04538","snapshot_observed_at":"2026-08-15T18:34:13.886225Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.886225Z"},"links":{"cited_paper":"/paper/2306.04538","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:ca1d072188b972fd250af851a7ed03391ecc539975153611917d10b2acbc62e4","observation_id":"981d010a-dccc-4fc7-b76c-6e108bdb622d","resolution":{"observed_at":"2026-08-15T18:34:13.886225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.893110Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.893110Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:c3a5157242c1a7b95e378c1005722c71948361cc7423d32cca58d8f4ed652da3","observation_id":"ab8c6d23-9d78-4971-bbdf-6916364ab644","resolution":{"observed_at":"2026-08-15T18:34:13.893110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15866","last_updated":"2023-09-26T20:12:26Z","snapshot_observed_at":"2026-08-16T14:57:23.175722Z","submitted_at":"2023-09-26T20:12:26Z","title":"ChatGPT & Mechanical Engineering: Examining performance on the FE Mechanical Engineering and Undergraduate Exams","version":1},"cited_work":{"arxiv_id":"2309.15866","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.15866","snapshot_observed_at":"2026-08-15T18:34:16.040235Z","title":"ChatGPT & Mechanical Engineering: Examining performance on the FE Mechanical Engineering and Undergraduate Exams","venue":"cs.CY","work_id":"8434d2c6-3d6a-43c5-874c-163dc56fe915","year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.898440Z"},"links":{"cited_paper":"/paper/2309.15866","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:b561e40d19a389bc580553eff46a48ced0922ed315187daa11e8ccf260874974","observation_id":"a550d8df-84b4-4019-8597-e4ac93b439df","resolution":{"observed_at":"2026-08-15T18:34:16.047006Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.552182Z","title":"https://openai.com/chatgpt/overview/","venue":null,"work_id":"ad6305e1-ad7c-4898-8e26-c9a9b512932a","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.904881Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:5fcc29c66571665da41390461ed6720a383e9b4e2c12b0098280b473e7f47522","observation_id":"3bea3459-2568-4159-85e0-72a35a37a6e7","resolution":{"observed_at":"2026-08-15T18:34:16.557749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1088/1361-6552/ad3d21","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.782639Z","title":"Physics Education59(4), 045005 (2024) https://doi.org/ 10.1088/1361-6552/ad3d21","venue":null,"work_id":"e9884ade-972b-4da7-8b31-d3108472d7fa","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.910018Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:3a9d6427578abad0272fa13ec010529c4e61c8a68dd946e801ae6b608665556d","observation_id":"07996907-9d7f-41c6-9a9e-2b20efe80304","resolution":{"observed_at":"2026-08-15T18:34:14.788284Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.916959Z","title":"Computers and Education: Artificial Intelligence5, 100318 (2024) https://doi.org/10.1016/j.caeai.2024.100318","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.916959Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:a25e4dc36f3df8c874927f43f834047597afc7ad39f6d5d55ada50302248770b","observation_id":"ba559a17-0872-49a8-b6b6-3eca7f3086eb","resolution":{"observed_at":"2026-08-15T18:34:13.916959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.923540Z","title":"Scientific Reports15(1), 17458 (2025) https: //doi.org/10.1038/s41598-025-97652-6","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.923540Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:32dc732569f5572ab713be07bfc580daff10859e6efe75a94d76392fa5aba614","observation_id":"59eff263-b670-4aea-abcc-b19fbe6beee9","resolution":{"observed_at":"2026-08-15T18:34:13.923540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.13304","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:15.938152Z","title":"Frontiers in Education8(2024) https://doi.org/10.3389/feduc.2023.1330486","venue":null,"work_id":"6833ea3d-bba0-47db-92dd-13038dba8e45","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.929291Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:96a40230c0e44b5bb8dec5782cbdbb01de779c46677a55699fc16c5ffc6c2fc8","observation_id":"df639bdb-2ab1-4b02-bf19-5d09722ddd57","resolution":{"observed_at":"2026-08-15T18:34:15.947540Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1119/5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.743876Z","title":"American Journal of Physics91(12), 955–958 (2023) https://doi.org/10.1119/5","venue":null,"work_id":"41b5bdb5-ae59-45be-86b6-0b8ff3af8e5e","year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.934877Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:5ca3f4c953a418dd5a46764957e1a847da40cd006887beb09a01e276105462ad","observation_id":"0ba0d86f-67a0-45b2-9907-8b3a675c1022","resolution":{"observed_at":"2026-08-15T18:34:14.751564Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.942927Z","title":"Physics Education 58(3), 035027 (2023) https://doi.org/10.1088/1361-6552/acc5cf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.942927Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:7e77aa8d2fc37e592255ca80dd1804dc02412b2dd8d7fcf14c7195181e3257f4","observation_id":"a56ca8e2-5796-4100-b189-0f751b72f9fa","resolution":{"observed_at":"2026-08-15T18:34:13.942927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-024-73634-y","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.697917Z","title":"Scientific Reports14, 23285 (2024) https://doi.org/10.1038/s41598-024-73634-y","venue":null,"work_id":"1a403e92-159d-440b-85fa-99bc84d5f9d4","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.948222Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:99721d49f67a633d9a8ec8cab9c38cae04f09a7b5cf46c6da46499672f3f9f5c","observation_id":"5a1cce64-f1b4-41ff-a68e-aab15281d27b","resolution":{"observed_at":"2026-08-15T18:34:14.703402Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.533758Z","title":null,"venue":null,"work_id":"de8ffec8-8c6a-4ef9-ad9a-45842551d68d","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.954216Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:9b25a5c0ad5704c7df68074785de8ecc1cb8509aa84d465c73775dd56d30034e","observation_id":"3e9ea4b3-623e-4547-b7a4-3b2de6d06666","resolution":{"observed_at":"2026-08-15T18:34:16.539611Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12415","last_updated":"2023-12-31T19:47:55Z","snapshot_observed_at":"2026-08-16T14:41:35.429908Z","submitted_at":"2023-11-21T08:08:57Z","title":"Data Dialogue with ChatGPT: Using Code Interpreter to Simulate and Analyse Experimental Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12415","snapshot_observed_at":"2026-08-15T18:34:13.960000Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.960000Z"},"links":{"cited_paper":"/paper/2311.12415","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:0e69e0664df5e5065ccdf4c24e35b9660001bfa2e7eb46ab1f10091b038d08a3","observation_id":"76261166-52b3-4374-88e9-2a296f6476a3","resolution":{"observed_at":"2026-08-15T18:34:13.960000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11223","last_updated":"2025-06-11T13:19:22Z","snapshot_observed_at":"2026-08-16T08:40:44.569712Z","submitted_at":"2025-01-20T02:16:19Z","title":"Reasoning Language Models: A Blueprint","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11223","snapshot_observed_at":"2026-08-15T18:34:13.965732Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.965732Z"},"links":{"cited_paper":"/paper/2501.11223","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:ea7c5f8a609a58effae480151c971aca57d6c8789c53515941ca181a30af9910","observation_id":"f3f6f99b-846b-41f1-b683-f2a959a9ecf5","resolution":{"observed_at":"2026-08-15T18:34:13.965732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-15T18:34:13.975698Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.975698Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:e9312a90093691766f034fcf7ff71f74387d8898be01833250537b52c6b0b454","observation_id":"0bb72430-6ee9-4488-aece-695e94b79211","resolution":{"observed_at":"2026-08-15T18:34:13.975698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.980876Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.980876Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:343b442406cd373c9a63bf42d25e203b194a13db786e93230808830843f0dc89","observation_id":"5794bccb-357b-418b-9ef0-da5b7e5c37b4","resolution":{"observed_at":"2026-08-15T18:34:13.980876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12054","last_updated":"2025-05-26T13:42:06Z","snapshot_observed_at":"2026-08-16T12:57:37.477350Z","submitted_at":"2025-02-17T17:24:14Z","title":"PhysReason: A Comprehensive Benchmark towards Physics-Based Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12054","snapshot_observed_at":"2026-08-15T18:34:13.986057Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.986057Z"},"links":{"cited_paper":"/paper/2502.12054","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:3164c44c8d768f9601350ad86ba143517beebb727cc65fdec1d6f4988db4ad1a","observation_id":"215662da-4e8e-425f-b409-b0b8670182a7","resolution":{"observed_at":"2026-08-15T18:34:13.986057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.509191Z","title":"https://ml-site.cdn-apple","venue":null,"work_id":"fefd66f5-cb2d-44ac-80f0-df704d10fd9f","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.990827Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:197792b1b7208f2108be66eb79003172a7724109322bb4520cf724d240c7a229","observation_id":"9faaa983-0544-40ef-84c4-3c1d84c818d6","resolution":{"observed_at":"2026-08-15T18:34:16.519831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:13.996468Z","title":"In: Proceedings of the IEEE International Conference on Big Data (BigData), pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:13.996468Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:884e231ecccbb90adc531922a00843c0258579428efbfc8dc9ecd6e48afed811","observation_id":"0b625643-bccc-4c7e-9a32-f8bae57f12e0","resolution":{"observed_at":"2026-08-15T18:34:13.996468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01319","last_updated":"2024-08-02T15:14:53Z","snapshot_observed_at":"2026-08-16T13:28:56.412197Z","submitted_at":"2024-08-02T15:14:53Z","title":"A Comprehensive Review of Multimodal Large Language Models: Performance and Challenges Across Different Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01319","snapshot_observed_at":"2026-08-15T18:34:14.001521Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.001521Z"},"links":{"cited_paper":"/paper/2408.01319","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:dc2675d6f88652337ce1a439569daa2c9d08c88adc22151836cee9f41c161a97","observation_id":"5c734466-9be6-4f30-a6ee-71beac7988d2","resolution":{"observed_at":"2026-08-15T18:34:14.001521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.007324Z","title":"Learning and Individual Differences118, 102601 (2025) https://doi.org/10.1016/j.lindif.2024.102601","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.007324Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:7f4dfa7309944dae49041637e902524718b5da233df82cef9da45fa5361c2224","observation_id":"155218de-2fe5-41cf-8f80-8c9d5000c96f","resolution":{"observed_at":"2026-08-15T18:34:14.007324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.490334Z","title":"(eds.): Multiple Representations in Physics Education vol","venue":null,"work_id":"2dd9d0da-2f89-46dd-95dc-a07733fab146","year":2017},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.012387Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:c2ebdfeb9986f5549618513e60589e125c136c8160b55ba16d8e8e89ad238a40","observation_id":"25bda3b0-9234-459d-be73-89b44a82f918","resolution":{"observed_at":"2026-08-15T18:34:16.495640Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.017439Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.017439Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:03b42a8847a03b36a216c3d4e58493fb71f88aa638034762efdf411bdcf6e43e","observation_id":"13b1c6f6-1459-4fc3-b6b8-e5e03c90c2b8","resolution":{"observed_at":"2026-08-15T18:34:14.017439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.473290Z","title":"International Journal of Advanced Multi- disciplinary Research and Studies5(1), 7–18 (2025) https://doi.org/10.62225/ 2583049X.2025.5.1.3610","venue":null,"work_id":"b513fc69-88af-42b0-afc4-5390589a2a2f","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.022892Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:e141b8019923d8ae3eb4c99e0c08891e814f1c86c4d2747e3c6bf7e9769d5dde","observation_id":"b37a7a8d-c21c-4d0d-9614-e50c69e6c394","resolution":{"observed_at":"2026-08-15T18:34:16.478781Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.028143Z","title":"chatgpt vs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.028143Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:eea677ae67db09cb16c02ceddc3b633adae0532858489b5cfc6cdca41f816c47","observation_id":"d4045639-fecd-4791-9217-1e51c82862ab","resolution":{"observed_at":"2026-08-15T18:34:14.028143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1119/perc.2024.pr.polverini","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.667035Z","title":"In: Proceedings of the Physics Education Research Conference (PERC), Boston, MA (2024)","venue":null,"work_id":"d8026f6c-0ad2-4505-8da8-3abf9c7d719f","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.033170Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:203883c3fc8eb5dc3e763af2c3e78325426ce86d73ac7d72c8e287dc4225052e","observation_id":"ebb0047a-0e79-4918-9362-388e310203ae","resolution":{"observed_at":"2026-08-15T18:34:14.673398Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.039530Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.039530Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:d332ac9c6155faffa3893f70f67d637e51a6edcf3eea6a752c2490127479162d","observation_id":"2b614932-795c-4444-a701-2cc63d756547","resolution":{"observed_at":"2026-08-15T18:34:14.039530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8610.36786","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:15.432740Z","title":"Artificial Intelligence in Physics Courses to Support Active Learning (ICSLT ’24 proceedings), 68–75 (2024) https: //doi.org/10.1145/3678610.3678631","venue":null,"work_id":"8232f4ca-b0a5-49ac-980d-c83daf48c988","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.046553Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:11033d74a2e376a0f70bf884abc45c7871adfac9cada8571918adb4ab83be81d","observation_id":"cfcb479e-5a06-4ad4-884f-8430c6153893","resolution":{"observed_at":"2026-08-15T18:34:15.446258Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.051986Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.051986Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:31f7fef092a78a3465b94972e4c7fd550d1cc6766e918d19a7737b0d6e885bcb","observation_id":"a13741c5-2b31-4a0e-a997-439b08ce954d","resolution":{"observed_at":"2026-08-15T18:34:14.051986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.061407Z","title":"Frontiers in Education9, 1452414 (2024) https://doi.org/10.3389/feduc.2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.061407Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:30cd5a842cd8353404b7d293e988c79348d75436d6c84bc420f700843930b605","observation_id":"d4ea7159-7eff-4ec7-95d5-71cfb5eb1d6e","resolution":{"observed_at":"2026-08-15T18:34:14.061407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.457624Z","title":"Technical report, OECD Publishing (2023)","venue":null,"work_id":"7e526004-ae9f-48df-be31-0857e58292c7","year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.066916Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:4048da3c9d448405ca6031687439929915a165779cabe495767372c31ce23599","observation_id":"e9ef5e9b-0e3b-4161-bde4-daf72e7f2e1a","resolution":{"observed_at":"2026-08-15T18:34:16.462656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.439400Z","title":"PhD thesis, Uppsala University, Department of Physics and Astronomy, Physics Didactics, Uppsala, Sweden (May 2025)","venue":null,"work_id":"901cc85f-8791-416f-aa03-0453a0ec0114","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.072118Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:e873d8a7b1530baf2501ddec8b277b5651719c6d2fdac939e545081cf24a2d3f","observation_id":"937a41de-62f5-49e1-a284-7684e5fa5c27","resolution":{"observed_at":"2026-08-15T18:34:16.445970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.422536Z","title":"Teaching & Learning Inquiry10(2022) https://doi.org/10.20343/ teachlearninqu.10.3","venue":null,"work_id":"8f0f0f52-4656-411c-9add-5a0173f053b7","year":2022},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.078958Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:ebb707c7a9281a67e9698f3f1752c2a95bf80cba40a7da02a71614b731b2aa91","observation_id":"c3160523-249e-48fa-8c65-320c1bb1edc4","resolution":{"observed_at":"2026-08-15T18:34:16.427733Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.405879Z","title":"(eds.) Constructivist Instruction: Success or Failure?, pp","venue":null,"work_id":"9b73c7c7-a898-41de-9960-a2f91873ec7d","year":2009},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.084927Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:5c57f523a1bdd273a1b72a0515e5ac98f1507d293eace60ad451bd9a004e2c6e","observation_id":"8cb6fcf6-aa80-4f84-aae3-1b697804ed1c","resolution":{"observed_at":"2026-08-15T18:34:16.411209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1725.2011","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:15.326497Z","title":"The Educational Forum75(3), 210–227 (2011) https://doi.org/10.1080/00131725.2011.577669 22","venue":null,"work_id":"7948c61a-5fb0-4612-acd4-a538496f5187","year":2011},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.091450Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:d3c0a9b27df2297d9146583a522b20822bae96fba0e674450117523eed417f1d","observation_id":"eac70dfa-cb45-42b7-9e16-a9734c5fbb05","resolution":{"observed_at":"2026-08-15T18:34:15.346798Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.388475Z","title":"Educational Research Quarterly31(3), 39–56 (2008)","venue":null,"work_id":"57cfa0aa-ffa3-42a0-94cb-afafe7e57e43","year":2008},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.100704Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:cde6c17935718acdddee101aacc6486eeb680a5881a36e9638b72bff91d8fa4e","observation_id":"7d4c1b7b-c47e-4537-acb3-7263a864f16a","resolution":{"observed_at":"2026-08-15T18:34:16.394447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.106947Z","title":"Physical Review Physics Education Research19(2), 020163 (2023) https://doi.org/10.1103/PhysRevPhysEducRes.19.020163","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.106947Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:e681ae042cc8037728272f4d60e5eafd65567191ec1493d3262286f39317d2b4","observation_id":"7cfc24cf-cd33-4554-a48e-4b972b02b478","resolution":{"observed_at":"2026-08-15T18:34:14.106947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.374211Z","title":"Physi- cal Review Physics Education Research20(2), 020144 (2024) https://doi.org/10","venue":null,"work_id":"c9c869b7-cc15-4eec-a57d-a2816af97b7f","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.114393Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:55b05082e84cfa5d8de077c837f7d1758c07574bd31d22a129f594677c617ff9","observation_id":"27d8d0c0-f424-4248-93dd-d2321e17fcc5","resolution":{"observed_at":"2026-08-15T18:34:16.378979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.120235Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.120235Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:77aa0fb445fe77b15d0197b2bc92c633a38de620d81fe25f4f3613a1aa9a7128","observation_id":"7cf48669-5229-4c8f-8e66-24c7c3d736f5","resolution":{"observed_at":"2026-08-15T18:34:14.120235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.358387Z","title":"Physical Review Physics Education Research21(1), 010126 (2025) https://doi.org/10","venue":null,"work_id":"ad270695-5218-4d3f-948d-06d34ad95dcb","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.126696Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:2fe5fb080d2c752a5598d17aa0b13ab852e662d02d1970e581182556149d20a8","observation_id":"a74baa2a-e2d8-4559-b9c7-541231fc5d2a","resolution":{"observed_at":"2026-08-15T18:34:16.364427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/physrevphyseducres.20.010152","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.582063Z","title":"Physical Review Physics Education Research20(1), 010152 (2024) https://doi.org/10.1103/PhysRevPhysEducRes.20.010152","venue":null,"work_id":"ee73f306-a1fc-43f9-adef-fda355278a5d","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.132806Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:282f2e2dcbbf5689cb60ff7c1a947d3db9400982656c4c422f0e8abf15c3a261","observation_id":"c83f5397-bce9-441b-ae17-826d3ba9e85b","resolution":{"observed_at":"2026-08-15T18:34:14.587360Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1140/epjqt/s40507-025-00334-5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.562618Z","title":"EPJ Quantum Technology 12(1), 33 (2025) https://doi.org/10.1140/epjqt/s40507-025-00334-5","venue":null,"work_id":"7da44f47-c290-472b-88c3-7fa2a2c22e07","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.138946Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:2b942447b349c82b4e869540cf076609de810d83e504c3937bab770e077e5e39","observation_id":"b48ebd8c-820a-4ec3-ace1-35716ea01aa5","resolution":{"observed_at":"2026-08-15T18:34:14.568692Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07407","last_updated":"2024-11-11T22:27:36Z","snapshot_observed_at":"2026-08-16T13:00:59.888969Z","submitted_at":"2024-11-11T22:27:36Z","title":"Using Generative AI and Multi-Agents to Provide Automatic Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07407","snapshot_observed_at":"2026-08-15T18:34:14.145575Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.145575Z"},"links":{"cited_paper":"/paper/2411.07407","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:254862c0697319cd97de154fe6ce85e9f26e81b42ee9e5ea1ff04a43d079b733","observation_id":"00ab6ddd-0c94-47d5-beb4-b464eed531b0","resolution":{"observed_at":"2026-08-15T18:34:14.145575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/educsci15020233","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.540080Z","title":"Education Sciences15(2), 233 (2025) https://doi.org/10.3390/educsci15020233","venue":null,"work_id":"b1898df6-6d9f-4957-a81b-f8740d7f964b","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.151204Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:074368728edd682132b5b01c60d7bf0295e43423e0887e6962dc762a9d89e867","observation_id":"4e16b706-a8fc-43a3-871a-75c4b8fba876","resolution":{"observed_at":"2026-08-15T18:34:14.548646Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1119/perc.2024.pr.el-adawy","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.511090Z","title":"In: 2024 Physics Education Research Conference Proceedings, pp","venue":null,"work_id":"11fe056d-edb4-4bcd-9d28-d126cc76caf7","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.163492Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:c1e2db29174200c1df3a7981062d9f933844247914b0833aaf3c2a6deeb5e79d","observation_id":"e2b65d10-7c77-4afd-9120-04dca6478086","resolution":{"observed_at":"2026-08-15T18:34:14.516392Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.340171Z","title":"Physical Review 23 Physics Education Research21(1), 010136 (2025) https://doi.org/10.1103/ PhysRevPhysEducRes.21.010136","venue":null,"work_id":"30745397-b019-4df6-883d-c1f28e06c098","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.169285Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:e341de03520149f44b6272b5a27a8f4cb6c2966a35280a3b6cb69e3e31291ef8","observation_id":"b421b229-4314-4ebb-96aa-eb41a7d0da2c","resolution":{"observed_at":"2026-08-15T18:34:16.346427Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.323465Z","title":"https://www","venue":null,"work_id":"58401f3a-98db-454f-ade3-e52d6d009c56","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.175430Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:89981f657eae42c7594af2f0f740547c99e28091ccdae4139b2b19822c99dc49","observation_id":"32799dd4-ad56-445b-8b49-a70e586e0157","resolution":{"observed_at":"2026-08-15T18:34:16.328655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.306594Z","title":"https://www.youtube","venue":null,"work_id":"756f0deb-4e93-4ab9-b13b-f8cf4c95c00f","year":2023},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.183987Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:15cb9e3e137b4a29600d19166f95d3b4a5602f1fcf71f8946c2b92f9738c41ce","observation_id":"46c464d8-1cbd-48cf-b1f5-25961d847180","resolution":{"observed_at":"2026-08-15T18:34:16.312600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19730","last_updated":"2024-10-29T03:48:33Z","snapshot_observed_at":"2026-08-16T13:05:52.833040Z","submitted_at":"2024-10-25T17:56:24Z","title":"Counting Ability of Large Language Models and Impact of Tokenization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19730","snapshot_observed_at":"2026-08-15T18:34:14.189386Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.189386Z"},"links":{"cited_paper":"/paper/2410.19730","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:157039f6fe4c0298e378fbde5ce2c953c76277132c817a9da8cc5d9544cef8be","observation_id":"5942ec7d-0ba3-4297-98ca-4203061cef10","resolution":{"observed_at":"2026-08-15T18:34:14.189386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.289798Z","title":"Journal of AI and Education (2025)","venue":null,"work_id":"dd138ceb-2229-4655-9015-7a1092650674","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.200459Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:2d6ce95758eeffe45ebcdf72983c72996bbbbb70c80420cf44b8ad2f3385a6bb","observation_id":"f4637ed1-81fa-45c6-aeee-6df663f17ab2","resolution":{"observed_at":"2026-08-15T18:34:16.294735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.273934Z","title":"https://www.unesco.org/en/articles/ ai-literacy-and-new-digital-divide-global-call-action","venue":null,"work_id":"108972d6-d312-4bad-a34d-53b44b00671f","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.208848Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:12f603b219c85e991b8a19e5b3508c8b6f4a26c7e61eea40b3b54a87c68f965a","observation_id":"e44665b0-08a9-4b2f-b28c-148e4f65c90a","resolution":{"observed_at":"2026-08-15T18:34:16.279000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.255798Z","title":"https://docs.anthropic.com/en/docs/about-claude/ models/overview","venue":null,"work_id":"fd7d2e76-77d8-4cce-84ee-78db50a602da","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.222735Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:db0387a1d0cdbfa5aa017aba4ebb80081c3905e92e0346884a151c992992b3ff","observation_id":"eb03f58e-e134-4dc2-a622-53a69ec2eaf4","resolution":{"observed_at":"2026-08-15T18:34:16.261982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.238495Z","title":"https://ai.google.dev/gemini-api/docs/models?utm source=chatgpt.com","venue":null,"work_id":"262c8776-bf23-4eef-9aa8-1f308bb5b54d","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.230278Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:c66d08ba3e385e7981741f40fe2b42f625d3733a186a3407b05f951a4d098b62","observation_id":"50d267ff-3396-4376-801d-c60f43536162","resolution":{"observed_at":"2026-08-15T18:34:16.244993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.217222Z","title":"https://ai.google.dev/gemma/docs","venue":null,"work_id":"07565922-7237-4e26-9316-f4e088e32e4e","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.235953Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:e52bbf2fd396fa10f9fe09b67754c910c44f01cce1286a05a3e50f30f510afed","observation_id":"6a8d8375-03df-4053-9e93-7e87de1faf8b","resolution":{"observed_at":"2026-08-15T18:34:16.222900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.197726Z","title":"https://platform.openai.com/docs/models?utm source= chatgpt.com","venue":null,"work_id":"0e7b25f6-b7a2-49e4-97bf-a5d53f706a77","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.241162Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:4f0a4f0277479e0a408e16b4e89620d35b40009e9945aee5b92ecc25ca65f366","observation_id":"69af45c0-6e68-4c2a-9aac-b12a034aebb7","resolution":{"observed_at":"2026-08-15T18:34:16.203581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/physrevstper.2.010105","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.488078Z","title":"Physical Review Special Topics - Physics Education Research2(1), 010105 (2006) https: //doi.org/10.1103/PhysRevSTPER.2.010105","venue":null,"work_id":"af9c1f7f-2bba-4110-b78d-a8b9aaab3259","year":2006},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.246461Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:47743ea3bb0ee8a9bb61aa349607a304a4dcc08ac65671bd9bb98ca3822dd4c4","observation_id":"25b723fd-1bb4-4f0b-8233-d6c824d9ae03","resolution":{"observed_at":"2026-08-15T18:34:14.494146Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5143.2017","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:15.061763Z","title":"Research in Science & Technological Education35(2), 238–260 (2017) https://doi.org/10.1080/02635143.2017.1310094","venue":null,"work_id":"4e361867-f8d2-4ff6-9cb1-739b48a9f9da","year":2017},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.255881Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:a618a64912c1da143f2c5a3d0b0eaf3ed0ca8e00751ed331b5d5f86a2463db5d","observation_id":"c195ff7a-f05a-4812-8428-5c900fe937f4","resolution":{"observed_at":"2026-08-15T18:34:15.071778Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.182327Z","title":"American Journal of Physics70(3), 238–251 (2002) https://doi.org/10","venue":null,"work_id":"0933a08c-a38e-4a04-8bea-2082e66bb564","year":2002},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.261394Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:0920fee070fbd9e06a6dd802ff20b8d1dd1f8854ea76c908a85fb396ac1611b5","observation_id":"a97d3564-00e3-4ae1-b979-d0772d046a04","resolution":{"observed_at":"2026-08-15T18:34:16.186830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.267839Z","title":"American Journal of Physics62(8), 750–762 (1994) https://doi.org/10.1119/1.17449","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.267839Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:e06e3cdf555f8a88156c09ed80718b992a07f46e82c6fcaaf5941e69d4e67413","observation_id":"33e7eb70-13f8-4102-ab0d-229b3593b132","resolution":{"observed_at":"2026-08-15T18:34:14.267839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.167186Z","title":"TechTarget SearchEnterpriseAI (2025)","venue":null,"work_id":"7968a29a-a644-4a64-8198-fdbc2abc8a8a","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.273765Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:0378899f9f77b0841b33b7545330d6b32a155b40532f2a795672caab3c09ed70","observation_id":"8fe0160a-cd52-4e10-bcf5-f6950a21aa90","resolution":{"observed_at":"2026-08-15T18:34:16.172224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.15719827","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.452593Z","title":"Dataset on Zenodo (2025)","venue":null,"work_id":"7ebe5253-ab26-4c95-9580-0bfc8a4f571a","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.279565Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:a6b60f03f7851586d061f4bb1e7627a773f23fbf8e0e43e122e6ce139271c5dc","observation_id":"cd9bb1fc-095b-4fa8-a0e4-582978d42518","resolution":{"observed_at":"2026-08-15T18:34:14.459765Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-15T18:34:14.287784Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.287784Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:19386acd223ee7b704f08a64b9b8735ca3810db62fc443fcd64ae93820a42203","observation_id":"b1ba034d-1a75-47d4-921f-031135d6d079","resolution":{"observed_at":"2026-08-15T18:34:14.287784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-15T18:34:14.295141Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.295141Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:ae666698137b3ef16caec37dd2b6ef74c3db402355be7273c35a8d26350d9d3b","observation_id":"70f55e3b-1a20-4988-a458-e7c0472c69a4","resolution":{"observed_at":"2026-08-15T18:34:14.295141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/physrevphyseducres.20.010104","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.401751Z","title":"Physical Review Physics Education Research 20(1), 010104 (2024) https://doi.org/10.1103/PhysRevPhysEducRes.20.010104","venue":null,"work_id":"3718a3af-fd48-4204-b7cf-496e69ac75ba","year":2024},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.302972Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:b215569245ccbbae95eeef2b597e98761cfd7209b1450a6ad4f3c7771cdd25a2","observation_id":"852441a5-4842-4ae9-a99b-603a51d37968","resolution":{"observed_at":"2026-08-15T18:34:14.416687Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/physrevphyseducres.13.020111","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:14.375964Z","title":"Physical Review Physics Education Research 13(2), 020111 (2017) https://doi.org/10.1103/PhysRevPhysEducRes.13.020111","venue":null,"work_id":"ef12d9dc-fdea-4960-bf69-8d15c636bd7b","year":2017},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.309146Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:4573b0f102a336a72d6a6a73cbf104d57db752515f8bc5e626cc854d8b4306fd","observation_id":"14ec92e1-0df4-4807-8d18-5fe6fd74d5c2","resolution":{"observed_at":"2026-08-15T18:34:14.385535Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.150854Z","title":"https://platform.openai.com/docs/guides/reasoning","venue":null,"work_id":"9294f018-da76-4fc9-add3-abcac5e8892e","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.315575Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:dfa18be70f529a5665a5974197c959a1cdb31960a9ccf2a313fbe5cbc868f49c","observation_id":"0bbf5d44-b4a2-4e26-939a-9c25f298a1fb","resolution":{"observed_at":"2026-08-15T18:34:16.156326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:34:16.132907Z","title":"https://platform.openai.com/docs/guides/ reasoning-best-practices","venue":null,"work_id":"81d26a48-3634-4c3d-bcf3-839c28e296d0","year":2025},"citing_paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T18:34:14.322352Z"},"links":{"citing_paper":"/paper/2506.19662"},"observation_digest":"sha256:007bdb9ce405f8a15a15f92b87a3019723312f91a7a37c244348410b722209c4","observation_id":"6af6dad8-6deb-4a20-a2cf-afc6dac43070","resolution":{"observed_at":"2026-08-15T18:34:16.138674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.19662","last_updated":"2025-09-11T14:18:25Z","latest_version":2,"primary_category":"physics.ed-ph","snapshot_observed_at":"2026-08-16T08:41:30.295921Z","submitted_at":"2025-06-24T14:25:04Z","title":"Multimodal large language models and physics visual tasks: comparative analysis of performance and costs"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":6,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":32,"verified_exact":14,"verified_fuzzy":23},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2506.19662."}