{"as_of":"2026-08-21T00:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:128ebde707ffe3cab35d6bb4dd04b8a86d4cada1fceed2f074f9f07044ce68a2","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:15:24.149486Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.01790/citation-record","integrity":"/paper/2505.01790/integrity","json":"/paper/2505.01790/citation-record.json","paper":"/paper/2505.01790"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.861392Z","title":"Computers and Education: Ar tiﬁcial Intelligence 7, 100298 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.861392Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:7770893957402e7863897ef3a88ea2fe65bafe33a37e57f2a424b425a5aac56c","observation_id":"e3f3df19-9ec7-4e89-ab54-283695590d6f","resolution":{"observed_at":"2026-08-16T04:15:23.861392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01390","last_updated":"2023-08-07T17:53:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-02T19:10:23Z","title":"OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01390","snapshot_observed_at":"2026-08-16T04:15:23.867723Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.867723Z"},"links":{"cited_paper":"/paper/2308.01390","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:7e88bb20896d4c54da806398db83d3fc724c0a90edc114e53deceabec34b390c","observation_id":"63c82e4a-e06e-45c8-a639-701fbbf3ad91","resolution":{"observed_at":"2026-08-16T04:15:23.867723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-70242-6_18","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":", Wartena, C.: Question generation capabilities of “small“ large lang uage models","venue":"Lecture notes in computer science","work_id":"b2f2a6b9-3c39-4745-871a-f209e1684d0e","year":2024},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.873957Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:ad48651a723520828a2697616c67c18c88d6ad879864cd3215148cee8d980757","observation_id":"9b05eb4e-0dbc-401f-86f3-2ab486c758e9","resolution":{"observed_at":"2026-08-16T04:15:24.646292Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.879180Z","title":"In: Conference on Computing Communication and Networking Technologies, ICCCNT 2023, Delhi, India, July 6-8, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.879180Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:f04681bce50e8414ec7a2944db82655dde6522c85f0d13fecac325d5afe563c0","observation_id":"8dc216d1-8823-4945-9468-a6e6fe60b7af","resolution":{"observed_at":"2026-08-16T04:15:23.879180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.641749Z","title":"In: Conference on User Modeling, Adaptation and Personalization, UMAP 2024, Cagl iari, Italy, July 1-4,","venue":null,"work_id":"15818e02-54cb-42b8-9ea5-8a848c4b5dc8","year":2024},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.884043Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:eebaae814eabbedb5241f2310519bfba2bfb060b640dabcd6784132cfd0b059f","observation_id":"868f6dcb-7d43-4aff-82e7-004cd474e11e","resolution":{"observed_at":"2026-08-16T04:15:25.646732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.626310Z","title":"O’Reilly Media, In c","venue":null,"work_id":"931545b5-9ab7-4bad-bc5b-455d2ca0c0a9","year":2009},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.893874Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:a34ddbdf7219e037d050e1dc200b0d630e0718dc87a469c9afb0c28f9df09b73","observation_id":"1d2e8cd9-e74f-4674-a052-77dd8677fb08","resolution":{"observed_at":"2026-08-16T04:15:25.630965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.898325Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.898325Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:a39f7f722007bba08095f23afb23d87250636009669fc3a270b75c481393ffd8","observation_id":"f74bd273-5329-44d3-8f1d-2fe003c97a8c","resolution":{"observed_at":"2026-08-16T04:15:23.898325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14735","last_updated":"2025-05-11T09:23:41Z","snapshot_observed_at":"2026-08-18T20:37:49.047473Z","submitted_at":"2023-10-23T09:15:18Z","title":"Unleashing the potential of prompt engineering for large language models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14735","snapshot_observed_at":"2026-08-16T04:15:23.903229Z","title":"arXiv preprint abs/2310.14735 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.903229Z"},"links":{"cited_paper":"/paper/2310.14735","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:7b1764044eaaed615f4f5e781edf00604bdc98847f13efc5f910ff99284ce409","observation_id":"a5a27e75-d2dc-4d93-9981-c503546b56bd","resolution":{"observed_at":"2026-08-16T04:15:23.903229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.907975Z","title":"In: International Confe rence on Web and Social Media, ICWSM 2018, Stanford, (California), USA, June 25-28 , 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.907975Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:c309cfd8b1287c6ab97c5466b40bb64cc897845f43c22606b3b3b94d7b4683e1","observation_id":"adaad955-8566-48a8-8027-51d66c73c057","resolution":{"observed_at":"2026-08-16T04:15:23.907975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.610827Z","title":"I n: Language Resources and Evaluation Conference, LREC 2020, Marseille, France, M ay 11-16, 2020","venue":null,"work_id":"f9ca9325-e163-4ddc-9339-29981480b8bb","year":2020},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.913114Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:503fcf037c493e7277a35d68d8f2df61fa602985512daab66b5b5556b5684684","observation_id":"a0b78471-9637-41d3-b532-7eedd68b234b","resolution":{"observed_at":"2026-08-16T04:15:25.615927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.918470Z","title":"Educ ational Horizons 83(3), 154–159 (2005), http://www.jstor.org/stable/42926529","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.918470Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:10a80bbafa0f21e6070399d08e5ea0d66370cb73b8812de9cc2ed404a4f60f22","observation_id":"b8a9ae60-4457-437e-b00d-ee0a7f586947","resolution":{"observed_at":"2026-08-16T04:15:23.918470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-36336-8_83","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":null,"venue":"Communications in computer and information science","work_id":"80ad0d1e-620a-4621-9203-479b9b898f43","year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.923051Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:d87ce12c7e8d3cdef505c04aad430e486bc1be209301f64665940769ede3fb9e","observation_id":"d2a524b1-69e9-4c89-a686-998db62fcd00","resolution":{"observed_at":"2026-08-16T04:15:24.593797Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.927892Z","title":"Journal of appl ied psychology 32(3), 221 (1948)","venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.927892Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:d0470ca3ead64e6fd2d6454c485bb280929104f0b0a23f959e062c5ef5bd68d7","observation_id":"4533f4a2-e6da-4aa8-97d9-27299db8f6cc","resolution":{"observed_at":"2026-08-16T04:15:23.927892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3991/ijac.v16i1.35207","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.561831Z","title":"International Journal o f Advanced Corporate Learning 16(1), 19–27 (2023)","venue":null,"work_id":"0772c3df-5927-487f-a5cc-d01439a7f3cd","year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.932732Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:16ad11662a5ef4e8ee6eebe86746706f0063605400939dead42dc32f90a45946","observation_id":"c6d320a0-1d6f-4fbc-9aa9-1e5d3e80609d","resolution":{"observed_at":"2026-08-16T04:15:24.567379Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02677","last_updated":"2018-04-30T21:53:41Z","snapshot_observed_at":"2026-08-09T05:23:26.365677Z","submitted_at":"2017-06-08T16:51:53Z","title":"Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02677","snapshot_observed_at":"2026-08-16T04:15:23.937551Z","title":"arXiv preprint abs/1706.02677 (2017), http://arxiv.org/abs/1706.02677","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.937551Z"},"links":{"cited_paper":"/paper/1706.02677","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:6abbc3d252ed095f738734cdb89150399ad0d8578dfc582d9657ecca26017f81","observation_id":"bdaf4fe1-a783-48f7-8ef8-5c4628e9b4af","resolution":{"observed_at":"2026-08-16T04:15:23.937551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7280.32975","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.164065Z","title":"In: ACM/SIGAPP Sym- posium on Applied Computing, SAC 2019, Limassol, Cyprus, Ap ril 8-12, 2019","venue":null,"work_id":"a07f922f-6f14-4f82-9d20-97f7fd6a0ab6","year":2019},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.942393Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:92211aa7cfcd46e7d94756a4fb79c7550d246d43412134a060f671dc27cf3822","observation_id":"a1fd207d-06a9-49eb-965f-3dd9efff3218","resolution":{"observed_at":"2026-08-16T04:15:25.174415Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.947144Z","title":"Scientiﬁc Dat a 10(1), 158 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.947144Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:ab15dd541edcafe731ee771fa147e1c5302271672ac1f61164d055c1a7d6bd4f","observation_id":"fbc13b5e-9486-4a68-a0cc-0885dbaeb7b9","resolution":{"observed_at":"2026-08-16T04:15:23.947144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32487","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.084546Z","title":"IEEE Access 11, 20885– 20896 (2023)","venue":null,"work_id":"4a4cbb51-2b69-4c6e-bb70-b3c1f9bc94fc","year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.951878Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:b7b824623cd44c28b2da6cb7471a1481a0a583b899a3478dddcced978a1b540b","observation_id":"5235225a-8633-43e5-b479-f0b620d055e3","resolution":{"observed_at":"2026-08-16T04:15:25.092829Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.956761Z","title":"In: Artiﬁcial Intelligence in Education, AIED 2024, Recife , Brazil, July 8-12, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.956761Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:3592b4631d20fa720e9dd300d2e94e3e4b3e677907733d3b83a136cfe24a38fc","observation_id":"ed1444af-7aa6-40ff-93ce-0b37d9720488","resolution":{"observed_at":"2026-08-16T04:15:23.956761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-16T04:15:23.961491Z","title":", Wang, T., Lacroix, T., Sayed, W.E.: Mistral 7b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.961491Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:6a4a25ddc3b4632218ac970397804980fe17d30502d283ff805d335350e6497a","observation_id":"7cc26809-51ab-4f14-8f69-c31ed299d267","resolution":{"observed_at":"2026-08-16T04:15:23.961491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.594273Z","title":"In: IEEE Conference on Computer Vis ion and Pattern Recognition, CVPR 2017, Honolulu, (Hawaii), USA, July 21-2 6, 2017","venue":null,"work_id":"c90eea99-539b-4d56-b429-7fc49aad8b32","year":2017},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.966192Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:0e8c3b8f586fbc372f3792276d2330e305ff6ad63becc75f0e0a9c57b199896a","observation_id":"bb163566-c328-4ee7-8cbd-837ee504e51b","resolution":{"observed_at":"2026-08-16T04:15:25.599572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.577570Z","title":"In: Worksh op on Statistical Ma- chine Translation co-locared with the ACL Conference, WMT@ ACL 2007, Prague, Czech Republic, June 23, 2007","venue":null,"work_id":"c19deac2-06d9-40b0-bb72-ee3785608051","year":2007},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.977100Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:99813e7d99b28328757c2dd055f0202aa28e021f836b13e384750b07b3a10680","observation_id":"87c1e9f1-2784-4db4-92cc-8594ea257cdb","resolution":{"observed_at":"2026-08-16T04:15:25.582977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.981662Z","title":"In: Proceedings of the 2018 Conference on Empirical Meth- ods in Natural Language Processing, Brussels, Belgium, Oct ober 31 - Novem- ber 4, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.981662Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:53a5b5dc65a3b44967cca05fb39425cc70c16883eae495597d2301a1654d21e6","observation_id":"6221b65e-18a8-4e91-a259-d34fa6e8a550","resolution":{"observed_at":"2026-08-16T04:15:23.981662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.986694Z","title":"In: Association for Computation al Linguistics, ACL 2020, Virtual Event, July 5-10, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.986694Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:9d455ea4842016a9d7c5dabee521a386d1f06df7e8204abd10b4e7ccc084a4b7","observation_id":"1c9ce369-e86b-4af2-a7dc-730772ed43c4","resolution":{"observed_at":"2026-08-16T04:15:23.986694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-50729-9_40","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":"I n: HCI International Conference, HCII 2020, Copenhagen, Denmark, July 19-24, 20 20","venue":"Communications in computer and information science","work_id":"8f50aafc-3a20-44d1-86f6-aabc6cb35586","year":2020},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.992227Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:62091d76e9766c67401f13cb215bd69679591b4bc0088560d669952a04412ff0","observation_id":"1d3f2296-b83a-4dc4-8676-6527266fba5e","resolution":{"observed_at":"2026-08-16T04:15:24.485221Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.560651Z","title":"In: International Conference on Machine Learning, ICM L 2023, Hon- olulu, (Hawaii), USA, July 23-29 2023","venue":null,"work_id":"f65bb884-7abf-47df-9a52-c52313bf04c6","year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.997122Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:e3a6366fcfe80a3d95669ba3d5e49118c7b6b4f7fa8a95a1dd6d1b9106ef9f69","observation_id":"9874c8d7-e323-4541-ab5a-bda65f577efa","resolution":{"observed_at":"2026-08-16T04:15:25.565861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-16T04:15:24.002262Z","title":", Wang, L., Qiao, Y.: Videochat: Chat-centric video understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.002262Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:ff2dfa688636657818a53536554662a4a9da5a775a93db3a2cfc414309407c4a","observation_id":"bc2cfdbd-cac3-4d34-97e3-27ec0138f499","resolution":{"observed_at":"2026-08-16T04:15:24.002262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05220","last_updated":"2025-01-09T13:13:24Z","snapshot_observed_at":"2026-08-15T11:45:16.481636Z","submitted_at":"2025-01-09T13:13:24Z","title":"A Novel Approach to Scalable and Automatic Topic-Controlled Question Generation in Education","version":1},"cited_work":{"arxiv_id":"2501.05220","doi":"10.48550/arxiv.2501.05220","metadata_source":"pith","pith_arxiv_id":"2501.05220","snapshot_observed_at":"2026-08-16T12:16:17.039197Z","title":"A Novel Approach to Scalable and Automatic Topic-Controlled Question Generation in Education","venue":"cs.CY","work_id":"e7b5b4a2-38f5-4995-9189-a3e72b598991","year":2025},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.007527Z"},"links":{"cited_paper":"/paper/2501.05220","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:aff9d6747fa1bb19f76ceaa8b747412c37d657e2be2338cbe0a5cef60e000b8b","observation_id":"8921010e-97e6-45f5-90e7-7a67a8adfd78","resolution":{"observed_at":"2026-08-16T04:15:24.450054Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-16T04:15:24.013417Z","title":"arXiv preprint abs/2311.10122 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.013417Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:2a750a410d59bc75acb2f1f8f1519fb6f1ef561644b3d9d6e6e8598c3dfb8f22","observation_id":"a263b28a-bdbc-4e71-8158-b0225f184ec1","resolution":{"observed_at":"2026-08-16T04:15:24.013417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.544321Z","title":"In: Association for Computational Linguistics, ACL 2004, Barc elona, Spain, July 21-26, 2004","venue":null,"work_id":"89beab84-757a-4654-9fd1-c41160d47d90","year":2004},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.018752Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:50dce4fea84767b4a2ba7626bb2714b7e23f65d15aba61679bfd648b1ad32bf1","observation_id":"1b3ef0ee-5713-4ea1-90bb-d59e416ba14d","resolution":{"observed_at":"2026-08-16T04:15:25.549030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-08-15T02:35:59.111911Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-16T04:15:24.023195Z","title":"arXiv preprint abs/2310.03744 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.023195Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:831e76e33ef953915e23e8e0b933bc011f325295ecb85305093bbb4cdeb6fdab","observation_id":"be3b2869-bd58-4653-b489-8469f30c5bf7","resolution":{"observed_at":"2026-08-16T04:15:24.023195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.527586Z","title":"In: Advances in Neural Information Processing Systems, NeurIPS 2023, New O rleans, (LA), USA, December 10 - 16, 2023","venue":null,"work_id":"ef0ae8f5-eb31-47e9-b760-a1ac99dfa6a4","year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.028367Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:8d07bc2b4c0ffe53404013958e743d777df3c894dcd6ebb9e9c2a35b3a97e464","observation_id":"51a4bb20-cff4-4b49-b311-6584efe9d203","resolution":{"observed_at":"2026-08-16T04:15:25.532899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07207","last_updated":"2025-03-17T13:51:51Z","snapshot_observed_at":"2026-08-16T15:24:32.944943Z","submitted_at":"2023-06-12T16:11:10Z","title":"Valley: Video Assistant with Large Language model Enhanced abilitY","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07207","snapshot_observed_at":"2026-08-16T04:15:24.032863Z","title":"arXiv preprint abs/2306.07207 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.032863Z"},"links":{"cited_paper":"/paper/2306.07207","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:1f5404164426ac906b7dbd867c222698372236a61c09817f339163a1cb23d03b","observation_id":"e4a58acc-aa56-4f3d-8ace-d31fb1ac8d54","resolution":{"observed_at":"2026-08-16T04:15:24.032863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-16T04:15:24.037868Z","title":"arXiv preprint abs/2306.05424 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.037868Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:cf39cead2c4693b5932564db235b3450ce2d28884b43c9933a407f391ba10066","observation_id":"636f3b18-225d-4334-9682-4c1fbe6b1419","resolution":{"observed_at":"2026-08-16T04:15:24.037868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.043122Z","title":"https://doi.org/10.1016/j.caeai.2025.100370","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.043122Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:e672258d196f40f8953aab5dc8ae46ad3f89033fde0a1ce9928b30c7492e6cb3","observation_id":"810cb79a-8a85-4553-a291-2f647be81c23","resolution":{"observed_at":"2026-08-16T04:15:24.043122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.049016Z","title":"https://doi.org/10.1016/j.compedu.2021.104355","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.049016Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:be928bafce4358bfcebe89bf5d11916f4073454218b9d842d015481e984ce9a7","observation_id":"49f96d43-eb51-4621-897a-7520541c6d10","resolution":{"observed_at":"2026-08-16T04:15:24.049016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.511458Z","title":", de Souza, A.F., Oliveira- Santos, T.: Automatic multiple-choice question generatio n and evaluation sys- tems based on LLM: A study case with university resolutions","venue":null,"work_id":"581d87b1-9a9e-4e98-abb4-3a574524f6f9","year":2025},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.053755Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:0fae37adf963c3e65d59f7ea2d32964803e5dc55b21377fb976bf41babcfe4cc","observation_id":"4e54c934-5642-4f1e-8221-ee4cb0517ee6","resolution":{"observed_at":"2026-08-16T04:15:25.516686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13435","last_updated":"2023-12-13T17:24:10Z","snapshot_observed_at":"2026-08-17T15:43:08.581326Z","submitted_at":"2023-11-22T14:48:30Z","title":"PG-Video-LLaVA: Pixel Grounding Large Video-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13435","snapshot_observed_at":"2026-08-16T04:15:24.058509Z","title":"arXiv preprint abs/2311.13435 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.058509Z"},"links":{"cited_paper":"/paper/2311.13435","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:34fbac55e8ed66edf2e298b4f7375e2b9bc4aeb056f5b22d9d1e2f8f888128e4","observation_id":"cd68b808-f4ea-4ee1-b278-09417ff7ae65","resolution":{"observed_at":"2026-08-16T04:15:24.058509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T04:15:24.063574Z","title":"arXiv preprint abs/2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.063574Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:733fc929847d03c934a7ca95cbd11315f37dc8bfdc618ba4e4e6a62de81bedf7","observation_id":"eb14dcb7-df7e-47ba-98c4-681709bbe48e","resolution":{"observed_at":"2026-08-16T04:15:24.063574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10639-018-9804-5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-19T11:03:45.297681Z","title":"Education and Information Technologies 24(1), 805–823 (2019)","venue":"Education and Information Technologies","work_id":"caa5544f-a703-4d81-81d9-59f8d0970b97","year":2019},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.068993Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:fc46e05b5e38c92d9d85e06164f029d8849cfc4fb2cf2370d2c7b828b656e811","observation_id":"6da932a9-3d70-4870-93e1-99b37f1af481","resolution":{"observed_at":"2026-08-16T04:15:24.321964Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.074686Z","title":"In: Association for Com putational Linguistics, ACL 2002, Philadelphia, (PA), USA, July 6-12, 2002","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.074686Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:ae532706ac0213c95dcdbb32afa695801db1521e3363e3f40c02423e0aa31f2d","observation_id":"91a2134e-a221-4604-9bbd-c2e7871dd11b","resolution":{"observed_at":"2026-08-16T04:15:24.074686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.080211Z","title":"In: Conference on E mpirical Methods in Natural Language Processing, EMNLP 2016, Austin , Texas, USA","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.080211Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:fbc1905ba89dea2950dbc7e888545c32bf364923007de77aa84e33143bf92302","observation_id":"71cce2fe-d5cf-49e6-94b1-14641afa730d","resolution":{"observed_at":"2026-08-16T04:15:24.080211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.085459Z","title":"In: Conference on Empirical Methods in Natural La nguage Processing, EMNLP 2019, Hong Kong, China, November 3-7, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.085459Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:0baee7b9f7494d180b45f1f61c49503fa3395db80c4d66969f80f632491e86d1","observation_id":"ff396e65-016f-4d89-a2b5-b6b4af99c348","resolution":{"observed_at":"2026-08-16T04:15:24.085459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.090213Z","title":"ACM Computing Surveys 55(2), 26:1–26:39 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.090213Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:a76469662388cfcabcf4773689070348e2c7ea74b1428630a9d4e0b469290703","observation_id":"13f0d652-4e9b-41e8-b03c-d9069f3d9bbd","resolution":{"observed_at":"2026-08-16T04:15:24.090213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-64299-9_12","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":"In: Artiﬁcial Intelligenc e in Education, Using VLMs to Generate Questions for Educational Videos 17 AIED 2024, Recife, Brazil, July 8-12, 2024","venue":"Lecture notes in computer science","work_id":"81ff060c-c075-4f27-9c28-687f84d0b501","year":2024},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.094848Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:8775147610c6a3c817225326c4c7c9571c08ce706a9c6321fb13f33b2ac9a347","observation_id":"4a5e03e0-2a09-40c5-a8dd-8d764fb66fd5","resolution":{"observed_at":"2026-08-16T04:15:24.275682Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10462-024-10895-z","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-19T11:03:45.297681Z","title":"Artiﬁcial Intel ligence Review 57(10), 271 (2024)","venue":"Artificial Intelligence Review","work_id":"22aacbdd-e01c-43b4-9e3b-0acaaed1b9c1","year":2024},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.100177Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:3a89bcd22f894d2d04445e98f02b4a15944ca6bbb8143b46278a6be9277ce74d","observation_id":"f29f2ad3-3a0a-4d3b-920a-75df25109fc5","resolution":{"observed_at":"2026-08-16T04:15:24.258502Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-36272-9_1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":"In: Ar tiﬁcial Intelligence in Ed- ucation, AIED 2023, Tokyo, Japan, July 3-7, 2023, Proceedin gs","venue":"Lecture notes in computer science","work_id":"fae26ae3-8db4-44e0-bc36-4e7ddb86a75a","year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.105007Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:400f4d2d6d922bb90c652bf3be8f14dad7c173d2370b6b87d8de23bb7fc2c554","observation_id":"8a40fd5f-395e-4a02-bae9-0fb5d694d212","resolution":{"observed_at":"2026-08-16T04:15:24.241956Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.109403Z","title":"In: Annual Confere nce on Infor- mation Technology Education, SIGITE 2017, New York, USA, Oc tober 4 - 7, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.109403Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:f59e291ebfe9418915233f44100a9ecb3ccc3193111334d46c02d42048d7aa1d","observation_id":"7c0e8292-8bbe-4899-8e87-c85281351f7c","resolution":{"observed_at":"2026-08-16T04:15:24.109403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-63467-4_16","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":": Automatic question- naire and interactive session generation from videos","venue":"IFIP advances in information and communication technology","work_id":"388f0e67-c8f7-4969-8c85-5327395a6c99","year":2020},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.114766Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:7079b647120c29d45a3dc96641184c2572b64a55beee267e50887be335c0db7b","observation_id":"20be832d-db44-4b11-ae9c-37f6693ed93d","resolution":{"observed_at":"2026-08-16T04:15:24.224356Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.495863Z","title":"In: ACM on Multimedia Conference, MM 2017, Mountain View, (CA), USA , October 23-27,","venue":null,"work_id":"1a7968ca-503a-47bc-9f83-2c7fcbd56bb0","year":2017},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.119897Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:945e9c70964654cb1815fb60b07934c7c1f687f78c7598f27ea0888c0231af6a","observation_id":"d6bed48f-d654-4c26-9bcb-65564087fa95","resolution":{"observed_at":"2026-08-16T04:15:25.500848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.129526Z","title":"In: Màrquez, L., Callison-Burch, C., Su, J., Pig hin, D., Marton, Y","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.129526Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:e714a97dfcc4c362bacbb3e85ea58aae8210262d562dfaad30fb749e06d7cf73","observation_id":"3ba8ea4d-63a9-429b-bbc1-441b35474a1f","resolution":{"observed_at":"2026-08-16T04:15:24.129526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13191","last_updated":"2025-02-10T05:52:10Z","snapshot_observed_at":"2026-08-16T13:08:34.768133Z","submitted_at":"2024-10-17T03:38:29Z","title":"MCQG-SRefine: Multiple Choice Question Generation and Evaluation with Iterative Self-Critique, Correction, and Comparison Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13191","snapshot_observed_at":"2026-08-16T04:15:24.135060Z","title":"arXiv prep rint abs/2410.13191 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.135060Z"},"links":{"cited_paper":"/paper/2410.13191","citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:f9208ec1d56ed4c647db015c97e4c8a0a066921297384520a536a4c05c18acc6","observation_id":"b79fb153-4af3-4d0f-8b4e-beb0a357e569","resolution":{"observed_at":"2026-08-16T04:15:24.135060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.140034Z","title":": Activitynet-qa: A dataset for understanding complex web videos via question answering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.140034Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:247518efbe7b3e13720f1c9e6c8d3a26fad89176689569f52793d4ed4a9b9e1c","observation_id":"6cd960a3-b2f8-436a-bed0-a3743bfbc9b6","resolution":{"observed_at":"2026-08-16T04:15:24.140034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.144923Z","title":"In: Conference on Empi rical Methods in Nat- ural Language Processing - System Demonstrations, EMNLP 20 23, Singapore, De- cember 6-10, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.144923Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:566dd700d037c67f1f2717e9a43a9f1be085d6bdf7c2ee9be442b8e8693d5edb","observation_id":"9cc52874-4fc6-46a6-976f-bdcb6a9d1e62","resolution":{"observed_at":"2026-08-16T04:15:24.144923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:25.469009Z","title":"In: International Conference on Learning Represen- tations, ICLR 2020, Addis Ababa, Ethiopia, April 26-30, 202 0","venue":null,"work_id":"fe8305ce-de6f-4fcb-9d5a-762f714b927f","year":2020},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.149486Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:f2b61e501a3c28c2b062a135cc90478af6fa10ed695da205713c398aff0a4ecf","observation_id":"9fc174ac-24db-4425-bd63-a1c608f5e5ab","resolution":{"observed_at":"2026-08-16T04:15:25.474580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:24.124780Z","title":"1645–1653","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:24.124780Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:b1da2b4a0bb0cba066cc4c2494ea0a90bd0dba03d29211d49d2b70a90baa56c6","observation_id":"c453569c-ccf4-4c92-a1b2-0766dff87d9a","resolution":{"observed_at":"2026-08-16T04:15:24.124780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.888781Z","title":"https://doi.org/10.1145/3631700.3665233","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.888781Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:27939f85eefd782ef0656e353e87239bf1674709e1e79209f20ca707179f456b","observation_id":"09f58eaa-87be-4097-a607-41f5f388cc7e","resolution":{"observed_at":"2026-08-16T04:15:23.888781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:15:23.971259Z","title":"https://doi.org/10.1109/CVPR.2017.571","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos","version":1},"reference_index":5384,"source":"pdf_text","source_observed_at":"2026-08-16T04:15:23.971259Z"},"links":{"citing_paper":"/paper/2505.01790"},"observation_digest":"sha256:73b660457699fc8f8e2a97f54148728903f0a6fc155268ab52e783f3b40b83e3","observation_id":"d4946c59-9f71-433b-9bbb-d6e8de624bda","resolution":{"observed_at":"2026-08-16T04:15:23.971259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.01790","last_updated":"2025-05-03T11:37:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T20:42:22.242317Z","submitted_at":"2025-05-03T11:37:31Z","title":"Enhancing the Learning Experience: Using Vision-Language Models to Generate Questions for Educational Videos"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":35,"verified_exact":9,"verified_fuzzy":11},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2505.01790."}