{"as_of":"2026-08-14T13:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a42c847d06aaf20896127ab973f6d1d2d6b761d64c7ff8cf62a1a0b345d5b03","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:11:08.139563Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T07:01:26.911110Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T07:05:28.650553Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2412.15739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.15739","snapshot_observed_at":"2026-07-01T07:05:28.650553Z","title":"V ord: Visual ordinal calibration for mitigating object hallucina- tions in large vision-language models","venue":null,"work_id":"f9ceab76-ee16-4c29-9c54-0d844040d098","year":2024},"citing_paper":{"arxiv_id":"2605.11559","last_updated":"2026-05-12T05:42:11Z","snapshot_observed_at":"2026-08-12T19:30:23.881578Z","submitted_at":"2026-05-12T05:42:11Z","title":"When Looking Is Not Enough: Visual Attention Structure Reveals Hallucination in MLLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T01:55:07.172228Z"},"links":{"cited_paper":"/paper/2412.15739","citing_paper":"/paper/2605.11559"},"observation_digest":"sha256:adfdcd1e0ffd78f579010e881670e82a6e8b500292c0f54a257daea5f6895eea","observation_id":"09f18509-1557-4199-8b5d-7d55abb7b0bd","resolution":{"observed_at":"2026-05-13T01:57:05.219770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2412.15739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.15739","snapshot_observed_at":"2026-07-01T07:05:28.650553Z","title":"V ord: Visual ordinal calibration for mitigating object hallucina- tions in large vision-language models","venue":null,"work_id":"f9ceab76-ee16-4c29-9c54-0d844040d098","year":2024},"citing_paper":{"arxiv_id":"2606.29805","last_updated":"2026-06-30T14:53:46Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T05:33:22Z","title":"Clearer Sight, Fewer Lies: Oriented Pickup Preference Optimization for Multimodal Hallucination Mitigation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-30T06:13:11.013395Z"},"links":{"cited_paper":"/paper/2412.15739","citing_paper":"/paper/2606.29805"},"observation_digest":"sha256:cab148035e67bb80c8e15c374841bf3bea21132ebef2f44735c2cc9eedbe1ae1","observation_id":"dd68306d-7301-41a3-a1eb-b4d74a1252be","resolution":{"observed_at":"2026-06-30T06:14:18.714212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2412.15739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.15739","snapshot_observed_at":"2026-07-01T07:05:28.650553Z","title":"V ord: Visual ordinal calibration for mitigating object hallucina- tions in large vision-language models","venue":null,"work_id":"f9ceab76-ee16-4c29-9c54-0d844040d098","year":2024},"citing_paper":{"arxiv_id":"2606.29805","last_updated":"2026-06-30T14:53:46Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T05:33:22Z","title":"Clearer Sight, Fewer Lies: Oriented Pickup Preference Optimization for Multimodal Hallucination Mitigation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-01T07:01:26.911110Z"},"links":{"cited_paper":"/paper/2412.15739","citing_paper":"/paper/2606.29805"},"observation_digest":"sha256:5995022861d695e426b033e8199fc6d91dc397573f021020c38a1b0915889bc5","observation_id":"e30a4de1-ce8b-4b71-b725-ab52c795d6a1","resolution":{"observed_at":"2026-07-01T07:05:28.652874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.15739/citation-record","integrity":"/paper/2412.15739/integrity","json":"/paper/2412.15739/citation-record.json","paper":"/paper/2412.15739"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:10.353585Z","title":"Towards causal vqa: Revealing and reducing spurious correlations by invariant and covariant semantic editing","venue":null,"work_id":"db83761b-4d3e-4bc2-ae94-7c2e30f3bf8a","year":2020},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.712435Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:d3c708c398cb3353e519b9335a0f2294c44999faa658fae6df13beb74de296bc","observation_id":"ebb77e48-b1c8-4bdf-8d58-0f8a340e7293","resolution":{"observed_at":"2026-08-11T11:11:10.363417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:10.314680Z","title":"Ana- lyzing the behavior of visual question answering models","venue":null,"work_id":"bb894806-e160-4360-afc4-b5f097ff48d3","year":2016},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.718351Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:adbd87c5ed90eeec40bf3f3e6e9158277eb72262384364c5b3f83537cdaf3035","observation_id":"6aad96c8-eac1-46d4-a913-54077f4149e2","resolution":{"observed_at":"2026-08-11T11:11:10.323150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12718","last_updated":"2025-03-14T04:38:44Z","snapshot_observed_at":"2026-08-12T23:39:58.417549Z","submitted_at":"2024-06-18T15:38:41Z","title":"Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12718","snapshot_observed_at":"2026-08-11T11:11:07.723954Z","title":"Agla: Mitigating object hallucinations in large vision- language models with assembly of global and local attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.723954Z"},"links":{"cited_paper":"/paper/2406.12718","citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:6ac9ab01361b8b7c3b95f28d2b2138cd26fd3aa2106cc45aec4c1e8d3b740c43","observation_id":"f7be4629-ad21-4184-a729-9bd028877d85","resolution":{"observed_at":"2026-08-11T11:11:07.723954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:10.282295Z","title":"Let there be a clock on the beach: Reducing object hal- lucination in image captioning","venue":null,"work_id":"1fe2106a-0bc0-4bd5-90ff-d21d71219c3a","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.730250Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:902eaca9bb6e62aecf6ff5304ed3536c3ee9a857403d6e32e2bce6b2d73a0aa7","observation_id":"539021ef-eb17-49a1-aed1-812cc1d3cef0","resolution":{"observed_at":"2026-08-11T11:11:10.290787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:07.735730Z","title":"Driving with llms: Fusing object-level vec- tor modality for explainable autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.735730Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:d613df4cc54788f93d969e50a29a609370b39177aee39aeabbbf67662fbdb001","observation_id":"b6d3a629-b492-448c-8b0a-953627c2594f","resolution":{"observed_at":"2026-08-11T11:11:07.735730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:10.202679Z","title":"HALC: Object hallucination reduc- tion via adaptive focal-contrast decoding","venue":null,"work_id":"eff06279-c7a5-4932-9552-ae6e8569cf28","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.741294Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:874b60fa2659d8ae5a3e24ee68dc46e26dbe73b832ec3322be05271b9edb1475","observation_id":"f4338983-47d4-4b6e-a6fb-daee00b338c4","resolution":{"observed_at":"2026-08-11T11:11:10.210391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:10.135696Z","title":"Calibrating deep neural networks by pairwise constraints","venue":null,"work_id":"85e94a69-d8f5-47aa-a72a-a7cf7cd07084","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.747344Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:c960facef82d3705f37f275fc3f2e89d8d94fb846acab2e7b5d707ed80844fe8","observation_id":"672774d1-60c0-4f33-a48f-57eb30618c2b","resolution":{"observed_at":"2026-08-11T11:11:10.163607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:10.093851Z","title":"InstructBLIP: Towards general-purpose vision-language models with instruction tuning","venue":null,"work_id":"59f127c4-f110-409f-b771-332846422b3f","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.752334Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:2d734a3c31fd2eb6d973328f8b996e8d805c979c726a36f30e40b0f026917d5f","observation_id":"54645598-86ac-489e-b2a8-6e0ab3e5b49d","resolution":{"observed_at":"2026-08-11T11:11:10.108183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:07.757770Z","title":"BERT: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.757770Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:c12442319be434c05fa4c2c3b9076e8c856d87a2ee2cbc84b473070d39f60fd4","observation_id":"97241392-75ea-4984-adbe-d511f9f5518d","resolution":{"observed_at":"2026-08-11T11:11:07.757770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:10.017132Z","title":"Hierarchi- cal neural story generation","venue":null,"work_id":"b5b71efc-5d05-472f-b84e-830c56dd7849","year":2018},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.764321Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:2235ae9281e927f59d9d059f93cb6257fda9338654de1cd732e534bfe1920845","observation_id":"d3bb68f2-b601-4274-92bd-87c7de16bbce","resolution":{"observed_at":"2026-08-11T11:11:10.027589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.972586Z","title":"Multi-modal hal- lucination control by visual information grounding","venue":null,"work_id":"3b9c0ab2-bbe7-44e5-8b34-d1d216bdd0ef","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.769497Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:6165cda0c9adfa560b0960f41d3d4efc68d820e74f572cdb56305beb66a36bab","observation_id":"e3267257-ec4d-460f-b9a0-a1aa71fe640c","resolution":{"observed_at":"2026-08-11T11:11:09.986738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.933552Z","title":"Beam search strate- gies for neural machine translation","venue":null,"work_id":"ab977c9c-31d8-4961-8f5d-6cbff74395a0","year":2017},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.774820Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:1b7be94dee11f8ba6f05f21c319117dafa02a3cd6af97c8dcfd60162e107b293","observation_id":"c03d125c-9347-41e2-8388-7c7e833daa14","resolution":{"observed_at":"2026-08-11T11:11:09.947362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.903428Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning","venue":null,"work_id":"e95fb519-4cfa-4b2f-8264-baedece64567","year":2016},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.779868Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:75f82afb38ef38499bf8c70c92a569e3e4d3ddfb1f7997da4f2fd6bd626b30e2","observation_id":"f880773e-2f72-4f8f-b58b-5fb6b4805919","resolution":{"observed_at":"2026-08-11T11:11:09.911384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.868844Z","title":null,"venue":null,"work_id":"f0fceeb2-49ed-447b-8185-d883e678633c","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.785308Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:86b65678e09419f831495136785e95355f196668521e8eb6b31a1151a057ea80","observation_id":"b1a6d5ca-d683-48db-b613-516245401880","resolution":{"observed_at":"2026-08-11T11:11:09.878066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.836089Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answer- ing","venue":null,"work_id":"8f3b2855-f5e9-4fb9-82f8-73044523285a","year":2017},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.790299Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:870c798475d1d8ec21afe090e4b2b14e2d77f9d5a5e5bbfa2958935004e79773","observation_id":"609ae471-7289-49a3-ab32-d061b2b9664e","resolution":{"observed_at":"2026-08-11T11:11:09.847698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.808011Z","title":"A stitch in time saves nine: A train-time reg- ularizing loss for improved neural network calibration","venue":null,"work_id":"efe593e4-2350-4356-a18f-9c708c876f99","year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.795089Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:28886c7a02eb17161616dc9a101f5b31224b10f12b1accc45e549fd5a7e65b19","observation_id":"658844fd-01d5-48d8-b78e-44791884a41b","resolution":{"observed_at":"2026-08-11T11:11:09.814830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.782337Z","title":"Dietterich","venue":null,"work_id":"79b106f5-6924-48e7-b7b2-4e297d66f77e","year":2019},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.800205Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:f4ca03c6ac45f4d9c797d9b5235d6cfa10cf2e0c4376eb34465380e1c63d459e","observation_id":"333a836a-a9ee-4b5d-bc52-f76a277169c0","resolution":{"observed_at":"2026-08-11T11:11:09.788342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.759240Z","title":"The curious case of neural text degeneration","venue":null,"work_id":"e3c8884a-a44f-4cf3-9224-e855a06870bf","year":2020},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.805461Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:908312dd3fcb710e921a09581d06596cab42cd0287bd8e89facc72b1f682c006","observation_id":"a3d03307-985d-46f8-b94e-79095a0c0685","resolution":{"observed_at":"2026-08-11T11:11:09.766631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.736507Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"44bbeca3-d260-4c3f-9e3f-e68238483815","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.810209Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:81423c549555bba25d7279612f25c9c367b6b136172b8aa4912984010a6c54cd","observation_id":"c06a1860-6c5e-41e0-ab06-0554b16b3643","resolution":{"observed_at":"2026-08-11T11:11:09.744758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.711873Z","title":"Scaling up vision-language pre-training for image captioning","venue":null,"work_id":"ebfc79cf-cb2b-45bc-84c9-6371c849bf3c","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.815921Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:07d09610d2e58bbcafee18951159da157b3d1063675e56ffcc121b075392cbdf","observation_id":"7e679aa3-6826-44bc-a811-47a84896216c","resolution":{"observed_at":"2026-08-11T11:11:09.721759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.679012Z","title":"Movienet: A holistic dataset for movie un- derstanding","venue":null,"work_id":"c239b6ec-33fc-4f59-824d-182db4bdc1ac","year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.820625Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:13d35c0f705593172f2434146e15976ed354ab92b188b670a9f5484dae5a8d5f","observation_id":"23cf6aba-1040-401d-b3c3-a81e3bd20826","resolution":{"observed_at":"2026-08-11T11:11:09.691832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.653685Z","title":"Opera: Alleviating hallucination in multi- modal large language models via over-trust penalty and retrospection-allocation","venue":null,"work_id":"700a7603-a7f3-4d64-a486-11c0c97757c3","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.825344Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:2e684bdf5a94d6b0778e3d5bdcbcc929fdf66228d94f2db8dda793d9d61f637b","observation_id":"705887a7-ff24-4a7d-8008-d1c2d7e7c526","resolution":{"observed_at":"2026-08-11T11:11:09.661551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.629293Z","title":"Hudson and Christopher D","venue":null,"work_id":"1ff8909e-d4a7-447a-8343-17d03630ad73","year":2019},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.830713Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:761cc502c9b12e776e34484f2b0b0cc9f142a7084861b4cc5b1860101e134a78","observation_id":"971ec0f5-117d-476d-b9d5-3a83f164397c","resolution":{"observed_at":"2026-08-11T11:11:09.637540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.598602Z","title":"Langsuit-e: Controlling, planning, and interacting with large language models in embodied text environments","venue":null,"work_id":"3ad55eee-f314-4bf6-936d-0b6dff211cb0","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.835699Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:34985e70e33895f05e82b6c1fa375ee77586bc972a18bdbdbcb553241f02e627","observation_id":"2b69a640-b761-4fa8-877e-a63e9d2e7e0f","resolution":{"observed_at":"2026-08-11T11:11:09.607019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.576474Z","title":null,"venue":null,"work_id":"74478e9e-752f-415f-b74b-1dadfc2c0cfb","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.840635Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:3ff9d7e84b51269c30f65622766839adccfecc0bd0853e8dd9c7236962fffc89","observation_id":"c5b36c9c-e778-477c-8040-ed6a5a301dc4","resolution":{"observed_at":"2026-08-11T11:11:09.583423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.549631Z","title":"Mitigating object hallucinations in large vision-language models through vi- sual contrastive decoding","venue":null,"work_id":"096ae99b-d252-49be-8833-00da870fac73","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.845747Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:0223ffc4c80d7d156829d2aebf83f6ca07db5f7db7ac8b0a72d19cb0e0ade741","observation_id":"cb88ebb6-abbc-4ebf-affd-9067ffa52af3","resolution":{"observed_at":"2026-08-11T11:11:09.560764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.518219Z","title":"BLIP: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"2fdb04f9-5b86-4209-a588-9c0edc7a5c24","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.850975Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:68b4c1155221c02592bcd9bd01765169ea41564be8c9b4dc8f1d043dbbd11e55","observation_id":"ba85f022-d422-4d20-8d55-902af48dda7e","resolution":{"observed_at":"2026-08-11T11:11:09.527141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.496366Z","title":"What does BERT with vision look at? In Proceedings of the 58th Annual Meeting of the Associa- tion for Computational Linguistics , pages 5265–5275, On- line, 2020","venue":null,"work_id":"75efd787-3de2-4d47-927b-d66aedc7d71a","year":2020},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.856692Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:5117bebe394b3d95cf8b1d5243dfab8f8339ffc460a0a8f80062349860e258ba","observation_id":"7309d8c7-cf7e-46d9-811b-9b561c4fd1e1","resolution":{"observed_at":"2026-08-11T11:11:09.503513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:07.861988Z","title":"Contrastive decoding: Open-ended text genera- tion as optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.861988Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:1a484fb186d927a1aebdb8e38796b5000fedfb9c544f9e84b331e5d1fa86be60","observation_id":"f99d7e55-d229-43e1-911a-3a289d42dca0","resolution":{"observed_at":"2026-08-11T11:11:07.861988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.423281Z","title":"Evaluating object hallucination in large vision- language models","venue":null,"work_id":"0cfae402-83da-4c44-aec5-9e54543c22bb","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.873320Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:f537dca048cef0d77aa46a19af38b45d0c278ef463c6842268dbfabe4c569049","observation_id":"2b1c6395-cdc0-4a9a-acba-c3f0975498b2","resolution":{"observed_at":"2026-08-11T11:11:09.433113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.388068Z","title":"Vila: On pre-training for visual language models","venue":null,"work_id":"ebacee56-406f-451d-8d6d-9148a46f2165","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.879348Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:23098d0839a240414b9e28aa4c6e933d43df914c15881cd2c50c1a1e91eb2384","observation_id":"ba1a1f16-7fbc-47f0-851d-5328e0b9da1b","resolution":{"observed_at":"2026-08-11T11:11:09.396878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.359377Z","title":"TruthfulQA: Measuring how models mimic human falsehoods","venue":null,"work_id":"4fdc3c4d-6c03-4144-80b8-afe4a7425269","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.884146Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:ba9e348ed9d081b66c6858c127ceab368095a30b979aee299941803d12b32112","observation_id":"2bc032a3-689d-44e3-bcce-80e05d005beb","resolution":{"observed_at":"2026-08-11T11:11:09.367167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:07.888882Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Doll ´ar, and C","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.888882Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:c702487bca7dc2409b0a51720dcc5f6e7327d33ecd738a9a62d07c68268613ab","observation_id":"1f3af1d4-27b3-467c-a274-2c0fc9264c94","resolution":{"observed_at":"2026-08-11T11:11:07.888882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.308624Z","title":"The devil is in the margin: Margin-based label smooth- ing for network calibration","venue":null,"work_id":"78aceff8-b97f-457c-ae45-c3c8bda199d4","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.894742Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:5d4cf17a2299bf8d0f54aef77cebd7fdda3041a902a2803abe99c27c2e3828bb","observation_id":"0a78a864-b362-45c6-9d35-5f88d0ec64f1","resolution":{"observed_at":"2026-08-11T11:11:09.317232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.283577Z","title":"Class adaptive network calibration","venue":null,"work_id":"5cb9a304-ee40-4e04-b59d-8e97dd74b28f","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.900573Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:8395016be8dac8a748f29871b74d14151a1830ad998f11f7604411f801457cef","observation_id":"f79cc1a1-ff8e-4503-80fe-fe98df0d4c8e","resolution":{"observed_at":"2026-08-11T11:11:09.290314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.258699Z","title":"Visual instruction tuning","venue":null,"work_id":"878e6994-15e7-4eae-8ae4-49c9fa12a01a","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.905667Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:64fcb640dee49ca1c11996abb3cc310552998f89c27b5e5daa38a56bb18dcf59","observation_id":"f8b9d1a1-ce88-4ecd-be43-9952910c5961","resolution":{"observed_at":"2026-08-11T11:11:09.270709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.237186Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"b447a9b8-ee2f-4bdc-a28d-fa4dfa3d6054","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.910927Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:12ebd202e989cbd9c00ee1c4d0735e0868c42262c274a578a2b3aa4217451c64","observation_id":"714ce5e3-456c-4593-8879-9bdf45daa5e8","resolution":{"observed_at":"2026-08-11T11:11:09.244426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.213157Z","title":"SimCLS: A simple framework for contrastive learning of abstractive summarization","venue":null,"work_id":"9a3f56b3-9d28-4675-b6e8-7ff8eaec8813","year":2021},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.916323Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:fb51fbbedc8e90e73577f8c5a22ee2996e90dfa5147c74e17f6ff52868c91f7e","observation_id":"c2b43492-b656-45b2-b0ce-bdc39072c360","resolution":{"observed_at":"2026-08-11T11:11:09.219766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.193862Z","title":"Curved scene text detection via transverse and longitudinal sequence connection","venue":null,"work_id":"6f05b7f6-0737-4d72-a627-7cfda2a69bc7","year":2019},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.921063Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:27a35134b8219e7024fbd15b8560c8e4093c453f08a80670d472e38fb6f2e68e","observation_id":"60410cb9-d557-43f1-bc5f-cdba375ca7eb","resolution":{"observed_at":"2026-08-11T11:11:09.199645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:07.926039Z","title":"Roberta: A robustly optimized bert pretraining approach, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.926039Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:7979e26bb1f75f67c81b997ac68dac1005605e0deeeb4d1131626b5121d87da6","observation_id":"09748774-bb09-455e-962e-86911e6e7795","resolution":{"observed_at":"2026-08-11T11:11:07.926039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.141938Z","title":"BRIO: Bringing order to abstractive summarization","venue":null,"work_id":"d77026e7-d29b-4ed1-85a0-650502ca4acb","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.931516Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:3f4d224d8b708b3b348a0fa5a8a647b1f272f6ee213f46cd1df6356313281f8f","observation_id":"1ddf0a41-b58f-4a2b-896c-1b4a8bb51bac","resolution":{"observed_at":"2026-08-11T11:11:09.148228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.116219Z","title":"Soft augmentation for image classifica- tion","venue":null,"work_id":"1e5eb307-e32d-426f-8923-762f4254c631","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.938412Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:0693d69801af4faf43a86b1061005b3ade94e00d87ccd2b12e0bb881d176fc02","observation_id":"81089e8f-a327-44ce-ac56-d75c4a64193d","resolution":{"observed_at":"2026-08-11T11:11:09.123636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.089560Z","title":"Dolphins: Multimodal language model for driving, 2023","venue":null,"work_id":"28c6e4ca-2eb3-40e9-9709-59c98cd4e7f8","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.944156Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:0a80f59be0e2113561be104696847b7c839fffa43faf6d4cc34536549986de04","observation_id":"f40dd33e-b200-4b10-9eb4-628a6068c6a5","resolution":{"observed_at":"2026-08-11T11:11:09.097746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.050112Z","title":"Deepart: Learn- ing joint representations of visual arts","venue":null,"work_id":"6eea66b4-70c5-4393-a24c-75cd9f14ac60","year":2017},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.949889Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:96cf0d5fa0481935d3d065aef4c90af0397e9d95f0a98620b4d8668c9689fa56","observation_id":"fc8673e6-ba68-47d4-8b65-4f47f1061b55","resolution":{"observed_at":"2026-08-11T11:11:09.064809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:09.018092Z","title":"Revisiting the calibration of modern neu- ral networks","venue":null,"work_id":"97a5e90c-6bda-4164-86b5-7eea49297bd4","year":2021},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.956423Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:708da62d703755825e4a0c1efe94f417e4e811c9267a5ff3f6c632b1790f5173","observation_id":"ac5a4295-2328-4c94-84c7-c94c5be2e1c3","resolution":{"observed_at":"2026-08-11T11:11:09.027688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.992558Z","title":"Confidence-aware learning for deep neural net- works","venue":null,"work_id":"7fa44206-9d71-4e36-be4e-a068edf56f43","year":2020},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.961753Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:de1ee865ae39b8706268298b0ef687cec8196bdc2175f949ca58537c3a2bdeaf","observation_id":"e258021e-9f12-489e-9bc3-5a2b6284f7a9","resolution":{"observed_at":"2026-08-11T11:11:08.998295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.965899Z","title":"When does label smoothing help? In Advances in Neu- ral Information Processing Systems","venue":null,"work_id":"738f89e0-2a59-4b8e-8197-8066e6dd4ee2","year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.967439Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:cbff4520a7f3905a90b8ed2e4099e334718e1bb788916c743908744c526413b1","observation_id":"515e2a05-b04c-410e-a5f1-6b9af90b4501","resolution":{"observed_at":"2026-08-11T11:11:08.974344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.934316Z","title":"Cooper, and Milos Hauskrecht","venue":null,"work_id":"c1834884-0b9e-477c-aa24-0c94bb68ab4c","year":2015},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.973010Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:541a80d23a84b17e67edfc7d71991bee7049f464dac1a829509a9549f1e8b4c2","observation_id":"c31ccbc7-2cf3-44b0-aa9e-922d22d009db","resolution":{"observed_at":"2026-08-11T11:11:08.940570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.915815Z","title":"Rankmixup: Ranking-based mixup training for net- work calibration","venue":null,"work_id":"dc3f3a31-40da-489d-b800-6e76e6c0ec62","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.977755Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:7c2c2c7f3f387c4eda3c931d4e7eaf7507323a1fb50252e59f7b24c3bab6f87a","observation_id":"9e1cd706-5266-4032-a811-03750bb6d645","resolution":{"observed_at":"2026-08-11T11:11:08.921206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.894721Z","title":"Gpt-4 technical report","venue":null,"work_id":"05ce697b-b7c1-43b3-a12f-112e6f393e24","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.982428Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:858158fc3b41a7714fc60d438f4e5dc0d28f2bbfed35ecfafb8fbe601c9823d0","observation_id":"a13db97e-dd97-40a1-8f26-20601727d037","resolution":{"observed_at":"2026-08-11T11:11:08.902280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:07.987568Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.987568Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:2f816954038d0e6f71aad01e2b61383d494f5a51e11eb2d9a918da6d9190431c","observation_id":"e15b0d9a-80c7-46e7-b733-ef28d27e9e86","resolution":{"observed_at":"2026-08-11T11:11:07.987568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.846433Z","title":"SummaR- eranker: A multi-task mixture-of-experts re-ranking frame- work for abstractive summarization","venue":null,"work_id":"7275cab5-bb27-4030-bb85-3bf57eee0d11","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.994592Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:aa36ff333952ea4ff235687c1fece156711ffa5cc7d6f488bf62a9367f3d37c3","observation_id":"3acdf735-75e1-45fb-a14a-268ef5cf5704","resolution":{"observed_at":"2026-08-11T11:11:08.858585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.827443Z","title":"Distributionally robust ensemble of lottery tickets towards calibrated sparse network training","venue":null,"work_id":"ff24e0d3-a715-4cab-baa7-11a5c6f81fd5","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.999714Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:2ce3bff8c6268f6f477ebb96ba47b7f97f85bcdeff6aa583c9078edc2996856b","observation_id":"f4b95d91-835a-4f64-be5a-a9bdcc367364","resolution":{"observed_at":"2026-08-11T11:11:08.832857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.810271Z","title":"A-okvqa: A benchmark for visual question answering using world knowl- edge","venue":null,"work_id":"e857eaa5-c537-4e10-bc8b-256ac10ccc41","year":2022},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.007274Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:4b81a9a85809271dba0a0b2c370cf5c982afcc1794b5ee3a71783a3311d24a2d","observation_id":"2bbe0bbc-6227-4a58-8a7c-378ea6abb84a","resolution":{"observed_at":"2026-08-11T11:11:08.816080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.791966Z","title":"REPLUG: Retrieval-augmented black-box language models","venue":null,"work_id":"1a1d44e0-6157-4124-8038-d95680917569","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.013216Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:27c6bb20fa46f0add5263013b20a6b697963dd0329cf93485243e57bdf886bf7","observation_id":"a90775c8-d2fe-454e-98d3-b0f77f8962cb","resolution":{"observed_at":"2026-08-11T11:11:08.799026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.766989Z","title":"Videobert: A joint model for video and language representation learning","venue":null,"work_id":"b70f9079-f9cc-4ed8-9aa1-6c001ab8e40a","year":2019},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.018056Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:3a346ad46e2f79e2f5829b2b0d40e07130b072a371f5e8dec6bc7fd1ffe07260","observation_id":"da305622-9b1d-414d-b410-7e67fac6f2b8","resolution":{"observed_at":"2026-08-11T11:11:08.774766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.740211Z","title":"Sq-llava: Self-questioning for large vision-language assistant","venue":null,"work_id":"12ae6375-3f80-4ab1-b64e-2c8ff6e5ef29","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.022992Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:0f49707ffece1ab09bf72077b9b04c09f5f48911a2f09f5d4ddada005436134b","observation_id":"96c70ff4-068c-4823-ad6b-f72242ebbcb9","resolution":{"observed_at":"2026-08-11T11:11:08.748964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T11:11:08.027836Z","title":"Llama: Open and efficient foundation lan- guage models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.027836Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:65f55896f25bab7d31bebd798abf8e6239fafc11187547b3773b6908e2bffa28","observation_id":"d309cf41-699b-4574-b85d-a5918e35badf","resolution":{"observed_at":"2026-08-11T11:11:08.027836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.720176Z","title":"A closer look at the robustness of contrastive language-image pre-training (clip)","venue":null,"work_id":"4f8fa982-7084-423e-b00f-a6d9fd54d394","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.033179Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:eab93cd809134a247c16383a4ad3e33a336c6a86c96e866d5dc1c22376881b24","observation_id":"9b159bed-56ca-4976-8033-f327b97bb3a5","resolution":{"observed_at":"2026-08-11T11:11:08.725549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.697887Z","title":"An empirical study into what matters for calibrating vision-language models","venue":null,"work_id":"d35d5dd8-ac4a-4cab-9f7f-18344b3bbdb7","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.038050Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:4698f447dd41fc91e463e9cbf8489be40d65ce39d4704508bb4ff77f1ca1adbe","observation_id":"bc871a3a-5abf-4ec7-ad48-b29d5d5e6d42","resolution":{"observed_at":"2026-08-11T11:11:08.703552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.680205Z","title":"GIT: A generative image-to-text transformer for vision and language","venue":null,"work_id":"e6a94e07-38c6-4e34-8ab1-88f41d9affab","year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.043116Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:33552f646d3c1ecece4b15beb5080d2f71313995cb882d6c0854274cc7e254e9","observation_id":"bfd9d476-06f8-4625-b7f0-9049d03a6511","resolution":{"observed_at":"2026-08-11T11:11:08.685635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07257","last_updated":"2023-02-14T18:54:06Z","snapshot_observed_at":"2026-08-13T12:44:31.544238Z","submitted_at":"2023-02-14T18:54:06Z","title":"ChatCAD: Interactive Computer-Aided Diagnosis on Medical Image using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07257","snapshot_observed_at":"2026-08-11T11:11:08.048628Z","title":"Chatcad: Interactive computer-aided diag- nosis on medical image using large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.048628Z"},"links":{"cited_paper":"/paper/2302.07257","citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:8a1794c3b53b93e4f02d5e55ff5a9240ce2b1acc88cfde6596ede51b6d87f305","observation_id":"afbc4c99-980c-4a8c-82e2-293803c20a8b","resolution":{"observed_at":"2026-08-11T11:11:08.048628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.658232Z","title":"Editable scene simulation for autonomous driving via collaborative llm-agents","venue":null,"work_id":"0cfb0587-df4c-495e-a6f8-9a34ef24cded","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.054227Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:e5e4fdd09c8a5e2e5de811a175b147aa6a2f9a698c42bdd47d13f3327751963a","observation_id":"5ce95740-d65c-4bd9-b42d-660870476e79","resolution":{"observed_at":"2026-08-11T11:11:08.667098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.632746Z","title":"Google landmarks dataset v2 - a large-scale benchmark for instance-level recognition and retrieval","venue":null,"work_id":"ab7bee29-e809-4bc1-810f-6f267f9c2a57","year":2020},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.060818Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:f2820371dff92f2edf41a9b53153423adbf6a258d761d0afa42374c4bd097413","observation_id":"81a2498c-861f-445c-a08e-75e8b20bfc81","resolution":{"observed_at":"2026-08-11T11:11:08.641238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.608965Z","title":"Precedent-enhanced legal judgment prediction with LLM and domain-model collaboration","venue":null,"work_id":"4785e965-c95a-4741-90de-e564260cf253","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.066185Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:01eb4f28e166dc76c992df855b41c0cddc6ebaaa83d0132a676a0e506dfe230e","observation_id":"e7fa6ad8-76fa-4214-8694-0cd71000b2b6","resolution":{"observed_at":"2026-08-11T11:11:08.614753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.575638Z","title":"Martindale, and Marine Carpuat","venue":null,"work_id":"63992817-3272-4049-bf88-16b4e0a35fc7","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.071650Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:caa078dba7746fcb63ff29d6489313dfc6c1fa164f6d589e7bbefa77db2cf139","observation_id":"c2434f08-8275-4e78-b2a2-9ce643d52a3e","resolution":{"observed_at":"2026-08-11T11:11:08.589776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-08-13T08:24:19.015641Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-11T11:11:08.077580Z","title":"mplug-owl: Modularization empowers large language models with mul- timodality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.077580Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:73e604c4be9a926614bfb78c85d3924acda2eccf50c3c73bfaffc7c1ac68eaba","observation_id":"eb4e3cd2-f926-4301-908a-1515592767b0","resolution":{"observed_at":"2026-08-11T11:11:08.077580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.549705Z","title":"Mul- timodal healthcare ai: Identifying and designing clinically relevant vision-language applications for radiology","venue":null,"work_id":"55ce8262-ab2d-4668-b766-66be0cab3b64","year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.084604Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:1b705d1e3c074af12d67f6a08367f6709efc31f9e78c3315180fd99a60528033","observation_id":"07866df3-59af-4006-b9fe-7f6005c1a38d","resolution":{"observed_at":"2026-08-11T11:11:08.558671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16045","last_updated":"2024-12-11T02:46:29Z","snapshot_observed_at":"2026-08-13T05:41:56.516364Z","submitted_at":"2023-10-24T17:58:07Z","title":"Woodpecker: Hallucination Correction for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16045","snapshot_observed_at":"2026-08-11T11:11:08.091154Z","title":"Woodpecker: Hallucination correction for multi- modal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.091154Z"},"links":{"cited_paper":"/paper/2310.16045","citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:81e5aa1ccb3577b9a5355a7313c04e57a7e344449ddd5d36205f6c1f1f0993dd","observation_id":"fb3fab50-01aa-41af-941c-b55f2870ba76","resolution":{"observed_at":"2026-08-11T11:11:08.091154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.524346Z","title":"Dauphin, and David Lopez-Paz","venue":null,"work_id":"d8773199-82d9-4423-abe2-eda1d3d4bac0","year":2018},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.096715Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:311405c023c692858390f96458593a54cc492544ec250af0ae3c8e0fe9c64bfa","observation_id":"be99acf2-2a7f-4ab5-8a2b-938749c71590","resolution":{"observed_at":"2026-08-11T11:11:08.531259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.498861Z","title":"What if the tv was off? examining counterfactual reasoning abilities of multi-modal language models","venue":null,"work_id":"864affb2-db0e-450d-bf0f-4c819b044f56","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.104459Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:3d92095e11263b97baeba57d7055d4c95a11c955fefad7195d238d9e24c7bd56","observation_id":"13aa1e1c-5b3d-4ac4-8264-1250fb04766a","resolution":{"observed_at":"2026-08-11T11:11:08.507251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-11T11:11:08.110730Z","title":"Siren’s song in the ai ocean: A survey on hal- lucination in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.110730Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:a956d24b4b64a44564db92eecf2db321fa5cfe5f11a653a5d462d6137b3ef6a4","observation_id":"7d2acbd9-d772-43e8-8069-ffa3d721984b","resolution":{"observed_at":"2026-08-11T11:11:08.110730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.471495Z","title":"Calibrating sequence likelihood improves conditional language genera- tion","venue":null,"work_id":"03a83017-392b-40c8-b845-49f176aac8b5","year":2023},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.117116Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:5bf6073452be3b13b60f466e5d87320d1670086a8ed65d1c5433117a959c1664","observation_id":"1d076d16-8717-46cd-a5bf-685aad026328","resolution":{"observed_at":"2026-08-11T11:11:08.477783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.445196Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":"085acda6-cb49-4db0-9847-47de78cc6f67","year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.123119Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:ce48df3008944c3c0d04a98f1fbf20eb550078709f3da1afe2f5fbc456c9dd31","observation_id":"1fd10b15-7c81-4a75-bdb4-26d6d42334d3","resolution":{"observed_at":"2026-08-11T11:11:08.457012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.422329Z","title":"Learning deep features for scene recognition using places database","venue":null,"work_id":"610bd7b5-61cb-45df-8039-5b12b8b16a9b","year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.128754Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:e664955e5100c3bb29c9f61bc07ea0597f5966ea6f48b383615eb872837c4b36","observation_id":"9d1d5b7d-4ccc-43b3-9569-304625f7ef61","resolution":{"observed_at":"2026-08-11T11:11:08.428399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.395535Z","title":"Detecting hallucinated content in conditional neural sequence generation","venue":null,"work_id":"8266fc66-3a20-406d-9509-42d02ed89c5a","year":2021},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.134313Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:d0386bb0450d69550ae19f8b45a48318faed01b957e295b56e68565cbd8d6bdd","observation_id":"3ae03b19-753c-4df1-a5c8-39043de5d5f1","resolution":{"observed_at":"2026-08-11T11:11:08.403825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:08.360968Z","title":"Jpeg Compression","venue":null,"work_id":"6ff92e07-77e3-4064-a374-4af502302fe2","year":2024},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:08.139563Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:7bb23d2c0c6f1e654130d4137805da2766b557dc20b25a96a602e3c40ad7b574","observation_id":"024b06c8-d5ab-49cb-92b4-adac92ce81a5","resolution":{"observed_at":"2026-08-11T11:11:08.372299Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:11:07.867924Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:07.867924Z"},"links":{"citing_paper":"/paper/2412.15739"},"observation_digest":"sha256:44ec5b44b9b1fb1f9b43e6a68b5ef0a649e29673f0eb46b150314a81a217856b","observation_id":"7c32e135-9339-44e5-95ee-75f3522c9ea7","resolution":{"observed_at":"2026-08-11T11:11:07.867924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.15739","last_updated":"2024-12-20T10:00:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T11:06:23.678695Z","submitted_at":"2024-12-20T10:00:26Z","title":"VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":62},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 3 inbound Pith citation observations for arXiv:2412.15739."}