{"as_of":"2026-08-07T17:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ef2473344b2ee51536213794b5a2e49e9b01f430f5df5b0d2b27382b6eab69ce","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:36:15.819379Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T17:46:00.822375Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T03:39:30.608876Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"cited_work":{"arxiv_id":"2506.07575","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07575","snapshot_observed_at":"2026-07-04T03:39:30.608876Z","title":"Uncertainty- o: One model-agnostic framework for unveiling uncertainty in large multimodal models.arXiv preprint arXiv:2506.07575, 2025","venue":null,"work_id":"0290cb83-fe4b-49e4-81fb-300a36f97fd5","year":2025},"citing_paper":{"arxiv_id":"2606.19868","last_updated":"2026-06-18T07:27:34Z","snapshot_observed_at":"2026-08-07T01:38:03.697975Z","submitted_at":"2026-06-18T07:27:34Z","title":"A Systematic Evaluation of Black-Box Uncertainty Estimation Methods for Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T17:46:00.822375Z"},"links":{"cited_paper":"/paper/2506.07575","citing_paper":"/paper/2606.19868"},"observation_digest":"sha256:35199bb8161ac19463db163ddadc37b5fe9415adc9feaa1888ccd14995225574","observation_id":"3e5cf70d-aa8e-41f0-8b38-dbe3e1ebd562","resolution":{"observed_at":"2026-07-04T03:39:30.610855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07575/citation-record","integrity":"/paper/2506.07575/integrity","json":"/paper/2506.07575/citation-record.json","paper":"/paper/2506.07575"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:36:15.429855Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.429855Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:ed212c4c057dff28307a2aadaf2c3199c8a970d9729aee19b4f269f3bbdda819","observation_id":"70721b71-9a16-4c3f-991a-9fbf08de0d47","resolution":{"observed_at":"2026-08-07T05:36:15.429855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.435545Z","title":"How many opinions does your llm have? improving uncertainty estimation in nlg","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.435545Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:43f5c8c3cdb7e291c1b0297c7ded413b1bcb572f9c6d028b4bd64f69e696acc4","observation_id":"dd960f05-75e3-4b49-a081-7afd2d699de5","resolution":{"observed_at":"2026-08-07T05:36:15.435545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13507","last_updated":"2023-10-25T18:43:02Z","snapshot_observed_at":"2026-07-06T15:31:01.106910Z","submitted_at":"2023-05-22T21:52:24Z","title":"Multimodal Automated Fact-Checking: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13507","snapshot_observed_at":"2026-08-07T05:36:15.440448Z","title":"Multimodal automated fact-checking: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.440448Z"},"links":{"cited_paper":"/paper/2305.13507","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:026a48fe71e0be1c36fec71f5fac550b82ab84f9c8412f0cd87b589fe184a974","observation_id":"9ab4718f-62d3-46dd-b731-b3e6c9d34225","resolution":{"observed_at":"2026-08-07T05:36:15.440448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13712","last_updated":"2024-07-02T01:39:50Z","snapshot_observed_at":"2026-07-06T15:31:09.320113Z","submitted_at":"2023-05-23T05:59:21Z","title":"Knowledge of Knowledge: Exploring Known-Unknowns Uncertainty with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13712","snapshot_observed_at":"2026-08-07T05:36:15.445213Z","title":"Knowledge of knowledge: Ex- ploring known-unknowns uncertainty with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.445213Z"},"links":{"cited_paper":"/paper/2305.13712","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:1e7cb191ebe55236da36ba243a2db8651b27ef90ee81ae298029ea86e7f35422","observation_id":"e39b9aa9-92d2-4f03-9716-e2b4b419173d","resolution":{"observed_at":"2026-08-07T05:36:15.445213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.450516Z","title":"Predicting and understanding human action decisions during skillful joint-action using supervised machine learning and explainable-ai","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.450516Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:e24019c7f5ec17ff5b8b8433329c54ecea810d6e7eeaf7d6ed62e221282443f9","observation_id":"a6bc3eba-a7d4-4d35-9603-09149144f8b9","resolution":{"observed_at":"2026-08-07T05:36:15.450516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.455158Z","title":"Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.455158Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:28ad90395449a2b489962694612121a31897c97ccdf044a7c64456787b09f668","observation_id":"5b218547-f80c-47a5-a32e-b5b5f7b2d477","resolution":{"observed_at":"2026-08-07T05:36:15.455158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-07T05:36:15.461202Z","title":"Halluci- nation of multimodal large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.461202Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:53295eb33b1092397bef7f868708594cad32936fc15ed5e1e2d892418b1f4066","observation_id":"c5614c95-8b66-486c-9645-aac77201f808","resolution":{"observed_at":"2026-08-07T05:36:15.461202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.466099Z","title":"Lan- guage models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.466099Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:441fd22db0385fa2923f95d197ca1f6c418c66eb1d14ebabee6040c387ba6bb4","observation_id":"5db89a14-a179-4fcf-82e6-514f3fea699e","resolution":{"observed_at":"2026-08-07T05:36:15.466099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.471048Z","title":"The revolution of multimodal large language models: a survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.471048Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:3dba19fa43514b095155d408fdf8eea86f84bf4f96c61b719c7356095ed9138e","observation_id":"7793d10b-c01a-4ba6-b99c-5e5d07611216","resolution":{"observed_at":"2026-08-07T05:36:15.471048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.475421Z","title":"Rational use of cognitive resources in human planning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.475421Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:37d6b1c3c4621ed4a02a2948a06f36ff792103b1739ba04c4d541700f1e83f91","observation_id":"dcc92c32-0aee-4b3b-a192-185d53e1dbd8","resolution":{"observed_at":"2026-08-07T05:36:15.475421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01322","last_updated":"2024-03-28T15:53:45Z","snapshot_observed_at":"2026-07-06T17:54:07.815827Z","submitted_at":"2024-03-28T15:53:45Z","title":"A Review of Multi-Modal Large Language and Vision Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01322","snapshot_observed_at":"2026-08-07T05:36:15.479733Z","title":"A review of multi-modal large language and vision models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.479733Z"},"links":{"cited_paper":"/paper/2404.01322","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:0457eaba688432be5db4b978f32ea6281143273937355755e4bb311f83d6ff2f","observation_id":"71f318e2-1579-4182-b768-4d14b299a69d","resolution":{"observed_at":"2026-08-07T05:36:15.479733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-07T11:28:03.211074Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-07T05:36:15.484473Z","title":"Shapenet: An information-rich 3d model repository","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.484473Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:fc1a27b3614ec73ad6ab52fec3706d9f58f6204ce6aaa169f2a089370b2c61f7","observation_id":"778e27d7-e173-4975-b03c-8f1f85040522","resolution":{"observed_at":"2026-08-07T05:36:15.484473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-07T05:36:15.489481Z","title":"Microsoft coco captions: Data collection and evaluation server","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.489481Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:f472be6c9b0ac35d9a726bc9bf6a52f1d18fb694db611766787a0aa4809c95d9","observation_id":"8e19de4c-965d-4307-a9e4-d5dd6321d415","resolution":{"observed_at":"2026-08-07T05:36:15.489481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03190","last_updated":"2024-05-27T11:52:56Z","snapshot_observed_at":"2026-07-06T17:25:35.493362Z","submitted_at":"2024-02-05T16:56:11Z","title":"Unified Hallucination Detection for Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03190","snapshot_observed_at":"2026-08-07T05:36:15.494189Z","title":"Unified hallucination detection for multi- modal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.494189Z"},"links":{"cited_paper":"/paper/2402.03190","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:bc6184f87902cb352ae705a4a6e7332a19e904577d1c33766731b63b48bfdddb","observation_id":"376f40cc-73b1-4818-95c8-fbb7dec15dbc","resolution":{"observed_at":"2026-08-07T05:36:15.494189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14660","last_updated":"2024-12-25T06:05:36Z","snapshot_observed_at":"2026-07-06T20:09:53.938772Z","submitted_at":"2024-12-19T09:10:07Z","title":"Unveiling Uncertainty: A Deep Dive into Calibration and Performance of Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14660","snapshot_observed_at":"2026-08-07T05:36:15.499186Z","title":"Unveiling uncertainty: A deep dive into calibration and performance of multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.499186Z"},"links":{"cited_paper":"/paper/2412.14660","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:5eb7abec7c2ead8d0d43b35fbf0e2317f09cbd8d26f9f5e68b79d2205fcefdfd","observation_id":"ebdf2bfd-a829-47a8-b447-09ce69d6f26a","resolution":{"observed_at":"2026-08-07T05:36:15.499186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.503666Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.503666Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:3c9ce18c91aea1d91dea3b29247d279895e2132a45220eecd48d8b84ac80b554","observation_id":"325846ed-c0dd-43d1-93f4-c8591d9a2503","resolution":{"observed_at":"2026-08-07T05:36:15.503666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.507721Z","title":"I don’t know: Explicit modeling of uncertainty with an [idk] token","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.507721Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:df14723e6524dc29fb485318e91725fef15cbcc2d3eea0664a0940e96c4e4ad6","observation_id":"e3efa6ed-bb55-4cda-9db9-f157a4f2a760","resolution":{"observed_at":"2026-08-07T05:36:15.507721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.511842Z","title":"Human uncertainty in concept-based ai systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.511842Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:2db4bfa75a193d4f2bbfc872b73a9959990db4b4217ecd8016b2f11ab47a4345","observation_id":"ca946fa2-aa29-4d04-ab07-3c5d5c2bb9ce","resolution":{"observed_at":"2026-08-07T05:36:15.511842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.516267Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.516267Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:8ab51fea92a112aefbed3ba2b5cd5b2f5fb33b6fa4e596d9ac170051664e05fe","observation_id":"ed92ce87-3568-4fcf-a237-420118f28b56","resolution":{"observed_at":"2026-08-07T05:36:15.516267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.520063Z","title":"Retrieve only when it needs: Adaptive re- trieval augmentation for hallucination mitigation in large lan- guage models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.520063Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:e84621b0c1944ef73e0a77e96477def49ea33d4d419694eac315742b42f643ff","observation_id":"97b9a2c7-0104-4af2-9a91-389aedb00c99","resolution":{"observed_at":"2026-08-07T05:36:15.520063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.523790Z","title":"Clotho: An audio captioning dataset","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.523790Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:1e987e7cdeb0b1ff46ae248dc046351f34c6f7135518fc63a751d1fc0da593b9","observation_id":"7af75ba0-58a5-4ae3-a999-229f03909fb8","resolution":{"observed_at":"2026-08-07T05:36:15.523790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13861","last_updated":"2024-10-21T15:42:46Z","snapshot_observed_at":"2026-07-06T19:35:30.732080Z","submitted_at":"2024-10-17T17:59:57Z","title":"PUMA: Empowering Unified MLLM with Multi-granular Visual Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13861","snapshot_observed_at":"2026-08-07T05:36:15.528322Z","title":"Puma: Empowering unified mllm with multi- granular visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.528322Z"},"links":{"cited_paper":"/paper/2410.13861","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:c7f347972676ffbcb2c0d4acd898fdb41c1827a986e835621ae9b5f0097efecd","observation_id":"e38279b1-d0d4-49ef-bde6-99226a0032bb","resolution":{"observed_at":"2026-08-07T05:36:15.528322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.06474","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.344034Z","title":"From uncertainty to trust: Enhancing re- liability in vision-language models with uncertainty-guided dropout decoding","venue":null,"work_id":"09241cc3-74eb-495b-b618-843d28ed5886","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.532369Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:796dc01b883a305a3450d7699a42a73423840c0e70ff8ef3323666eb71a847c0","observation_id":"0b6b566e-5ccb-4483-b7ed-342084bcd31f","resolution":{"observed_at":"2026-08-07T05:36:16.352161Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:17.144358Z","title":"Detecting hallucinations in large language models using semantic entropy","venue":null,"work_id":"f44a78d0-fd16-458c-97cd-e89dee3f7fa8","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.536133Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:1f9dd1bc79e274995aa48b6fae7942936a0bdaab86ef8868e273c1294ee25ae3","observation_id":"e806c30d-0123-4821-90e1-c11fae348f40","resolution":{"observed_at":"2026-08-07T05:36:17.149174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03230","last_updated":"2024-05-07T11:55:10Z","snapshot_observed_at":"2026-07-06T20:17:15.995064Z","submitted_at":"2024-05-07T11:55:10Z","title":"Video-of-Thought: Step-by-Step Video Reasoning from Perception to Cognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03230","snapshot_observed_at":"2026-08-07T05:36:15.540187Z","title":"Video-of-thought: Step-by-step video reasoning from perception to cognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.540187Z"},"links":{"cited_paper":"/paper/2501.03230","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:d47ff9c159c86f1bf91d340a5ab1326dacb712b23f84ea9fb2435985d00bc4de","observation_id":"2347e678-cf70-4e00-b626-809cef25365c","resolution":{"observed_at":"2026-08-07T05:36:15.540187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19806","last_updated":"2024-10-08T08:39:04Z","snapshot_observed_at":"2026-08-05T07:34:18.685637Z","submitted_at":"2024-10-08T08:39:04Z","title":"Vitron: A Unified Pixel-level Vision LLM for Understanding, Generating, Segmenting, Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19806","snapshot_observed_at":"2026-08-07T05:36:15.544341Z","title":"Vitron: A unified pixel-level vision llm for understanding, generating, segmenting, editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.544341Z"},"links":{"cited_paper":"/paper/2412.19806","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:6a2801801720d4254f620caa64216bfbb1eee045f018158d1506c682aa88323c","observation_id":"237fe246-e200-4e68-aaf0-7fab4d12797f","resolution":{"observed_at":"2026-08-07T05:36:15.544341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:17.128750Z","title":"Enhancing video-language representations with structural spatio-temporal alignment","venue":null,"work_id":"1533642f-511b-4d22-891c-b4d9a41195f9","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.549346Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:2a44252673758f37cf0da71edbf7115ece53b1f565a7a6469fe59fe19afd9a83","observation_id":"fb6d6d4e-0c6d-4329-bc25-88955f8ba0c2","resolution":{"observed_at":"2026-08-07T05:36:17.133079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:17.113480Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":"ba393dcb-c134-42ab-a3a7-49fb405ae688","year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.553009Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:278d16415622b11cf125a0abd43cb3393faf7e267792f80791bfc053ae785d50","observation_id":"df0cea6e-45ab-46c4-8b2b-f957556efdca","resolution":{"observed_at":"2026-08-07T05:36:17.117688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:17.098037Z","title":"Large language models respond to influence like humans","venue":null,"work_id":"459d079d-809a-400f-96e5-b9d8d8f46ea3","year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.557255Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:ccbf2ae72033c61e55c28014f6fd6e4ead5eddcf206865321e64d2e90bb27b66","observation_id":"c1842dab-1c97-42e8-bd92-e5701d9ac166","resolution":{"observed_at":"2026-08-07T05:36:17.102771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:17.082600Z","title":"Onellm: One framework to align all modalities with language","venue":null,"work_id":"462d1ae0-4d0e-4557-b919-048f2225bef4","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.561326Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:a7e3f385686c407622cc7f4629e82f3ff39b12eee9ca94911a25fce0f5eb0ca4","observation_id":"81acf36e-e34b-44a2-be82-0777b77a5356","resolution":{"observed_at":"2026-08-07T05:36:17.087585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.564981Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.564981Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:8d4ffa0baca3bdb4a66186b9c5a4638769c3413b96486fd9b29a9a2b971d0ea5","observation_id":"d5bb6bb3-9efb-4b11-92e7-c5a62c1a9e69","resolution":{"observed_at":"2026-08-07T05:36:15.564981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15769","last_updated":"2024-08-28T13:05:55Z","snapshot_observed_at":"2026-08-06T13:29:37.152582Z","submitted_at":"2024-08-28T13:05:55Z","title":"A Survey on Evaluation of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15769","snapshot_observed_at":"2026-08-07T05:36:15.568736Z","title":"A survey on evaluation of multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.568736Z"},"links":{"cited_paper":"/paper/2408.15769","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:7c6aa738d102ace57fef41f4538393030554ec6bbb8f24db5ec5ef60ff93a387","observation_id":"c2252e6d-8f3a-4ad4-81d6-87a0f853c88b","resolution":{"observed_at":"2026-08-07T05:36:15.568736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-07T05:36:15.573134Z","title":"Visual hallucinations of multi-modal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.573134Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:3711e1eaefaadeb23952e9ee3a6dbc1463dcc5a2dd5e9b2574a743b7cbc8b04a","observation_id":"467d2227-2375-4c1c-98e8-3e3dbcb4cde6","resolution":{"observed_at":"2026-08-07T05:36:15.573134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T05:36:15.578298Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.578298Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:8ac855e50865059271d237901962471eaa6ffbe1855627a29d0ef2d0040d7ba4","observation_id":"6677854a-7a7f-4690-9f27-78863eb71b10","resolution":{"observed_at":"2026-08-07T05:36:15.578298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05335","last_updated":"2023-07-20T16:24:14Z","snapshot_observed_at":"2026-07-06T14:03:33.692469Z","submitted_at":"2022-10-11T10:54:54Z","title":"MAP: Multimodal Uncertainty-Aware Vision-Language Pre-training Model","version":3},"cited_work":{"arxiv_id":"2210.05335","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.05335","snapshot_observed_at":"2026-08-07T05:36:16.174627Z","title":"MAP: Multimodal Uncertainty-Aware Vision-Language Pre-training Model","venue":"cs.CV","work_id":"61825ff7-e0b0-41f2-88be-1824e0809ed4","year":2022},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.582961Z"},"links":{"cited_paper":"/paper/2210.05335","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:0e31fd9148c02298f97fb7e4defcf1e76fd43eede4c476023b775105d8b48b3a","observation_id":"c84a9f05-7ab1-4223-8e26-233241932b2d","resolution":{"observed_at":"2026-08-07T05:36:16.179278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.587156Z","title":"Mimic-cxr, a de- identified publicly available database of chest radiographs with free-text reports","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.587156Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:398ddb8dc3d11f8d0e3923950a00483952db475c2903115cab1939da2350fe20","observation_id":"01ea5bc5-5f9c-4ccd-9054-63993b4d147f","resolution":{"observed_at":"2026-08-07T05:36:15.587156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01519","last_updated":"2025-04-20T08:45:26Z","snapshot_observed_at":"2026-07-06T17:11:04.789413Z","submitted_at":"2024-01-03T03:01:29Z","title":"Exploring the Frontiers of LLMs in Psychological Applications: A Comprehensive Review","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01519","snapshot_observed_at":"2026-08-07T05:36:15.591683Z","title":"Ex- ploring the frontiers of llms in psychological applications: A comprehensive review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.591683Z"},"links":{"cited_paper":"/paper/2401.01519","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:884a15fd9f9d88fe9188df3ff6fd834f8b6331e6b062c44dc4e8552512822a84","observation_id":"bcf371ae-1231-4d40-aa0c-495b7b9177e1","resolution":{"observed_at":"2026-08-07T05:36:15.591683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:17.050299Z","title":"Audiocaps: Generating captions for audios in the wild","venue":null,"work_id":"ac18f856-c323-4490-aa1b-1366bc30f814","year":2019},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.596504Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:8bf9995cd2767298ed19ea46db86dd8f7b721eb4b9c35c18126cd0517051ab47","observation_id":"75ec342a-cbb9-4f81-b4e8-667fd903db5d","resolution":{"observed_at":"2026-08-07T05:36:17.054522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15352","last_updated":"2023-03-05T09:14:16Z","snapshot_observed_at":"2026-08-07T16:54:38.689558Z","submitted_at":"2022-09-30T10:17:05Z","title":"AudioGen: Textually Guided Audio Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15352","snapshot_observed_at":"2026-08-07T05:36:15.600823Z","title":"Audiogen: Textually guided audio gen- eration","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.600823Z"},"links":{"cited_paper":"/paper/2209.15352","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:2873495392f2d000bf1a28a00ce70bd177fd1b88b302fdb10a56bb3270214a72","observation_id":"4e14ef2e-2a4b-44a6-abc1-7ad47759d318","resolution":{"observed_at":"2026-08-07T05:36:15.600823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14979","last_updated":"2024-12-05T02:38:38Z","snapshot_observed_at":"2026-07-06T18:49:33.987133Z","submitted_at":"2024-07-20T21:06:33Z","title":"RGB2Point: 3D Point Cloud Generation from Single RGB Images","version":4},"cited_work":{"arxiv_id":"2407.14979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14979","snapshot_observed_at":"2026-08-07T05:36:16.127620Z","title":"RGB2Point: 3D Point Cloud Generation from Single RGB Images","venue":"cs.CV","work_id":"8e326dad-a212-43e5-9b52-11884978cfc5","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.605520Z"},"links":{"cited_paper":"/paper/2407.14979","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:274a079c439e1b55ddb968cf01556157b3a5a99ded5297879e7954ff1d8b13f2","observation_id":"5fe5e464-8070-4b80-bcc6-c7ed9502e635","resolution":{"observed_at":"2026-08-07T05:36:16.132027Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13388","last_updated":"2024-06-06T13:25:09Z","snapshot_observed_at":"2026-07-06T17:19:52.125879Z","submitted_at":"2024-01-24T11:36:44Z","title":"UNIMO-G: Unified Image Generation through Multimodal Conditional Diffusion","version":3},"cited_work":{"arxiv_id":"2401.13388","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.13388","snapshot_observed_at":"2026-08-07T05:36:16.108618Z","title":"UNIMO-G: Unified Image Generation through Multimodal Conditional Diffusion","venue":"cs.CV","work_id":"328391e6-ebfa-4dce-adeb-5755fe691d9a","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.609922Z"},"links":{"cited_paper":"/paper/2401.13388","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:f4d4415619858814350bce5e40ab9d785879ab658bbc95629b9cc9f76e7a2499","observation_id":"8d212d59-c7e4-41a7-8a5a-fbfbdaee565d","resolution":{"observed_at":"2026-08-07T05:36:16.113155Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-07T05:36:15.614324Z","title":"Evaluating object hallucination in large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.614324Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:4b60ed195921dcb0eaf57076df60029738bad681b404952ff42e0857aab1cae2","observation_id":"d1f731e9-3188-434b-9555-0abe0b85a997","resolution":{"observed_at":"2026-08-07T05:36:15.614324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-07T05:36:15.619085Z","title":"Video-llava: Learning united visual repre- sentation by alignment before projection.arXiv:2311.10122,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.619085Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:088e763b41b4a0bbff50b3b252951a9b944e6e1cc3af77f0812ad9992aea665e","observation_id":"ec0414f0-53ca-4d81-9263-dc1580cfc322","resolution":{"observed_at":"2026-08-07T05:36:15.619085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:17.036970Z","title":"Clotho-aqa: A crowd- sourced dataset for audio question answering","venue":null,"work_id":"37889fba-5fe9-4b82-b891-477bf6353d08","year":2022},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.623493Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:f1bae67021d347ab990ba2164ced55204dc53328c2cf09873081bff589dd1be1","observation_id":"bf64d6b2-be98-4356-a98e-0283d0c71af2","resolution":{"observed_at":"2026-08-07T05:36:17.040842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14565","last_updated":"2024-03-19T22:53:25Z","snapshot_observed_at":"2026-08-06T22:33:34.254048Z","submitted_at":"2023-06-26T10:26:33Z","title":"Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14565","snapshot_observed_at":"2026-08-07T05:36:15.627411Z","title":"Mitigating hallucination in large multi-modal models via robust instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.627411Z"},"links":{"cited_paper":"/paper/2306.14565","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:336c364d1cd63c5b112397892b87d8bdc74236da3c28dc4731fd6a8e67e15583","observation_id":"8b24cdc6-a01c-4e9a-8db5-3475d99d59cc","resolution":{"observed_at":"2026-08-07T05:36:15.627411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:17.023576Z","title":"Visual instruction tuning","venue":null,"work_id":"ce6cbce7-dec1-4854-91c7-81de0191f1e5","year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.632144Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:a13cf07ed3a85eac70da919867ce424631261a85c1911c48234642f54fc24b14","observation_id":"2dd78eba-5d68-4e87-ae0e-31bd69f75c75","resolution":{"observed_at":"2026-08-07T05:36:17.027803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08320","last_updated":"2023-10-13T01:43:04Z","snapshot_observed_at":"2026-08-05T15:11:09.163965Z","submitted_at":"2023-03-15T02:16:39Z","title":"VideoFusion: Decomposed Diffusion Models for High-Quality Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08320","snapshot_observed_at":"2026-08-07T05:36:15.636162Z","title":"Videofusion: Decomposed diffusion models for high-quality video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.636162Z"},"links":{"cited_paper":"/paper/2303.08320","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:fa2e9239102e0d4cc5aa51ad0d2813b43a49cb0b8ec7d295a1d98ab9b8394dd9","observation_id":"ae0d8297-91b7-4cc9-9557-3208a3e74c0d","resolution":{"observed_at":"2026-08-07T05:36:15.636162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:17.010802Z","title":"Unibind: Llm-augmented unified and balanced representa- tion space to bind them all","venue":null,"work_id":"d5fa46df-2999-43c2-9f19-9d759cac7e41","year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.640261Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:47483aafb8238c5d2107131b856cb2933292e511c879019645325377beeb9ca3","observation_id":"cac0082e-be49-4cd1-b3af-e2c5b8aaacd0","resolution":{"observed_at":"2026-08-07T05:36:17.014887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.996306Z","title":"Openeqa: Embodied question answering in the era of foun- dation models","venue":null,"work_id":"9221a2d7-61b0-4c88-a087-47274ff301d0","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.644736Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:f91b251da051c0724bed80363a1d371dc0030b92010354db344e110e409c0684","observation_id":"daefd627-3d13-41eb-a34c-88f115b96a00","resolution":{"observed_at":"2026-08-07T05:36:17.000738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08751","last_updated":"2022-12-16T23:22:59Z","snapshot_observed_at":"2026-07-06T14:31:54.932806Z","submitted_at":"2022-12-16T23:22:59Z","title":"Point-E: A System for Generating 3D Point Clouds from Complex Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08751","snapshot_observed_at":"2026-08-07T05:36:15.648822Z","title":"Point-e: A system for generating 3d point clouds from complex prompts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.648822Z"},"links":{"cited_paper":"/paper/2212.08751","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:abc6d5f8bbd8cbcb432ea55659aa4175198d87ab67b3185cd19b2c92342d35c4","observation_id":"8a27a624-c870-4bdd-bafd-a7999d2625b2","resolution":{"observed_at":"2026-08-07T05:36:15.648822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.981693Z","title":"Human uncertainty makes clas- sification more robust","venue":null,"work_id":"f5be5112-1456-43d4-bf4e-be8a6ce7fed7","year":2019},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.653333Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:3b1ba4e70258ae1274bcd5f0e8db2525feebcd427d3670ac5990a34818e6ad36","observation_id":"af333303-2975-4ef3-846b-bf441ccd6fd3","resolution":{"observed_at":"2026-08-07T05:36:16.986280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02906","last_updated":"2024-06-17T16:53:49Z","snapshot_observed_at":"2026-08-07T09:15:19.297634Z","submitted_at":"2024-01-05T17:05:42Z","title":"MLLM-Protector: Ensuring MLLM's Safety without Hurting Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02906","snapshot_observed_at":"2026-08-07T05:36:15.657440Z","title":"Mllm-protector: Ensuring mllm’s safety without hurting per- formance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.657440Z"},"links":{"cited_paper":"/paper/2401.02906","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:90eef783968f57f237ebbefbfd816c12481b20112eaa9f94fe4062ec8b50b362","observation_id":"54ad4906-8783-4811-9f0b-c3012997d958","resolution":{"observed_at":"2026-08-07T05:36:15.657440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.968326Z","title":"Flickr30k entities: Collecting region-to-phrase corre- spondences for richer image-to-sentence models","venue":null,"work_id":"ab29f5d4-b8a1-4831-b196-31dc4341684e","year":2015},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.661704Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:5470dff415dbe858e6799fba643b8ac8ac74f7bb16ecf6fed1cc5eaa64701af6","observation_id":"7e38aa81-7496-4998-b151-13add24a20ee","resolution":{"observed_at":"2026-08-07T05:36:16.972679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.954228Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":"94a8ba5e-de47-45b0-8bfc-84c43b69b096","year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.665572Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:3f59412414757b6a5116f01e3c5ad9b3c86f258a0443c9e5d8686f430d68fe59","observation_id":"0440a7a7-ffff-4e94-8d09-61ab9705dc2c","resolution":{"observed_at":"2026-08-07T05:36:16.958347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-07T05:36:15.669523Z","title":"Object hallucination in image cap- tioning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.669523Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:7eb9d58d2cd77be3363fe737557604a2cdd0fab47655afa3eb1799fefac2d42b","observation_id":"07b9fbbe-98d3-49d7-ba6f-307a9daff762","resolution":{"observed_at":"2026-08-07T05:36:15.669523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.939149Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"e7381a1d-db90-47ce-a7e6-84423795aaef","year":2022},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.673597Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:e67dbebb13f42073e86687b2fd10c3eff09b0594cd9e7f6620315af629c1f063","observation_id":"faefea57-4f5e-4ad6-9d7d-de744989a0d0","resolution":{"observed_at":"2026-08-07T05:36:16.944222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05563","last_updated":"2025-07-01T22:08:39Z","snapshot_observed_at":"2026-07-06T20:03:11.541819Z","submitted_at":"2024-12-07T06:56:01Z","title":"A Survey on Uncertainty Quantification of Large Language Models: Taxonomy, Open Research Challenges, and Future Directions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05563","snapshot_observed_at":"2026-08-07T05:36:15.677482Z","title":"A survey on uncertainty quantification of large language models: Taxonomy, open research chal- lenges, and future directions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.677482Z"},"links":{"cited_paper":"/paper/2412.05563","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:6ed341a577636bbc718f644365cd7821f25ddabe23ea4e6d488547802bf45dac","observation_id":"eca5bd21-10f8-4cc3-91c8-1e66359ac523","resolution":{"observed_at":"2026-08-07T05:36:15.677482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.923366Z","title":"Moma: Multimodal llm adapter for fast personalized image generation","venue":null,"work_id":"e859cdde-f485-45ab-8170-bc7c0c598be3","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.682096Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:bd9c551dbafd13aaa0bb699e9ada2ccffea293e8ddbf8c6eb4e67cdeb1bf548f","observation_id":"5a5ddccc-f0da-48e1-ab39-cea1af7510ee","resolution":{"observed_at":"2026-08-07T05:36:16.927402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.907717Z","title":"Pix3d: Dataset and methods for single-image 3d shape modeling","venue":null,"work_id":"a5f989a8-12e6-41c3-b307-ba4955a357c3","year":2018},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.686084Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:00f922c6a3bb08dabfda26da8f7863eb17d24b755007a873dbfdfe625e610295","observation_id":"6bbc8983-0700-42fc-adbe-2898be57e7a3","resolution":{"observed_at":"2026-08-07T05:36:16.913292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.893584Z","title":"Any-to-any generation via composable diffu- sion","venue":null,"work_id":"f134dabe-5217-4d89-ab73-cdc6b301c9d2","year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.690326Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:850d8ffda0db28c802d3cdd1ea41c358efdd3136d08d55566098c99a6c94caed","observation_id":"dd0d44dc-603d-40b7-8a28-579308a563b1","resolution":{"observed_at":"2026-08-07T05:36:16.898734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.879400Z","title":"Codi-2: In-context in- terleaved and interactive any-to-any generation","venue":null,"work_id":"43018479-2e01-4e6f-9f18-adedba9c5860","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.694155Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:9be172c4c69955655a6d2035ba91779ce11d9d6f3a0aac9de67b2dcc0579c6bd","observation_id":"49d04c41-9cc9-4a29-9a9a-9659e12366b7","resolution":{"observed_at":"2026-08-07T05:36:16.883874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.02990","last_updated":"2021-01-24T09:49:19Z","snapshot_observed_at":"2026-08-05T20:29:03.208508Z","submitted_at":"2020-04-06T20:44:10Z","title":"Evaluating the Evaluation of Diversity in Natural Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.02990","snapshot_observed_at":"2026-08-07T05:36:15.698346Z","title":"Evaluating the evaluation of diversity in natural language generation","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.698346Z"},"links":{"cited_paper":"/paper/2004.02990","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:6dca157406f1c4702d14b2764a9346bf018857a51bdd1f5eaf673042eed0890e","observation_id":"476d3ee4-1bd3-480e-8dfe-036b1e821b17","resolution":{"observed_at":"2026-08-07T05:36:15.698346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15126","last_updated":"2023-10-10T11:57:26Z","snapshot_observed_at":"2026-08-01T17:12:16.290540Z","submitted_at":"2023-08-29T08:51:24Z","title":"Evaluation and Analysis of Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15126","snapshot_observed_at":"2026-08-07T05:36:15.702798Z","title":"Evaluation and analysis of halluci- nation in large vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.702798Z"},"links":{"cited_paper":"/paper/2308.15126","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:bdafca29682a9045075709a3c77e62ff456aa4b323c65b504a871a5eae79295c","observation_id":"8e9d0d8f-51dc-419f-a014-a59245f18cdf","resolution":{"observed_at":"2026-08-07T05:36:15.702798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04854","last_updated":"2024-06-07T11:37:45Z","snapshot_observed_at":"2026-08-07T05:36:07.498338Z","submitted_at":"2024-06-07T11:37:45Z","title":"Uncertainty Aware Learning for Language Model Alignment","version":1},"cited_work":{"arxiv_id":"2406.04854","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04854","snapshot_observed_at":"2026-08-07T05:36:15.949675Z","title":"Uncertainty Aware Learning for Language Model Alignment","venue":"cs.CL","work_id":"a0392a55-a955-417c-9c36-4d569f197ebe","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.707773Z"},"links":{"cited_paper":"/paper/2406.04854","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:00cb1c369a4bd15e848348a8e89a6fddd4c4632b5aabd16969d4f8fba95d6d70","observation_id":"ae3f04ff-f2a2-460f-8022-02163d43b24e","resolution":{"observed_at":"2026-08-07T05:36:15.955675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.865638Z","title":"Multimodal large language models: A sur- vey","venue":null,"work_id":"a8f89f49-d2c7-451d-9cdf-e08cc7d5102d","year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.712088Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:c357a66c8d971873ae4cfce5fa9b8fb809d8832a6588b062aa3cc8d2fd2f9beb","observation_id":"8e788e5a-7fc5-4718-a811-dd04f9b82aea","resolution":{"observed_at":"2026-08-07T05:36:16.870372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15310","last_updated":"2024-09-05T08:47:34Z","snapshot_observed_at":"2026-08-05T20:59:08.258366Z","submitted_at":"2024-09-05T08:47:34Z","title":"Visual Prompting in Multimodal Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15310","snapshot_observed_at":"2026-08-07T05:36:15.716207Z","title":"Visual prompting in multimodal large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.716207Z"},"links":{"cited_paper":"/paper/2409.15310","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:717376ac710640a57cd1fcf53b7a0509fcc627d72c349d0ca34ce1e3b884567c","observation_id":"7aaf53df-d37c-4d31-b5c1-7996665ae2f2","resolution":{"observed_at":"2026-08-07T05:36:15.716207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.720986Z","title":"Next-gpt: Any-to-any multimodal llm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.720986Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:995824e70a24c20d7417eac42e9d2ca28ff5e81afa6660f3dba0fa3370d13c08","observation_id":"12192345-6dc4-4ee5-8aa6-b83f32a2c336","resolution":{"observed_at":"2026-08-07T05:36:15.720986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.843093Z","title":"Self-correcting llm-controlled diffusion models","venue":null,"work_id":"b93fc7b6-bea3-4afe-9b74-463dc3ed33d5","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.724944Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:9d4ca627dfbeb6aa02bd28965ec69cb52bbd10beb3186d20cef4ec96c07bde2f","observation_id":"3020b22e-730f-449a-a1b0-7c92dec595ea","resolution":{"observed_at":"2026-08-07T05:36:16.847851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.829267Z","title":"Can graph learning improve planning in llm-based agents? In The Thirty-eighth Annual Conference on Neural Information Processing Systems, 2024","venue":null,"work_id":"1b30ed3b-2ed2-4e8b-bf6d-39010b08d7dd","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.728850Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:3618107687e1dd1df4940f69347a02f8c0aa56c572cc140f0523ee5d060a5b1b","observation_id":"1d991fb0-35ef-43ac-8b4d-0d762251ead3","resolution":{"observed_at":"2026-08-07T05:36:16.834135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.814720Z","title":"3d shapenets: A deep representation for volumetric shapes","venue":null,"work_id":"b3bd9769-fecf-4b79-a170-c28419e65af4","year":1912},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.732697Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:c02dbfbf7872a803daf73fd94ee9e6e8a37ace816826f8c815807dbf0fe80797","observation_id":"2548339c-b73b-4fa1-af65-6be55726c9a3","resolution":{"observed_at":"2026-08-07T05:36:16.819142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.737268Z","title":"Next-qa: Next phase of question-answering to explaining temporal actions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.737268Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:3fa29cfe0a92df3f416dbea9440dbafe092c461bc4eedb45b6c6e96fc33ed739","observation_id":"2ae6169d-5f76-4e1c-8488-ab0d4516dd1c","resolution":{"observed_at":"2026-08-07T05:36:15.737268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13063","last_updated":"2024-03-17T04:38:48Z","snapshot_observed_at":"2026-07-06T15:45:39.649725Z","submitted_at":"2023-06-22T17:31:44Z","title":"Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13063","snapshot_observed_at":"2026-08-07T05:36:15.741481Z","title":"Can llms express their un- certainty? an empirical evaluation of confidence elicitation in llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.741481Z"},"links":{"cited_paper":"/paper/2306.13063","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:e57591582c2b9e828a195d212df83704ebe28f0199d657c6541df96cba0a6bcd","observation_id":"68d2ece3-1225-4022-bb25-888c3f0296f0","resolution":{"observed_at":"2026-08-07T05:36:15.741481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.793059Z","title":"Video question answer- ing via gradually refined attention over appearance and mo- tion","venue":null,"work_id":"9e9faa12-e431-460c-b33b-73932c7a68a2","year":2017},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.745559Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:b712bbeaaf6eaa43de47eb4c1a8f660e47ce8971e21b0062560fa142d6227191","observation_id":"d77d7aba-9da5-4367-b1f5-502704668300","resolution":{"observed_at":"2026-08-07T05:36:16.797287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:15.749730Z","title":"Msr-vtt: A large video description dataset for bridging video and language","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.749730Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:ac98c4bb9d08528b4c5a512f427aae9f712fa12bb6b79facb3b57c6ea80a96a1","observation_id":"17999f8c-8899-4ab5-b676-2c98cabc63c4","resolution":{"observed_at":"2026-08-07T05:36:15.749730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.770475Z","title":"Pointllm: Empowering large lan- guage models to understand point clouds","venue":null,"work_id":"92d3d037-674b-41eb-8387-f7c3a140e8fb","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.753669Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:6a10e06540e3372150942ffc9a7ff3cd16233204de3d0a86849a716273200d96","observation_id":"7af7cedc-e546-45e1-930f-9a1318550ad7","resolution":{"observed_at":"2026-08-07T05:36:16.774727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.756594Z","title":"Cstr vctk corpus: English multi-speaker corpus for cstr voice cloning toolkit (version 0.92)","venue":null,"work_id":"c6ead2bb-93da-44b3-aa87-06228200cf08","year":2019},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.757713Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:4925e44caaf6e7d7a98fcd651f0cef7de8c4dc76452b729fc0c0da16f11a31db","observation_id":"094700cd-9f89-41d9-a81a-2f388c89175c","resolution":{"observed_at":"2026-08-07T05:36:16.760808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-06T13:03:19.727877Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-07T05:36:15.761382Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.761382Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:2f432a831a63deb231038c99694130514a9f86194f627acda437fe39cf1643d7","observation_id":"a5cad0f1-76b9-4ebd-a0dd-7ac05c6960c3","resolution":{"observed_at":"2026-08-07T05:36:15.761382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12226","last_updated":"2025-09-08T07:04:17Z","snapshot_observed_at":"2026-07-06T17:32:15.447061Z","submitted_at":"2024-02-19T15:33:10Z","title":"AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12226","snapshot_observed_at":"2026-08-07T05:36:15.766361Z","title":"Anygpt: Unified multimodal llm with dis- crete sequence modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.766361Z"},"links":{"cited_paper":"/paper/2402.12226","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:e2b003a45c3f401129dce2dfe87fd18331f2f7114f633aab5e1789d5158a2f6a","observation_id":"acd1e886-8c71-4176-9c05-ff8507bccb95","resolution":{"observed_at":"2026-08-07T05:36:15.766361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-07-06T15:38:39.712379Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-07T05:36:15.771552Z","title":"Video-llama: An instruction-tuned audio-visual language model for video un- derstanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.771552Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:85aafd55b845c387af20ac30ea857fca4af38daaf98872bb144e96cf6805be48","observation_id":"45cee82c-6fd7-4084-85f8-f5d2d5618ef3","resolution":{"observed_at":"2026-08-07T05:36:15.771552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.742553Z","title":"Approaching outside: scaling unsupervised 3d object detec- tion from 2d scene","venue":null,"work_id":"49457ff4-4bb5-435a-a1c5-a15c4ba7a2b1","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.775728Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:0f3ad71a95467b38f32703d8b6e7f03639f9bc586c857dfc3e510fff7e9bf81b","observation_id":"7611bbc7-6cac-430a-b7d1-240cca9eed78","resolution":{"observed_at":"2026-08-07T05:36:16.747296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00619","last_updated":"2024-10-08T14:13:38Z","snapshot_observed_at":"2026-08-04T02:27:20.841925Z","submitted_at":"2024-08-01T15:01:07Z","title":"Harnessing Uncertainty-aware Bounding Boxes for Unsupervised 3D Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00619","snapshot_observed_at":"2026-08-07T05:36:15.779306Z","title":"Harnessing uncertainty-aware bounding boxes for unsuper- vised 3d object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.779306Z"},"links":{"cited_paper":"/paper/2408.00619","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:d1ec610e690038e3b28623ff5b796e2d1bb7cde0cc6093817a0ebb30d4f731a6","observation_id":"50519c5e-2aab-46ab-9f8b-fea6a440e93e","resolution":{"observed_at":"2026-08-07T05:36:15.779306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11919","last_updated":"2024-11-28T13:35:56Z","snapshot_observed_at":"2026-07-06T19:52:11.774784Z","submitted_at":"2024-11-18T04:06:04Z","title":"VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11919","snapshot_observed_at":"2026-08-07T05:36:15.783537Z","title":"Vl- uncertainty: Detecting hallucination in large vision-language model via uncertainty estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.783537Z"},"links":{"cited_paper":"/paper/2411.11919","citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:72ab2dfdc87afc130f336e8205c1533fb1a171e528db5a8e005f308d59c614d5","observation_id":"a5cf42fd-d216-42ae-a7d1-3d8de849d069","resolution":{"observed_at":"2026-08-07T05:36:15.783537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.728446Z","title":"Prompt highlighter: Interactive control for multi- modal llms","venue":null,"work_id":"21c64278-e5d5-4006-8644-4405757b48cd","year":2024},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.788459Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:db35eda5609fdc4ea56de5b6f0206c2ddfa155537acc972641b848a690586074","observation_id":"51bd2dbd-eea2-411e-b2b7-7b3920ad1b1b","resolution":{"observed_at":"2026-08-07T05:36:16.732868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.714397Z","title":"As a result, any fluctuation in answers of LMM directly reflects its uncertainty","venue":null,"work_id":"4e812b64-bd7b-454b-ab48-ce6e937e162e","year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.792698Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:6a61febe0aa316eeeb998e9534b1c52240f29040d7aaa1be0577bb77536685a0","observation_id":"bc126e85-5740-401c-b7a4-a282d1e3069e","resolution":{"observed_at":"2026-08-07T05:36:16.719241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.698267Z","title":"We conduct experiments with 18 benchmarks","venue":null,"work_id":"32f0de35-71da-43c8-b4ba-e1fb84628bc5","year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.797322Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:3b9508d1a7a389978ae3dcc4675f9e9736942175a5491a914b2fcb7784fc54ad","observation_id":"59e14804-32b7-419f-aa1b-2e1e6a5dc455","resolution":{"observed_at":"2026-08-07T05:36:16.703460Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.682050Z","title":"We report the ablation of text clustering methods (see Tab","venue":null,"work_id":"f9b44dad-bbf7-4675-ad77-37d636602819","year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.801877Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:cbed041297d1c3f7969d2e5a29545f0e6a32c033a8939e31be97ed1ae62c4431","observation_id":"2c3f1bf3-685f-42ab-8bcc-49e730a33205","resolution":{"observed_at":"2026-08-07T05:36:16.687117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.667165Z","title":"Definitions and Assumptions","venue":null,"work_id":"6f0f1440-ac66-4828-af05-3961024c928e","year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.805895Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:da70362ccf4dbbc747b197977c3333f399316df92a9dd7611751507c8460cfab","observation_id":"a29543ef-6ce6-4957-a66d-3b7cd3d2b15a","resolution":{"observed_at":"2026-08-07T05:36:16.671652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.652730Z","title":"For those input prompts, the predictions from the large model is yi = M (xi), and yj = M (xj), respectively","venue":null,"work_id":"ed10ecf1-93bc-4e13-b4a5-0557eb653d28","year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.811029Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:47ab0ec22dc429613580f66e8692075da75f1a44f98c371bf56ad3f8698242fd","observation_id":"7c2f0cd5-22ec-45d7-8c1e-9acca061a8f3","resolution":{"observed_at":"2026-08-07T05:36:16.657634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.639064Z","title":"Assume the large model parameters θ are random variables with a prior distribution P (θ)","venue":null,"work_id":"ac0a6a0e-614f-4bd2-b90c-cff0d56b37f3","year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.815113Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:3be0fa4d5a16415ab6a7c5019477adab323189e7b1111031c6de0d9c2d36fc86","observation_id":"f4f9f391-c9db-42c5-93a9-ecf227b8ab9e","resolution":{"observed_at":"2026-08-07T05:36:16.643193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:36:16.625176Z","title":null,"venue":null,"work_id":"8d9ceb1a-710c-4d46-8255-1c5502baabca","year":null},"citing_paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T05:36:15.819379Z"},"links":{"citing_paper":"/paper/2506.07575"},"observation_digest":"sha256:10b1bc12f8d9fd2d9207539fd2762e193402dd78412ca708e9cd8f779097714c","observation_id":"b780146d-e00e-45f0-8537-459bcb0c434f","resolution":{"observed_at":"2026-08-07T05:36:16.629270Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07575","last_updated":"2025-06-09T09:20:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:28:03.889420Z","submitted_at":"2025-06-09T09:20:20Z","title":"Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":5,"verified_fuzzy":32},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 1 inbound Pith citation observation for arXiv:2506.07575."}