{"as_of":"2026-08-12T06:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1721e9ed7994ec9213212e310c4781d7f218ab09a3a26d9542ef78b71a7510b2","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:48:27.991615Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.03879/citation-record","integrity":"/paper/2501.03879/integrity","json":"/paper/2501.03879/citation-record.json","paper":"/paper/2501.03879"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.299681Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.299681Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:1f6cdbb4b3f096e8dbd2a25d7e95e29fa4b6115c7c0c0673131301a8a0190b6b","observation_id":"7caabb3d-d4e1-4f68-861b-bf58ef6f5024","resolution":{"observed_at":"2026-08-10T21:48:26.299681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.326484Z","title":"Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.326484Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:82da4b416018427ccaf544a4de72c4d93f7291ff6dcaca0b210a059cb7a52a9f","observation_id":"28ebce41-c479-4ab8-b236-b7c05d2523e2","resolution":{"observed_at":"2026-08-10T21:48:26.326484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.937980Z","title":"Cont: Contrastive neural text generation","venue":null,"work_id":"c5d5d712-eb35-4fff-a4ad-b670684b635d","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.412782Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:5a8808413f213f25f81e772e41abea17613b4c376d405c0223fddac693704a5d","observation_id":"c5dda510-aa6e-4ff7-a2c5-8b5fb5be5e39","resolution":{"observed_at":"2026-08-10T21:48:30.022910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.488123Z","title":"Scanqa: 3d question answering for spatial scene understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.488123Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:e0a482fea11c4d2358d7fc2eecfba080712ce1e1b6d43e27a9757db3020aa135","observation_id":"4544a78f-ec8a-402b-be71-47c7dc93a570","resolution":{"observed_at":"2026-08-10T21:48:26.488123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-10T21:48:26.493104Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.493104Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:b3deb9ccc80939eab1a0cfad79c8610ac7839293301ca4cfb769ebfd0944894a","observation_id":"39643184-a576-4313-878a-6e3b146a9551","resolution":{"observed_at":"2026-08-10T21:48:26.493104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.497897Z","title":"and Lavie, A","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.497897Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:45b2690e8c2ac23277afe5c0251ee3a6516d9d9a0663cb87add305a64030bf4b","observation_id":"b3ec04d4-1ab7-4e72-9ce2-914c5a704194","resolution":{"observed_at":"2026-08-10T21:48:26.497897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.900637Z","title":"Grit-vlp: Grouped mini-batch sampling for efficient vision and language pre-training","venue":null,"work_id":"a38718a3-de7f-4448-a7cf-8ceda7f07955","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.502062Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:cf3d0363ce9dbcfc6c7597f4ca5f83002f84c46c3966dcb3034a9bd3965d8fb9","observation_id":"f4e59d8f-8d44-4172-a68a-2e01e8c3d7ad","resolution":{"observed_at":"2026-08-10T21:48:29.905724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.885707Z","title":"3djcg: A unified framework for joint dense captioning and visual grounding on 3d point clouds","venue":null,"work_id":"15cb89b3-1587-4ea8-8e57-c2ba1ebb4009","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.507494Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:fe4ce75cadf3a8af87f991945294fbf518847eaf4e26be4e5501b236292a31d5","observation_id":"061659df-143b-4e1a-a067-f22cde328c0c","resolution":{"observed_at":"2026-08-10T21:48:29.890286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.511972Z","title":"Honeybee: Locality-enhanced projector for multimodal llm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.511972Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:dad0a47c126ae479b6522d8c1c631c3e06ec3eb30015697142860ec1870bdd58","observation_id":"58c0e82d-72e7-4b58-b13f-3e571313d597","resolution":{"observed_at":"2026-08-10T21:48:26.511972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-11T21:14:03.563893Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-10T21:48:26.516664Z","title":"X., Funkhouser, T., Guibas, L., Hanrahan, P., Huang, Q., Li, Z., Savarese, S., Savva, M., Song, S., Su, H., et al","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.516664Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:206e96e18ca4729d22b26e4d2eff88cd1722e07b309d865731ab54ecbc73eb3e","observation_id":"02c7370e-0322-4994-8a03-7d385b3e04a6","resolution":{"observed_at":"2026-08-10T21:48:26.516664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12501","last_updated":"2024-02-19T20:08:48Z","snapshot_observed_at":"2026-08-12T03:14:43.213847Z","submitted_at":"2024-02-19T20:08:48Z","title":"Your Vision-Language Model Itself Is a Strong Filter: Towards High-Quality Instruction Tuning with Data Selection","version":1},"cited_work":{"arxiv_id":"2402.12501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12501","snapshot_observed_at":"2026-08-10T21:48:28.426535Z","title":"Your Vision-Language Model Itself Is a Strong Filter: Towards High-Quality Instruction Tuning with Data Selection","venue":"cs.CL","work_id":"e2bd35f1-cb45-4291-a3e6-3b5ac4a4405d","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.521483Z"},"links":{"cited_paper":"/paper/2402.12501","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:6cf50dd43e2918005375c65eb847b82cfd6db4d67b6b01984920b37fc8e0da75","observation_id":"7df4fa98-be40-457d-ad55-7d4b71e5b948","resolution":{"observed_at":"2026-08-10T21:48:28.523336Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.813710Z","title":"Language conditioned spatial relation reasoning for 3d object grounding","venue":null,"work_id":"7b884bfa-1177-4e7e-af29-53268f02cd10","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.526612Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:e67b013b6fd26413042557f2c574bb6f54764c3a9a6b25d262946bc070925ab9","observation_id":"5aea0609-a8fe-4bbe-8601-51c7b4d4024a","resolution":{"observed_at":"2026-08-10T21:48:29.864146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.564674Z","title":"End-to-end 3d dense captioning with vote2cap-detr","venue":null,"work_id":"35e9d989-5f4c-46e2-9abb-bdeb8dfc56d3","year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.531253Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:2f52633060b1f302ad9e477d5093c4dfdfecba09a33caeed7de3e86c6322c886","observation_id":"b6a28f74-a71e-4415-b5bf-2c2b18e0eaa1","resolution":{"observed_at":"2026-08-10T21:48:29.720330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.549379Z","title":"Ll3da: Visual interactive instruction tuning for omni-3d understanding reasoning and planning","venue":null,"work_id":"77ece7e2-2612-4982-af38-61d1959ac5c2","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.535032Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:cb5cb0a09d6cddcd32a6b40ffcfb422989d0b73dab666c5a71427f4811fcc4a3","observation_id":"1fd03218-e748-4830-b514-92384b7218c4","resolution":{"observed_at":"2026-08-10T21:48:29.554510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.533624Z","title":null,"venue":null,"work_id":"46a8dca0-57be-46d2-92fc-9911d7f00d64","year":2021},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.539263Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:15f3e7e133969d9838e70abce2af2ddf68dd3cbc2c65f1e2ac6334d78b6c3729","observation_id":"145c03e3-412e-4a79-8156-34b84d87e749","resolution":{"observed_at":"2026-08-10T21:48:29.538747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.560131Z","title":"X., Savva, M., Halber, M., Funkhouser, T., and Nie ner, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.560131Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:52a890b652b672620dc1435b890e510872fe7a1405a3f996dc43368a8700f1ae","observation_id":"f4da19a2-90a8-40c3-a8c2-25888ab2d987","resolution":{"observed_at":"2026-08-10T21:48:26.560131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.645925Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.645925Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:b02a7dbb9835270452a9f7fa2ba9dc86ae7f396b552d4c57994ced2799c8fa6a","observation_id":"c17274ca-4ed9-412d-a532-054b95dfbd63","resolution":{"observed_at":"2026-08-10T21:48:26.645925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T21:48:26.739675Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.739675Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:258e1bd3791e2438f77833501cdf4faf0638700cef724d149d35aae5db69ca43","observation_id":"ad0e20be-64a3-4286-a225-c710568559c1","resolution":{"observed_at":"2026-08-10T21:48:26.739675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11401","last_updated":"2024-03-22T18:52:51Z","snapshot_observed_at":"2026-08-06T11:39:56.281668Z","submitted_at":"2024-03-18T01:18:48Z","title":"Scene-LLM: Extending Language Model for 3D Visual Understanding and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11401","snapshot_observed_at":"2026-08-10T21:48:26.868837Z","title":"Scene-llm: Extending language model for 3d visual understanding and reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.868837Z"},"links":{"cited_paper":"/paper/2403.11401","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:d3bc3f82d2e8bf3b9ee5bec172e433dcdc0c699aca735a1fde42b2d38394d076","observation_id":"9d84bc00-778c-479e-9640-4fe393d8eaad","resolution":{"observed_at":"2026-08-10T21:48:26.868837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:26.983771Z","title":"Detecting and preventing hallucinations in large vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.983771Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:54f1d87c4c557b46588a5d857ce735ed00476648c7d69b6299abc5f7de006d9e","observation_id":"f8df9538-ca08-4f60-9c78-fe46812253a5","resolution":{"observed_at":"2026-08-10T21:48:26.983771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00615","last_updated":"2023-09-01T17:59:47Z","snapshot_observed_at":"2026-08-10T23:05:27.308529Z","submitted_at":"2023-09-01T17:59:47Z","title":"Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00615","snapshot_observed_at":"2026-08-10T21:48:26.988637Z","title":"Point-bind & point-llm: Aligning point cloud with multi-modality for 3d understanding, generation, and instruction following","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.988637Z"},"links":{"cited_paper":"/paper/2309.00615","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:762b8ad191e276fa20fb954e1424bbd3d3bbf03aef794e82eaec82388d5af1b9","observation_id":"ea930fc1-ced0-4f12-be11-471d0703ff7e","resolution":{"observed_at":"2026-08-10T21:48:26.988637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-10T21:48:26.993391Z","title":"and Gimpel, K","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.993391Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:ab09cd87ee4174e462ba84b5d528d86edefee551a7c25f98ec98ebaed6e1bb07","observation_id":"e859bf68-a441-466b-bb1a-8bb872b246af","resolution":{"observed_at":"2026-08-10T21:48:26.993391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07691","last_updated":"2024-03-14T07:47:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T14:34:08Z","title":"ORPO: Monolithic Preference Optimization without Reference Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07691","snapshot_observed_at":"2026-08-10T21:48:26.999401Z","title":"Reference-free monolithic preference optimization with odds ratio","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:26.999401Z"},"links":{"cited_paper":"/paper/2403.07691","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:6e0c63b7b2be5932c60e96e0e99bb2e697fa072fae7af1e87f42f0387d008ef3","observation_id":"0b64bf11-b2d3-44e6-86ce-e42c6d310600","resolution":{"observed_at":"2026-08-10T21:48:26.999401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.004600Z","title":"3d-llm: Injecting the 3d world into large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.004600Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:a32e0258f195899705f2cce08e14f976f9b5d83d14e43358db081650397f0e4e","observation_id":"7376d52c-1cb0-44c5-9887-e4ce9f99f5a9","resolution":{"observed_at":"2026-08-10T21:48:27.004600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08168","last_updated":"2024-09-28T03:56:28Z","snapshot_observed_at":"2026-08-07T17:07:05.445620Z","submitted_at":"2023-12-13T14:27:45Z","title":"Chat-Scene: Bridging 3D Scene and Large Language Models with Object Identifiers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08168","snapshot_observed_at":"2026-08-10T21:48:27.009762Z","title":"Chat-3d v2: Bridging 3d scene and large language models with object identifiers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.009762Z"},"links":{"cited_paper":"/paper/2312.08168","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:e030d1c0fc3b815ab32bc14da841cd421146fb766692fca2fac1aad7cd865336","observation_id":"907e174d-fdc8-404d-b5db-bf8aa789b7cb","resolution":{"observed_at":"2026-08-10T21:48:27.009762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.477284Z","title":"An embodied generalist agent in 3d world","venue":null,"work_id":"0ee933a9-1ba1-4885-bcbf-9cff6665e75f","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.016074Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:8c2bb1a91e64330dab00feb61b136d58c80a632ea0ac3b02a6861f1e07bd66ec","observation_id":"2e352672-3fe9-440d-a04c-1a09de14c71c","resolution":{"observed_at":"2026-08-10T21:48:29.482609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01185","last_updated":"2023-05-02T22:46:46Z","snapshot_observed_at":"2026-07-06T13:59:11.954611Z","submitted_at":"2022-10-03T18:56:35Z","title":"ContraCLM: Contrastive Learning For Causal Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01185","snapshot_observed_at":"2026-08-10T21:48:27.021444Z","title":"U., Wang, Z., Nan, F., Li, X., Tan, M., Nallapati, R., Ray, B., Bhatia, P., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.021444Z"},"links":{"cited_paper":"/paper/2210.01185","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:a258b02bdd9575cde3caf6f7ed649dc2ab87e78288ec484e3ec4f6a1c46215fa","observation_id":"3223d6d8-4d8b-42ed-9e74-c8927c15f0bf","resolution":{"observed_at":"2026-08-10T21:48:27.021444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.409060Z","title":"Bootstrapping vision-language learning with decoupled language pre-training","venue":null,"work_id":"3a0cfebe-0e8a-4f59-8500-f10491a8a58d","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.027081Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:8dc7d7e7757b9b7e207819b002c6126cbd7a65a7e4f8b78704f1da22bc4beb85","observation_id":"5dbdaa2f-3a25-43b1-bba3-fee4c827c489","resolution":{"observed_at":"2026-08-10T21:48:29.466528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-10T21:48:27.031550Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.031550Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:3d2f389de64ef25f5864d262eb6cfef8d03d927ccb840bbed8d0ba94031f2965","observation_id":"1c5137e5-da9c-4bdd-a37b-3bb79772401c","resolution":{"observed_at":"2026-08-10T21:48:27.031550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.241890Z","title":"L., Bansal, M., and Liu, J","venue":null,"work_id":"6d92a34e-3963-4422-93de-9443ca147eac","year":2021},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.036655Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:6468582950e0d339ff1d9f1abfeced4ed88edeb9f86081bb4e62ac24b3eb7b09","observation_id":"a140425f-c0ec-4903-bb9c-f2ebc5b204b0","resolution":{"observed_at":"2026-08-10T21:48:29.328687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.041603Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.041603Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:c542f16e4b959afd5b0f55bdf3d7f2310dd9b7eaf50c45fcb5c928a5fc3cf119","observation_id":"dd2380ff-9970-4e35-b715-792e8b8a58dc","resolution":{"observed_at":"2026-08-10T21:48:27.041603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.046499Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.046499Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:db67debce4090967fc4e46bd2db0c5ccaf87d10a75919ecd5ac022cd0296973f","observation_id":"8973470f-ca4b-4455-970a-b1deae07e9e5","resolution":{"observed_at":"2026-08-10T21:48:27.046499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.051330Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.051330Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:793b52fc78949f58fd1744ab5739eff4112945dea2f1686e6ac9c46274454f38","observation_id":"e123e7a5-7e1b-4075-b8fc-c3f094ac7ab0","resolution":{"observed_at":"2026-08-10T21:48:27.051330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.055940Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.055940Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:3c1c22bd428c1ddb6dc08bac6285feae352ea76155cce6dd8a353ed95c0d4246","observation_id":"c36d4596-e9ec-49f7-8339-257f67e36e31","resolution":{"observed_at":"2026-08-10T21:48:27.055940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.102283Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.102283Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:1e1fd827279ee3f007fa9b6e9321282ed36475166b7088fbfd46d4f01f450503","observation_id":"3c8d95ce-90f6-4eef-a3e4-a1655c2120a7","resolution":{"observed_at":"2026-08-10T21:48:27.102283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16804","last_updated":"2022-03-31T05:19:38Z","snapshot_observed_at":"2026-08-11T09:00:18.563346Z","submitted_at":"2022-03-31T05:19:38Z","title":"BRIO: Bringing Order to Abstractive Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16804","snapshot_observed_at":"2026-08-10T21:48:27.273833Z","title":"Brio: Bringing order to abstractive summarization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.273833Z"},"links":{"cited_paper":"/paper/2203.16804","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:fa122fa1a0003504710202ca5cd730eefbb8cfd3ddfd2cf122b69997a7e72827","observation_id":"2bf68995-3482-4df4-9bd3-4d0af9823717","resolution":{"observed_at":"2026-08-10T21:48:27.273833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.176706Z","title":"Scalable 3d captioning with pretrained models","venue":null,"work_id":"604ce98d-37bc-45df-b236-0226d9bfbfe3","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.361679Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:17c143a5bdb9f4b8b039ae48276dbd297ee6797384f653237efbc94ffe222c43","observation_id":"89810cc6-6a75-4756-8b18-e1e3dfc206eb","resolution":{"observed_at":"2026-08-10T21:48:29.182024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07474","last_updated":"2023-04-12T20:05:41Z","snapshot_observed_at":"2026-08-11T02:19:20.093098Z","submitted_at":"2022-10-14T02:52:26Z","title":"SQA3D: Situated Question Answering in 3D Scenes","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07474","snapshot_observed_at":"2026-08-10T21:48:27.366951Z","title":"Sqa3d: Situated question answering in 3d scenes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.366951Z"},"links":{"cited_paper":"/paper/2210.07474","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:a5b9c5593dfe062143eea19a48a09f6dea8619b80a0950778a4ca393624f35c6","observation_id":"f7ae0f13-03a1-47e9-829e-8ac4747cb558","resolution":{"observed_at":"2026-08-10T21:48:27.366951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.371627Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.371627Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:658e45fbdf54ab7272099b6cfb9417c6be3242e6c1fbbb610c7d18d5557398b4","observation_id":"35b73b15-5ec6-4e12-8b32-ba45471de13d","resolution":{"observed_at":"2026-08-10T21:48:27.371627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.376225Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.376225Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:98c6255f4c6556110e2903e12223b361da7019911246393d6704b1e2833e5f8c","observation_id":"928d637c-e913-4640-8b28-6d859f480fc4","resolution":{"observed_at":"2026-08-10T21:48:27.376225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.141013Z","title":"Advances and perspectives in collaborative robotics: a review of key technologies and emerging trends","venue":null,"work_id":"7fac11be-1a98-4cdd-9edd-c7f87a83c6d7","year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.382201Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:084f51c0aae137be9be151b8d246592947f90fce6dad767bb7aa697238c8b1d1","observation_id":"3427e288-41f0-49fb-9630-8abe245c45c3","resolution":{"observed_at":"2026-08-10T21:48:29.146144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:29.012828Z","title":"Gpt4point: A unified framework for point-language understanding and generation","venue":null,"work_id":"57cca9b4-80d4-468f-a7f4-95edb8c9948a","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.386676Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:8cd767049f6ab4539b24ec775a44a45f132712f7010627db1ebfff310a176e48","observation_id":"e670e6fb-7f3d-439a-93d0-ad706ff61bbb","resolution":{"observed_at":"2026-08-10T21:48:29.130662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-10T21:48:27.390781Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.390781Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:5d33979ae87ef3e8aff908d2a7ffd4eebe0dd6ff47d9ae287b8922f9d69ce9ee","observation_id":"49129600-0c70-4aa3-9c67-81cba00d6ca3","resolution":{"observed_at":"2026-08-10T21:48:27.390781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-10T21:48:27.396273Z","title":"and Gurevych, I","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.396273Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:a58c6bdf8edc7a7f2bdebc42d7edd55ef5f56f8472e5fc673b0d53f404059da4","observation_id":"db0175b4-dbc8-485c-9f06-88a481c24751","resolution":{"observed_at":"2026-08-10T21:48:27.396273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04592","last_updated":"2021-01-24T22:19:30Z","snapshot_observed_at":"2026-08-07T09:28:19.837584Z","submitted_at":"2020-10-09T14:18:53Z","title":"Contrastive Learning with Hard Negative Samples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04592","snapshot_observed_at":"2026-08-10T21:48:27.401731Z","title":"Contrastive learning with hard negative samples","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.401731Z"},"links":{"cited_paper":"/paper/2010.04592","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:cd5f41230e4d7883befdcdf39204d1d8be416a3b30428baec6b39e9cced992d0","observation_id":"a3a3e04d-15ba-490d-9a09-9e0cbe665b3b","resolution":{"observed_at":"2026-08-10T21:48:27.401731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.773547Z","title":"Language-grounded indoor 3d semantic segmentation in the wild","venue":null,"work_id":"774e21ba-1901-4597-a969-64c21dd9777a","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.406669Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:c1e3ccff331b4087a450238de561c2de8918be2ccb697f2638faf80c34764728","observation_id":"c194bf40-4a57-43aa-84ed-fd85486b768d","resolution":{"observed_at":"2026-08-10T21:48:28.881270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18654","last_updated":"2025-02-28T00:26:42Z","snapshot_observed_at":"2026-08-04T21:04:25.264907Z","submitted_at":"2024-05-28T23:36:00Z","title":"Mitigating Object Hallucination in MLLMs via Data-augmented Phrase-level Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18654","snapshot_observed_at":"2026-08-10T21:48:27.485988Z","title":"\\\"O ., and Pfister, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.485988Z"},"links":{"cited_paper":"/paper/2405.18654","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:2be1dd577a831061d5b67e6fee7ca236341e96c0329b9f3a15b48691ce382086","observation_id":"9604f3b8-9588-4a8f-be45-cda265433c89","resolution":{"observed_at":"2026-08-10T21:48:27.485988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.758118Z","title":"and Koustoumpardis, P","venue":null,"work_id":"80c19f67-5b4c-4f12-9fa4-41cfd8d4cce9","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.490780Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:a8ef9463212edb720c405f22f36dfedb58c48e9552247eecd8a15d8fef2b36e3","observation_id":"cd0d7682-2547-4068-8473-29de6317ac55","resolution":{"observed_at":"2026-08-10T21:48:28.762830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-10T21:48:27.495110Z","title":"S., Love, J., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.495110Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:e688d91def0d0fcf72aa706b3904a2f4c96b8db7a20de7602f1ee4c58f36dc03","observation_id":"87f6535b-a278-4a92-89d1-09822afc238d","resolution":{"observed_at":"2026-08-10T21:48:27.495110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T21:48:27.500267Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.500267Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:d0afa3e322be80b481ae464e8abe4db315c5eb0f37919efde3b7c93794d6eab5","observation_id":"07420348-b81c-40ef-b3e2-05140a782ec9","resolution":{"observed_at":"2026-08-10T21:48:27.500267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.505942Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.505942Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:80245ded91b05e9a1fe06b677c012c7815d846751c7a41d972b971b8b680ed1a","observation_id":"58a3ea3a-ffe9-4441-879a-153a3195a736","resolution":{"observed_at":"2026-08-10T21:48:27.505942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.514505Z","title":"Cider: Consensus-based image description evaluation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.514505Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:c55441062761524b6631c821ea099c5b0a0cc1a7f2a6928c3c62afe92da6c4ba","observation_id":"3a5a071a-e59f-4a71-87e7-90787dbc6bae","resolution":{"observed_at":"2026-08-10T21:48:27.514505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08769","last_updated":"2023-08-17T03:52:15Z","snapshot_observed_at":"2026-08-08T07:19:32.263241Z","submitted_at":"2023-08-17T03:52:15Z","title":"Chat-3D: Data-efficiently Tuning Large Language Model for Universal Dialogue of 3D Scenes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08769","snapshot_observed_at":"2026-08-10T21:48:27.520318Z","title":"Chat-3d: Data-efficiently tuning large language model for universal dialogue of 3d scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.520318Z"},"links":{"cited_paper":"/paper/2308.08769","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:e1c2e5b84d7eb042ea8b500d08cb5c4a88c7d4d92b943446e3d99a59ce7a6832","observation_id":"ffedf3cc-2089-4b54-bbf4-ba1ef83e7434","resolution":{"observed_at":"2026-08-10T21:48:27.520318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16911","last_updated":"2024-09-06T22:45:43Z","snapshot_observed_at":"2026-08-12T01:26:03.061612Z","submitted_at":"2023-08-31T17:59:46Z","title":"PointLLM: Empowering Large Language Models to Understand Point Clouds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16911","snapshot_observed_at":"2026-08-10T21:48:27.526667Z","title":"Pointllm: Empowering large language models to understand point clouds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.526667Z"},"links":{"cited_paper":"/paper/2308.16911","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:655786b5d5240770e36e3b663de1c641657ab4fa5cd2ad3b43dfbd56bdaa5058","observation_id":"0e08e82a-1f50-4ed4-9adc-c01f18a53f3b","resolution":{"observed_at":"2026-08-10T21:48:27.526667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11138","last_updated":"2024-06-06T06:03:34Z","snapshot_observed_at":"2026-08-11T20:00:29.511001Z","submitted_at":"2024-02-17T00:09:32Z","title":"Contrastive Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2402.11138","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11138","snapshot_observed_at":"2026-08-10T21:48:28.088388Z","title":"Contrastive Instruction Tuning","venue":"cs.CL","work_id":"4bd95202-694a-4939-8182-21d853c1e41a","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.531725Z"},"links":{"cited_paper":"/paper/2402.11138","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:e0a6e7ebd9149cf047ae898662d6e0768b1e68d4c29fb0d5fa62e6773e93d498","observation_id":"6c7ee131-1dec-4813-9179-a90a076da1d4","resolution":{"observed_at":"2026-08-10T21:48:28.094689Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05132","last_updated":"2025-03-20T23:06:14Z","snapshot_observed_at":"2026-08-05T02:21:47.865084Z","submitted_at":"2024-06-07T17:59:59Z","title":"3D-GRAND: A Million-Scale Dataset for 3D-LLMs with Better Grounding and Less Hallucination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05132","snapshot_observed_at":"2026-08-10T21:48:27.536522Z","title":"F., and Chai, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.536522Z"},"links":{"cited_paper":"/paper/2406.05132","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:3341e5072a18eb85d9151082fa0c9e49e8ce5525aab746cf21e300e3fae9ec24","observation_id":"ba4c14e4-3ec0-4d57-bf35-ae7e34aae2ce","resolution":{"observed_at":"2026-08-10T21:48:27.536522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.722331Z","title":"Point-bert: Pre-training 3d point cloud transformers with masked point modeling","venue":null,"work_id":"32e0f8cd-5aee-4417-8652-65b0189e8eb6","year":2022},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.541148Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:f7d7d1b235870382319487a594ccaeadc99212748007257e6e918e74650846d0","observation_id":"db07c3f3-5494-432e-ac24-3b5949de8334","resolution":{"observed_at":"2026-08-10T21:48:28.727456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08487","last_updated":"2024-06-14T00:52:35Z","snapshot_observed_at":"2026-08-11T01:31:43.600162Z","submitted_at":"2024-06-12T17:59:49Z","title":"Beyond LLaVA-HD: Diving into High-Resolution Large Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08487","snapshot_observed_at":"2026-08-10T21:48:27.570775Z","title":"Beyond llava-hd: Diving into high-resolution large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.570775Z"},"links":{"cited_paper":"/paper/2406.08487","citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:cc2e49c0b0e3905b5d0ba22ebb701d1c6b83dd36365c3813b91a4c45d7eeb8ab","observation_id":"b9ef01a3-a29c-4a5e-9094-8278d42682ff","resolution":{"observed_at":"2026-08-10T21:48:27.570775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.705802Z","title":"Click: Controllable text generation with sequence likelihood contrastive learning","venue":null,"work_id":"e0ba59a1-b79c-4e92-a8ea-d50c44e6bafa","year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.680548Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:c176d85daa529b33451069d32bb39033a7195f390b392a10710aaf08cfc18052","observation_id":"5a483eb4-e3cf-4bbd-a352-220337543f0c","resolution":{"observed_at":"2026-08-10T21:48:28.711424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.688916Z","title":"Lima: Less is more for alignment","venue":null,"work_id":"94de45ce-3b30-4f8c-ac96-afed87db38cf","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.761673Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:46cc192ed1080d76add0716aa4f2b6d5f13f6779295b87029d3976918bf3f6c0","observation_id":"dafc9267-fc16-4791-b6cb-f08ed2f099e4","resolution":{"observed_at":"2026-08-10T21:48:28.694638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:28.672657Z","title":"Uni3d: Exploring unified 3d representation at scale","venue":null,"work_id":"77c90979-e181-43f7-aef9-d8de5656b515","year":2024},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.875113Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:3d2a32ec6b5157ac01c1ac010fa0dcf9309e7875657863459e45c1dfa172ec33","observation_id":"e06730dc-7927-4c02-9466-83cc0853dad0","resolution":{"observed_at":"2026-08-10T21:48:28.678174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:48:27.991615Z","title":"3d-vista: Pre-trained transformer for 3d vision and text alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T21:48:27.991615Z"},"links":{"citing_paper":"/paper/2501.03879"},"observation_digest":"sha256:45eeb70131fa54cf64d7e409da46c45ba21d7af9963d4c27d4a75358182d17b8","observation_id":"1e48be94-5faf-4e68-b0cf-6d361b8977aa","resolution":{"observed_at":"2026-08-10T21:48:27.991615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.03879","last_updated":"2025-01-07T15:42:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T01:26:25.176273Z","submitted_at":"2025-01-07T15:42:32Z","title":"CL3DOR: Contrastive Learning for 3D Large Multimodal Models via Odds Ratio on High-Resolution Point Clouds"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":42,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2501.03879."}