{"as_of":"2026-08-06T03:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bd5f0071b8cfac14be3f2c4d01f9081f49a3c37ceb8772787a86b91cd01bd2f","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T20:39:09.547472Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16560/citation-record","integrity":"/paper/2607.16560/integrity","json":"/paper/2607.16560/citation-record.json","paper":"/paper/2607.16560"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-01T20:39:06.564102Z","title":"Qwen-vl: A versatile vision-language model for understand- ing, localization, text reading, and beyond.arXiv preprint arXiv:2308.12966, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:06.564102Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:d5ccb50802da9754522685ecdb32682351a048429217cdffe5d745253082e6de","observation_id":"b6370be1-f2e6-496c-96ab-0f152c60a0ac","resolution":{"observed_at":"2026-08-01T20:39:06.564102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-01T20:39:06.645877Z","title":"Mech- anistic interpretability for ai safety–a review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:06.645877Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:488c5da20dda587846771262871c7a79dc7c30b475b63886808e04ac48187609","observation_id":"ddd883f7-a2f9-483e-aeee-277f5a72baca","resolution":{"observed_at":"2026-08-01T20:39:06.645877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-01T20:39:06.772075Z","title":"On the oppor- tunities and risks of foundation models.arXiv preprint arXiv:2108.07258, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:06.772075Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:fe5c0c868550e3848fbe7280c9ff4773c45b26e37db3d441353deed5a5afb76c","observation_id":"6341219d-f45c-42f8-a5c8-d99f5f848c3b","resolution":{"observed_at":"2026-08-01T20:39:06.772075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:06.835553Z","title":"Naver: A neuro-symbolic compositional automaton for visual grounding with explicit logic reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:06.835553Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:2df5f496f8f0cef36419ac76f128b269cdecd3829b7a558e097d19cd126adedc","observation_id":"ba6e7d4b-65b8-4aa5-99ca-55a3650d28d2","resolution":{"observed_at":"2026-08-01T20:39:06.835553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:06.906540Z","title":"Pseudo-simulation for autonomous driving.arXiv preprint arXiv:2506.04218, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:06.906540Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:077dd63a74107ea94cb33e2ba27b8b0d07d4b367f57504b7b3e08e338acf878c","observation_id":"a029ce34-3216-4be3-9c22-9898a5cc8d9c","resolution":{"observed_at":"2026-08-01T20:39:06.906540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:07.064783Z","title":"Position: Stop reactively patching your model every time and start proactive test-driven ai development","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:07.064783Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:c86ecdc2b9ffbdf6a62faad547a738b71eb44dc9a6f6ac82de3156685043b8c7","observation_id":"6da47c53-639f-4dc1-8160-2fc2505cda46","resolution":{"observed_at":"2026-08-01T20:39:07.064783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:07.287462Z","title":"M3- embedding: Multi-linguality, multi-functionality, multi-granularity text embeddings through self- knowledge distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:07.287462Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:e788a7671a04d790366b69eaf1b9451241305e10c18161b1634b4d88d0dfcdbb","observation_id":"1a95ce16-5371-44a3-ae0a-9d2f00bc1cc8","resolution":{"observed_at":"2026-08-01T20:39:07.287462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-01T20:39:07.479298Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodal- ity, long context, and next generation agentic capabilities.arXiv preprint arXiv:2507.06261, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:07.479298Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:d80a3c1545ace0b030efb81603ec91e1514e07f6cf8d135c342b52994d69f6d4","observation_id":"c4937fba-4a44-4124-ad81-1fcd8da99c51","resolution":{"observed_at":"2026-08-01T20:39:07.479298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:07.564588Z","title":"NAVSIM: Data-driven non-reactive au- tonomous vehicle simulation and benchmarking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:07.564588Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:ff8f92ee0574a8dcf3118bcad249e7dd2264ad8f5939348bc920230e0399b992","observation_id":"f93ac6a2-d9f3-499f-8771-4984b5bc4fb2","resolution":{"observed_at":"2026-08-01T20:39:07.564588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-01T20:39:07.728361Z","title":"Toy models of superposition.arXiv preprint arXiv:2209.10652, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:07.728361Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:d58b173ad3937e61947bc0201e7ae2c8ec51d7b10a76410b5879d5a359208e36","observation_id":"73eeddb1-494d-4cea-ae68-f6407cbbc1cf","resolution":{"observed_at":"2026-08-01T20:39:07.728361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:07.872921Z","title":"Martin.Speech and Language Processing: An Introduction to Natural Language Processing, Computational Linguistics, and Speech Recognition","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:07.872921Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:119e52d34ac7b762a04156b56daca76a8c1f024260d2e8e80b0fbf9e5f361e7f","observation_id":"4210c4ee-601b-4965-a6c2-51d5139a78a8","resolution":{"observed_at":"2026-08-01T20:39:07.872921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:07.974982Z","title":"Explainability and vision foundation models: A survey.Information Fusion, 122:103184, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:07.974982Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:b257f64f704912b16deb9ceedd3454574591970559701c52d64f8c4589c70b21","observation_id":"3e286aa5-4700-4adb-9762-0bb2304cf2b9","resolution":{"observed_at":"2026-08-01T20:39:07.974982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:08.084115Z","title":"Sekai: A video dataset towardsworldexploration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:08.084115Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:5a182ac578111398dd08ae0faf14bd83c9bc8c3010b3d676fc470beeaf8e0e51","observation_id":"9af9f28d-d6af-4ad8-a238-29f561323f8c","resolution":{"observed_at":"2026-08-01T20:39:08.084115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:08.189469Z","title":"A comprehensive survey and guide to multimodal large language models in vision–language tasks","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:08.189469Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:eccf1125ef0353e9eafca345a7f58d5afb8ee171a4bfd14e128452b1a29647be","observation_id":"46e624d3-fb2d-40d6-918f-28ddee78c860","resolution":{"observed_at":"2026-08-01T20:39:08.189469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:08.305294Z","title":"Visual instruction tuning.Ad- vances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:08.305294Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:ecf6d6d3a30d649880b1bc17ec066f2ba37f2ef446ab29669faa37063f91688c","observation_id":"f7d81587-0c32-4dec-b440-5a500e4093d0","resolution":{"observed_at":"2026-08-01T20:39:08.305294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:08.456014Z","title":"Manning and Hinrich Schütze","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:08.456014Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:24228a5652355e0005bb1c607aea66e16832a5c4ac7a2795b222cb5f77f91cb3","observation_id":"c9306c13-a683-403b-b310-863933464145","resolution":{"observed_at":"2026-08-01T20:39:08.456014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:08.678816Z","title":"Enhancing reason- ing capabilities of llms via principled synthetic logic corpus.Advances in Neural Information Processing Systems, 37:73572–73604, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:08.678816Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:07f5688b5e88e1e1260f73f823b7d75b210e3e89ac9c44ed3cd92126c413f536","observation_id":"989f026c-a2fa-4a8d-b1ea-8d39a9d7fcc2","resolution":{"observed_at":"2026-08-01T20:39:08.678816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:08.818158Z","title":"PhysicalAI–Autonomous Vehicles","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:08.818158Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:7e5a2f0ee1ea3f6fa4b55eddc1bfb3be61e5fc809b49a84d5b890ca473a8df57","observation_id":"baa1a07b-d015-4da9-a7cf-d5aed76c9761","resolution":{"observed_at":"2026-08-01T20:39:08.818158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:09.091749Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:09.091749Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:b38c8af2bf16d5bdb564c6e30dbe7460de575b7131b3ec057a6286ff6780fd2b","observation_id":"54d91eb4-a59e-4fe9-b88a-33af79ec88a1","resolution":{"observed_at":"2026-08-01T20:39:09.091749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:09.163877Z","title":"Sse: Multimodal semantic data selection and enrichment for industrial-scale data assimilation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:09.163877Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:7ca7838f64b4dc45ca60b3c9a0682e457112047e32edb6993851212a616c5c8f","observation_id":"02b5a29d-ebd6-4d6a-a0f5-b91953833842","resolution":{"observed_at":"2026-08-01T20:39:09.163877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:09.283159Z","title":"Winoground: Probing vision and language models for visio-linguistic composition- ality","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:09.283159Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:1715147515fdf41d93d0211e6988016499890b8a05db459ac53053201959e2a4","observation_id":"96c48ab9-f19f-4006-8c37-eda66d59e661","resolution":{"observed_at":"2026-08-01T20:39:09.283159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:09.446835Z","title":"Scalable parallel prompting for complex av video captioning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:09.446835Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:6a26f11d47f6ff6b62a57fe8bda9f91f39444c3cc02660808913d7740ddb79fc","observation_id":"6490c17d-7445-47f7-9de5-f5432f0e9a4f","resolution":{"observed_at":"2026-08-01T20:39:09.446835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-01T20:39:09.547472Z","title":"there\"or","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:09.547472Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:0816b1406e7a95e6ea0650a7940bcb7e31ad556e4043c26d84b83587501f6821","observation_id":"51174ffd-5566-43cb-97ef-8249c08996d5","resolution":{"observed_at":"2026-08-01T20:39:09.547472Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T20:39:08.968462Z","title":"Accessed July 16, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T20:39:08.968462Z"},"links":{"citing_paper":"/paper/2607.16560"},"observation_digest":"sha256:cef9f0acad91a408f2a1bcdc4c8165b05fa46e7fc7a92a26af2d2ccaae1d83c0","observation_id":"2e816ba3-5546-4c9a-8afb-7bbccc080456","resolution":{"observed_at":"2026-08-01T20:39:08.968462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16560","last_updated":"2026-07-18T00:08:47Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-01T20:39:05.810046Z","submitted_at":"2026-07-18T00:08:47Z","title":"From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2607.16560."}