{"as_of":"2026-08-06T07:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b5b5d884bd9f342b4086ea3884d6b64fd2df00cb34ca001568b5e3286d02dccc","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:29:12.064221Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.11490/citation-record","integrity":"/paper/2604.11490/integrity","json":"/paper/2604.11490/citation-record.json","paper":"/paper/2604.11490"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transactions of the Association for Computational Linguistics9, 1116– 1131 (2021)","venue":null,"work_id":"afd32e8a-b805-4592-aaa4-e9b29208d93f","year":2021},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:879ea92d4c4bddd50e0407c88382f9036b4dd33eaed93443803f78acf818b06a","observation_id":"8742ba98-00be-4462-bee1-66fd38998ab7","resolution":{"observed_at":"2026-05-17T15:09:49.213328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.882","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Measuring and Modeling ``Culture'' in LLM s: A Survey","venue":null,"work_id":"26c61d5c-9baa-4da7-b243-46bb902d5316","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:b11aca3dcbc966c38d8771a98caf1870421143db091ab39818e27e9b94b86423","observation_id":"b1014503-ab7d-4c3a-bf5b-b2d250493e7b","resolution":{"observed_at":"2026-05-10T16:30:35.274815Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T09:08:05.565223+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T09:08:05.565223+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Potdar, S., Rojas- Barahona, L., Montella, S","venue":null,"work_id":"5d3d372b-6cd3-4c19-9586-f4b0c6c2ccd2","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:4a281a2c72953f7bed20ea4767dbdd20a436fb726fedbfef9a80d4ea2fdc913e","observation_id":"1e8fd00d-bb46-4a9d-995d-aeeafa066038","resolution":{"observed_at":"2026-05-17T15:09:49.220161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":"2410.07073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-07-04T13:59:52.216141Z","title":"Pixtral 12B","venue":"cs.CV","work_id":"9ad2b071-82d8-4cfa-b994-b9975094b575","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:958ff262bccd1a43acf72f73783c38ef47aabd558d2d1842ab30220e62baf0af","observation_id":"7a562fed-3eaa-4354-90fa-1d00945940ed","resolution":{"observed_at":"2026-05-14T23:53:29.932651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07112","last_updated":"2024-12-10T01:57:17Z","snapshot_observed_at":"2026-07-06T20:04:20.826875Z","submitted_at":"2024-12-10T01:57:17Z","title":"Maya: An Instruction Finetuned Multilingual Multimodal Model","version":1},"cited_work":{"arxiv_id":"2412.07112","doi":"10.48550/arxiv.2412.07112","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07112","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2412.07112 , year =","venue":"arXiv (Cornell University)","work_id":"d94e98e1-943a-4ba3-a3d9-cab6f21756ea","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2412.07112","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:ba8de5b7a731c6445b9e712e052cd3c5594462229d4c5224400420eebb85fcda","observation_id":"b0c569c3-4146-434d-95df-ff076306f829","resolution":{"observed_at":"2026-05-11T08:50:57.651111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.05959","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2512.05959 (2025)","venue":null,"work_id":"86b754cb-acf6-4360-82e5-663571983896","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:352a71892d6b91442774ade83e0f5094e4f8d2b6cb8e5fecdc6df042bf6241fd","observation_id":"5fe3fb37-0a4a-4fac-aeff-a88e858ba7b9","resolution":{"observed_at":"2026-05-11T08:50:57.698773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"a critical analysis of globalization indices","venue":null,"work_id":"356501c7-475c-4524-ad66-d257ab9ef41e","year":2010},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:9c2c02b7b3b1302d2b84482932fecf985bbe533c2d3c56e37fceaa4d7bbf4c5e","observation_id":"3507754c-8455-4a48-9ca7-a10182b0282e","resolution":{"observed_at":"2026-05-17T15:09:49.216291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:73209249eae93ac29e584c9809f11208d2e396cc548111f5560993d05c6c9556","observation_id":"9a07494c-8dde-47ab-bec7-0d67137e3abf","resolution":{"observed_at":"2026-05-11T08:50:57.721804Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:f1068c89927d88a2b9c5c08bdcab00b167f8c69970fb658a15c6f5948f21dda5","observation_id":"c987a5c0-a9be-4ca7-90c8-2bf1cd9e5c32","resolution":{"observed_at":"2026-05-11T08:50:57.768343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13897","last_updated":"2024-09-20T20:53:22Z","snapshot_observed_at":"2026-08-03T05:09:05.950220Z","submitted_at":"2024-09-20T20:53:22Z","title":"LLM for Everyone: Representing the Underrepresented in Large Language Models","version":1},"cited_work":{"arxiv_id":"2409.13897","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.13897","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bf73a0bc-21d0-4804-9e0d-eaee0f6ed952","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2409.13897","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:0d5c9290c85aa2bd66b905ff433603fc6627a3f87df6ed2e8b2825c4de3c8eeb","observation_id":"695201e1-7ce0-4cb0-9ff4-06b0a6b3caf6","resolution":{"observed_at":"2026-05-11T08:50:57.765495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.naacl-long.274","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Chiruzzo, L., Ritter, A., Wang, L","venue":null,"work_id":"35e3c9e1-21cb-4b60-b05a-5c8eefdd6afd","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:7da9217a5f1eb7d4e1b61974ee69d8b000b97fe4bedfa94d356bd73e10e60b95","observation_id":"d5d1f712-f283-4b9b-9ac1-7612dbd60d70","resolution":{"observed_at":"2026-05-10T16:30:35.264163Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T12:43:25.257063Z","title":"In: Findings of the Association for Computational Linguistics: ACL 2023","venue":null,"work_id":"293634fd-0d50-4eda-81f1-e3f942865218","year":2023},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:76e31d4d08a707c8533482787a4769d2579b43e3cc30a7f3e4366e5f3b77bc2e","observation_id":"87d7a30c-8aff-4ecc-b880-9cd10e9d9dbc","resolution":{"observed_at":"2026-05-10T16:30:35.271406Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.ijcnlp-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Park, J.C., Arase, Y., Hu, B., Lu, W., Wijaya, D., Purwarianti, A., Krisnadhi, A.A","venue":null,"work_id":"e73bfdb8-f1b8-4f4f-8f5f-e320320aaea1","year":2023},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:f739a7736bfef113e057a914713910320330b3afd4f2e3a693e99f128caec619","observation_id":"c8fa2433-aaef-415e-aedd-e88e14f58fcd","resolution":{"observed_at":"2026-05-10T16:30:35.238138Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T01:05:12.524976Z","title":"Agent-RewardBench: Towards a unified benchmark for reward modeling across perception, planning, and safety in real- world multimodal agents","venue":null,"work_id":"1ef694be-4483-4d1c-b319-30be63d024de","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:1628002cf0523d7cb68ec2d5022f8f0e49d19036bb0ba27ea5ab693ee200ebed","observation_id":"55da768d-597b-4075-87a6-3e56a3abd3a0","resolution":{"observed_at":"2026-05-10T16:30:35.252086Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) pp","venue":null,"work_id":"006ca267-9454-45a3-ad5f-545f20d7d59b","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:7784f592cd98bc447546957c253308a97c3bb120d893599478842788f683acde","observation_id":"96000ef9-42bb-4116-afd7-ce1af17187dd","resolution":{"observed_at":"2026-05-17T15:09:49.236429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Duh, K., Gomez, H., Bethard, S","venue":null,"work_id":"27bc8c06-94c7-4996-b5f8-0ddd85099abf","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:5ca0b6d02260582d69dcdc9cdf0e9a030d2b2c3a20c3a02451a0aaa1e2aac841","observation_id":"4abaa10b-7d66-4db8-8418-b9dfb17489fc","resolution":{"observed_at":"2026-05-17T15:09:49.226191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.naacl-long.112","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chen Liu, Fajri Koto, Timothy Baldwin, and Iryna Gurevych","venue":null,"work_id":"4e809b25-18a8-4244-b5c2-00c959a2f84d","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:3575c57b4dea70ffdd688d018bdbda82cd1dc3fef2d64a42ce4c3e4870227540","observation_id":"84ab66fe-69c1-4223-bd3c-1a6775ee5d0f","resolution":{"observed_at":"2026-05-10T16:30:35.241210Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00698","last_updated":"2025-04-14T12:37:51Z","snapshot_observed_at":"2026-08-02T23:25:33.983019Z","submitted_at":"2025-04-01T12:08:07Z","title":"Command A: An Enterprise-Ready Large Language Model","version":2},"cited_work":{"arxiv_id":"2504.00698","doi":"10.48550/arxiv.2504.00698","metadata_source":"pith","pith_arxiv_id":"2504.00698","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Command a: An enterprise-ready large language model","venue":"cs.CL","work_id":"88710095-eaf5-456f-ae9e-2adad6a20133","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2504.00698","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:e58186114b2fc1f3aa0a4a3d5ceadfa20cc92ee85e969fc3a8bc4ba3ffd8cc5a","observation_id":"972ed5f8-3fbc-49f4-9131-085b0d4e84a7","resolution":{"observed_at":"2026-05-11T08:50:57.704041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.918971+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.918971+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dad73f0f-2bef-4993-b0bc-a3b1c22c0c65","year":2026},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:b961527b8aeb69f2df54934e9411c9ad2445d94054017ac6e401bf2fe5531c0b","observation_id":"b46e8fa1-3f37-4f4f-ba29-e9bbd254f960","resolution":{"observed_at":"2026-05-17T15:09:49.195207Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17146","last_updated":"2024-12-05T14:28:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-25T17:59:51Z","title":"Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2409.17146","doi":"10.48550/arxiv.2409.17146","metadata_source":"pith","pith_arxiv_id":"2409.17146","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models","venue":"cs.CV","work_id":"b6841af7-2b88-4597-9d0e-54e96aa7a368","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2409.17146","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:c0443210df30f99a11a1e6366bec362855b13a9d943c94d8b01f90a792890736","observation_id":"5e4c86e9-9082-4271-9169-156300307c1c","resolution":{"observed_at":"2026-05-15T01:55:12.888993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7731.2014","doi":"10.1080/14747731.2014.887389","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Globalizations11(6), 875–893 (2014).https://doi.org/ 10.1080/14747731.2014.887389,https://doi.org/10.1080/14747731.2014","venue":"Globalizations","work_id":"4a608d3b-96c2-4c5a-8149-a54a87752c9a","year":2014},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:796337736e095a2d5f0960f60d8c87891e319f9c622547aae4342399bb085cfd","observation_id":"cc6dd79e-085e-4853-a24d-1ab9c120fb33","resolution":{"observed_at":"2026-05-10T16:30:35.249130Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:cd04fa9a10e87528a135a9b541b72d78ed88b5ed214e561a89a7a0dc44cc0be1","observation_id":"4d3aae7a-df02-48fb-ae49-9504a8bf2176","resolution":{"observed_at":"2026-05-11T08:50:57.667384Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-025-09422-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T03:06:43.562716Z","title":"doi: 10.1038/s41586-025-09422-z","venue":"Nature","work_id":"9835b482-5032-4135-93dd-82a066677569","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:ebdacdfe334c954e7928a160df2ebdbbf07da3535ce6ad61131ac699560fe992","observation_id":"e7512bdd-bcff-41e9-9451-be779eac4797","resolution":{"observed_at":"2026-05-10T16:30:35.316888Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:21.094896+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:21.094896+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05237","last_updated":"2025-06-04T10:07:57Z","snapshot_observed_at":"2026-08-03T04:20:15.211547Z","submitted_at":"2024-12-06T18:14:24Z","title":"MAmmoTH-VL: Eliciting Multimodal Reasoning with Instruction Tuning at Scale","version":2},"cited_work":{"arxiv_id":"2412.05237","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.05237","snapshot_observed_at":"2026-07-04T19:40:07.154168Z","title":"Mammoth-vl: Eliciting multimodal reasoning with instruction tuning at scale","venue":null,"work_id":"6b851c4c-d27c-4e39-aadd-a27efd45cfd9","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2412.05237","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:727d5e684e2633e3fdba5db5f36c28232eb63d6b06f341d5159f6a6200bd06d9","observation_id":"0f5eeb8b-5a5a-402f-8a76-d3fcc9128ac7","resolution":{"observed_at":"2026-05-11T08:50:57.788020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11558-019-09344-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Review of International Organizations14(3), 543–574 (Jan 2019)","venue":"The Review of International Organizations","work_id":"ad6ed208-9a03-4512-8c6e-f9acc17ca2eb","year":2019},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:bed971253ddb3bc8291b48955f1ed09fffb7e33b13e9ac9d4a2a16778760d147","observation_id":"b58938e2-308a-47b5-8405-a190fffb729b","resolution":{"observed_at":"2026-05-10T16:30:35.292813Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-07-11T04:03:04.326208+00:00","source":"paper_reference_links","state":"open"},"event_date":"2019-05-01","event_type":"correction","notice_doi":"10.1007/s11558-019-09357-x","provenance":{"observed_at":"2026-07-11T03:08:20.052529+00:00","source":"crossref","source_record_id":"10.1007/s11558-019-09357-x->10.1007/s11558-019-09344-2:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1515/jbnst-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jahrbücher für Nationalökonomie und Statistik240(5), 691–696 (Sep 2019).https://doi.org/10.1515/jbnst- 2019- 0045,http://dx.doi.org/10","venue":null,"work_id":"e70e36d4-9857-4dd5-97d7-e6225b7c8202","year":2019},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:7699b0c9cba6288fcccf85f9d84e57648c53ee609298a2f7138e333dce663c85","observation_id":"28e77127-593f-48d8-9be2-88a118ca21b0","resolution":{"observed_at":"2026-05-10T16:30:35.311541Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.18174","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"da855800-0ae7-4689-838b-d57b68652b20","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:abc4993a639d299b5e54f56eb44dcf50ac608a0db109c4d20ffd8fb00d63dfc1","observation_id":"d9b6508b-d97b-4fca-bbd4-688be948f260","resolution":{"observed_at":"2026-05-11T08:50:57.632970Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e349330e-6a70-4932-8279-f2d3b61dfc37","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:68b1c28269988c1610b1a3551de344da9f0e3df6864e620875fdf04a62785d53","observation_id":"968d19ff-0134-4777-a9e7-376bde42575f","resolution":{"observed_at":"2026-05-17T15:09:49.223121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"10685–10706 (2024)","venue":null,"work_id":"beb437e8-880c-4881-a507-41f06a957b03","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:498a5a3398f70e6f53aca4ddd8b37987ff1fc699d8db8eca71ca3a6ef0d30790","observation_id":"4d772c29-e661-4242-9b12-b5f0f75c61ea","resolution":{"observed_at":"2026-05-17T15:09:49.233151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19103","last_updated":"2024-11-28T12:38:42Z","snapshot_observed_at":"2026-08-04T12:27:16.242461Z","submitted_at":"2024-11-28T12:38:42Z","title":"VARCO-VISION: Expanding Frontiers in Korean Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2411.19103","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.19103","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c83e50be-1b75-48c0-83d8-25fd91d755d5","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2411.19103","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:fb4e0ceee4be09b4a693ecdf63575baf63fa745b352158440448809d121080fc","observation_id":"579ef28e-9638-4b05-bd0d-dbb1829f3b4d","resolution":{"observed_at":"2026-05-11T08:50:57.757159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-acl.525","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Rogers, A., Boyd-Graber, J., Okazaki, N","venue":null,"work_id":"5f498ba6-a1b6-4fb1-a0b6-4802a85be339","year":2023},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:b5bd7700023f9ddac2cbe9be260c636e8270d6dddbb146e4c4165198f6f66cb8","observation_id":"70c150e6-259d-4058-9bc5-58d45315d42f","resolution":{"observed_at":"2026-05-10T16:30:35.308366Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"10685–10706 (2024)","venue":null,"work_id":"946d73a6-1657-4359-b971-5da0a418e8b6","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:08f0296ccc84e8b004a6215089a376d2bf058ba98dcca98aecd950a2d9cbe814","observation_id":"6a52ece6-d3c6-49c2-baf6-47567a0df746","resolution":{"observed_at":"2026-05-17T15:09:49.229831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.wmt-1.55","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Command-A-Translate: Raising the Bar of Machine Translation with Difficulty Filtering","venue":null,"work_id":"2b51b5c2-e075-4185-a0e2-ad957979b2be","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:842ebc59fc545d6c18f583b0a336d53199c01cee619965e70c7091937ddfd0a3","observation_id":"fb513f9e-9dfd-4ace-b407-817f7b69d970","resolution":{"observed_at":"2026-05-10T16:30:35.301797Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the ACM SIGOPS 29th Symposium on Operating Systems Principles (2023)","venue":null,"work_id":"00425924-e417-411f-94b6-b23f98e447e0","year":2023},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:a710c5270c995e817513ebcba3f175fda237d04e7a66018f1781933a513d4010","observation_id":"559fbc19-00da-4d75-b1fb-3949ee6e3ec1","resolution":{"observed_at":"2026-05-17T15:09:49.201697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3a6e9414-6ace-46fd-854e-ee9d781bcb2b","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:3be0e4c55b10557030c763f7546d7d9a30491519cff616d236c1b79a98813d30","observation_id":"5e777762-82f4-4b82-8eb4-ce6771878f93","resolution":{"observed_at":"2026-05-17T15:09:49.210234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/tacl_","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:55:04.802904Z","title":"Transactions of the Association for Computational Linguistics7, 452–466 (2019).https://doi.org/10.1162/tacl_ a_00276,https://aclanthology.org/Q19-1026/","venue":null,"work_id":"a17912dd-b6c9-4c49-8b20-e27bb4fa6d69","year":2021},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:0d5ee58fda8847c13aa6ff2b02db78cd6f1af04f3bc958338d01ac82524d365d","observation_id":"802e1916-0f5b-4658-abb2-8388fb96bbfe","resolution":{"observed_at":"2026-05-10T16:30:35.305272Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:647f7275733b84c237ff2a5402b4f240ddac77203a4dcee240244d9cf7625187","observation_id":"e89f278a-7972-42e0-bef9-6851ebc2a15d","resolution":{"observed_at":"2026-05-10T16:30:35.298372Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.296","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Al-Onaizan, Y., Bansal, M., Chen, Y.N","venue":null,"work_id":"2454f251-6315-4c75-abc3-315ee0e51d74","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:107216c8c3eb0345547515258d977ba213d741320902e3d5b91731cd3408b33d","observation_id":"73f0d701-7eaa-4623-8c1d-8f678d4c7059","resolution":{"observed_at":"2026-05-10T16:30:35.286473Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"34f34991-ec13-40c4-9df3-3c60d1c2a78d","year":null},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:1875df2364bbcac707eccc090f6061f4ada5c243df59ede96be3c0073177c69d","observation_id":"cf95e986-3d6e-468a-9ec8-819304cfb5e8","resolution":{"observed_at":"2026-05-17T15:09:49.198272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0f14357d-9bc3-4ad3-92e8-959f2ce3983f","year":2009},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:f5e1ea6602af5043ec6959a67c5068aa246796993904fd302f8619478d5d28a3","observation_id":"bef32612-5c3e-4781-8bf2-dabeb893ea49","resolution":{"observed_at":"2026-05-17T15:09:49.207360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: The Thirty-eight Conference on Neural Information Processing Systems Datasets and Benchmarks Track (2024), https://openreview.net/forum?id=E18kRXTGmV","venue":null,"work_id":"9dbbb1a5-dfff-4695-bf5c-a5256487bd23","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:13f5a70994a16e5b390bb388b49cc2f38def30071d5268a360cdd2fad91481ce","observation_id":"9ac1976f-ef14-404c-b708-8dbc5d80b9eb","resolution":{"observed_at":"2026-05-17T15:09:49.239658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Sawaf, H., El-Beltagy, S., Zaghouani, W., Magdy, W., Abdelali, A., Tomeh, N., Abu Farha, I., Habash, N., Khalifa, S., Keleg, A., Haddad, H., Zitouni, I., Mrini, K., Almatham, R","venue":null,"work_id":"f04c1770-96d3-4418-afa1-7e3f1a3886c4","year":2023},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:1064222c1690ef5083f53fda77426a3fd93c467f2b7e8b639defb868378218df","observation_id":"9c719297-2019-4ae2-a545-97b3e6b92ffe","resolution":{"observed_at":"2026-05-17T15:09:49.204700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Ku, L.W., Martins, A., Srikumar, V","venue":null,"work_id":"c99fff8b-2e42-434c-8516-0aa8274d6471","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:8aca26850ca4aace63a64670788c552ad6c401eae1348527a741c3670810812d","observation_id":"28484c41-f456-47d2-a18c-0a769a072f5d","resolution":{"observed_at":"2026-05-17T15:09:49.189017Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Inui, K., Sakti, S., Wang, H., Wong, D.F., Bhattacharyya, P., Banerjee, B., Ekbal, A., Chakraborty, T., Singh, D.P","venue":null,"work_id":"e20ac7c4-c8c3-4b3a-90c0-61992d108392","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:060b3db30ab0374c9c792f6099dfb2cd6388c823310e217efd6af2cc23b58805","observation_id":"8f5c7c3c-299f-4dbb-82fd-4d0b413eb303","resolution":{"observed_at":"2026-05-17T15:09:49.192384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.02266","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"org/abs/2602.02266","venue":null,"work_id":"3a5a0b6d-38b1-4969-ac1e-815d5a447bf2","year":2026},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:443203ee2d93235a0c6838ce93ed2cfbac7d76092fdb9af6a8489db9d967d044","observation_id":"8b6973b5-f6e3-4e8d-b287-fa7aedbbdfba","resolution":{"observed_at":"2026-05-11T08:50:57.752667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T09:07:47.009935Z","title":"Xu, Huazuo Gao, Deli Chen, Jiashi Li, Wangding Zeng, Xingkai Yu, Y","venue":null,"work_id":"f30bdb61-5994-46dd-a4d7-2d320a1917e0","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:f0eb5c8c6c9c46d98504b0050be47d2bd7fe13ca695ed0ada5e505d92a3633f1","observation_id":"0c1dfec2-95a6-49be-a93b-0e0d64514939","resolution":{"observed_at":"2026-05-10T16:30:35.278472Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:37:03.093376Z","title":"In: Christodoulopoulos, C., Chakraborty, T., Rose, C., Peng, V","venue":null,"work_id":"e6d6ecae-3575-45e2-8c99-76359a926a1a","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:179ddbe6e981b961f2ebd36a3324fc59df65f6fb19351d1553e68a277272b3cd","observation_id":"dfb49b56-8b16-4d06-a344-31cf9efe23ac","resolution":{"observed_at":"2026-05-10T16:30:35.261052Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-03T20:08:10.343755+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T20:08:10.343755+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.isprsjprs.2022.04.018","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ISPRS Journal of Photogram- metry and Remote Sensing188, 301–313 (2022).https://doi.org/https: //doi.org/10.1016/j.isprsjprs.2022.04.018,https://www.sciencedirect","venue":"ISPRS Journal of Photogrammetry and Remote Sensing","work_id":"ba33f2c5-268b-4d67-a133-874eecbf3568","year":2022},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:4cd666cebaef03e3ad869d8629d1cb4c883c9d28233158bf4892887b2c90b5f4","observation_id":"51a6e72d-2873-4ae8-8038-b69b8d5732e1","resolution":{"observed_at":"2026-05-10T16:30:35.289638Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"88676d45-3af1-48f8-ac08-d65fe3e131d3","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:f6e72ad0b88adf9cdfa6e6207fb0bdd5e939392f313ece140a820a9f44830dd9","observation_id":"509f4462-7580-43e5-8fb4-93a3db6eae24","resolution":{"observed_at":"2026-05-17T15:09:49.183044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8dd0d010-a4c2-4aab-a1d5-c4cecdaacb58","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:d2fef0a6513beb70238d72e4cd1fe25b765fa0cbcc85123d8f0390b9f479279d","observation_id":"b9cc2d46-b093-403b-a52c-adad6ae3067e","resolution":{"observed_at":"2026-05-17T15:09:49.185952Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"cited_work":{"arxiv_id":"2412.03555","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03555","snapshot_observed_at":"2026-07-10T13:27:05.580089Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","venue":"cs.CV","work_id":"dc984d60-8996-44cb-8163-88e7526073b7","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2412.03555","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:8bf82919996b9522be5072a5a7212cfaae9a5c503c8512b2120681362823edc8","observation_id":"d1e7e7c1-286c-44be-8ba8-c64b3a133520","resolution":{"observed_at":"2026-05-15T09:15:08.030466Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:c733ab40e6893d8afce11ca0484f00682c06c4f46ce806fdab257c8320130534","observation_id":"000c9926-6430-4c67-b160-76acbedfc58f","resolution":{"observed_at":"2026-05-11T08:50:57.709465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":"2503.19786","doi":"10.1007/978-3-540-48085-3_36","metadata_source":"pith","pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma 3 Technical Report","venue":"cs.CL","work_id":"f93e08bf-9e96-409b-8ac6-b8385fd17fd7","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:5a970a0d3f3314ccccb52ac72464102910c7615c29f2b94777e51a07db528153","observation_id":"bfc02b94-6519-45c5-9620-d0d7670c4fce","resolution":{"observed_at":"2026-05-11T08:50:57.677744Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":"2207.04672","doi":"10.18653/v1/w19-5207","metadata_source":"pith","pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","venue":"cs.CL","work_id":"68c8336c-d20e-40fa-ba9c-89459da6fc1a","year":2022},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:c9f1db2006febb67caf5623918502929d9305bcdfc8f78d04e8f2213fd3f1a45","observation_id":"20bed22c-58ea-4451-ba56-b81f3ac03e16","resolution":{"observed_at":"2026-05-12T17:54:14.284800Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Gu, J., Fu, T.J.R., Hudson, D., Celikyilmaz, A., Wang, W","venue":null,"work_id":"e83a6d0a-30e7-4d1a-9fac-c1ac3dbffa51","year":null},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:c161a3019c74a8a9aed59535b2aa04554ac1d90891e3651d96aa4c0c3519caef","observation_id":"b7369303-7fe5-4504-9ca5-c0c20cd7f8cb","resolution":{"observed_at":"2026-05-17T15:09:49.180245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.alvr-1.15","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"https://doi.org/10.18653/v1/2024.alvr-1.15,https://aclanthology.org/ 2024.alvr-1.15/","venue":null,"work_id":"e6cb7381-fa8f-4a4b-b9af-12047a2b168c","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:2dd7a6d7f5e31b6ea1cc5407ac7fdb1c6916f5e0f611df3ed0adb6bcd19b6926","observation_id":"67e8db99-6267-4f17-abe5-ca8753db86bb","resolution":{"observed_at":"2026-05-10T16:30:35.257920Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02538","last_updated":"2025-02-04T15:41:27Z","snapshot_observed_at":"2026-08-03T05:46:28.445899Z","submitted_at":"2024-11-04T19:17:17Z","title":"MILU: A Multi-task Indic Language Understanding Benchmark","version":3},"cited_work":{"arxiv_id":"2411.02538","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02538","snapshot_observed_at":"2026-06-30T13:34:40.335071Z","title":"arXiv preprint arXiv:2411.02538 (2025) Anthropogenic Regional Adaptation 25","venue":null,"work_id":"7f4f6763-dd14-40e9-a40a-e2af036210b8","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2411.02538","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:fc5136b0dde40f5f37cf092a63ccb187222368d635881c8034566ce967106495","observation_id":"55434b8e-5527-42b2-8866-ece0f42016d5","resolution":{"observed_at":"2026-05-11T08:50:57.760900Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.34133/remotesensing.0439","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Journal of Remote Sensing5(Jan 2025).https://doi.org/10.34133/remotesensing.0439,http://dx.doi.org/ 10.34133/remotesensing.0439","venue":"Journal of Remote Sensing","work_id":"886dadf8-ba49-4c8a-bde5-b74878dff0c2","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:d0bad5f74f8a88a45483aad03dc53d5f20bb6f4cfbe08994135198502a99f36d","observation_id":"88cf2950-5005-4c07-9903-a095d53f4700","resolution":{"observed_at":"2026-05-10T16:30:35.282293Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"5997–6023 (2024)","venue":null,"work_id":"580030d5-76c5-4ac1-a9ad-efadb1c15110","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:5a495ef347a10f38143ad8d31f9a86fdf1aa680abf1c65c7f6a31f31998bfdb6","observation_id":"bbf90e00-5ee8-4d51-b840-9f2e77536487","resolution":{"observed_at":"2026-05-17T15:09:49.169412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:ba955c0474873660eabae49a8613f3f647c95f56482cce58fe060c24c63edaef","observation_id":"21a51bc0-5640-43ce-b3d5-40787168f2bf","resolution":{"observed_at":"2026-05-11T08:50:57.640983Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":"2503.05236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.05236","snapshot_observed_at":"2026-07-04T16:59:58.010213Z","title":"Unified Reward Model for Multimodal Understanding and Generation","venue":"cs.CV","work_id":"bf9fcf9a-1781-4008-960e-2bec1a717e4e","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2503.05236","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:a2df7469a8b05bca47c976011dcbade33266b808bbf42a06c276f73189f0d4e5","observation_id":"04f7a972-8436-4afe-bf59-e9313957176f","resolution":{"observed_at":"2026-05-14T00:44:31.060111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.eacl-main.57","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Vlachos, A., Augenstein, I","venue":null,"work_id":"142e0d23-596a-4664-891f-09d64f823854","year":2023},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:79d2666238cee0185169790bf3fab8d879f59b9a3bc1130eeb9426f22c5d865c","observation_id":"a6e836e9-c7d5-4655-b983-38f1f4bb4926","resolution":{"observed_at":"2026-05-10T16:30:35.244267Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 2025 Conference of the Nations of the Americas Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers)","venue":null,"work_id":"ab0ba8a2-cbcd-4bde-8966-1a8f9d4f2ee0","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:4d66d2f12971520ff33c82214cd24d2d5c31252c26a1ebf497d54023366cff2e","observation_id":"486450ca-997c-4626-9f58-d62852ad3ab8","resolution":{"observed_at":"2026-05-17T15:09:49.172970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14133","last_updated":"2024-05-23T03:12:49Z","snapshot_observed_at":"2026-07-06T18:18:16.530605Z","submitted_at":"2024-05-23T03:12:49Z","title":"Automated Loss function Search for Class-imbalanced Node Classification","version":1},"cited_work":{"arxiv_id":"2405.14133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14133","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2405.14133 (2024)","venue":null,"work_id":"42c3d79f-6469-4697-a74b-0f2fe1fbee71","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2405.14133","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:bf98b7a66280a7bd1c1d8c2154644d452c9b60237ef0e9728fee49892bfda5ea","observation_id":"02d051bb-5dc1-407e-bb42-ff24ad739095","resolution":{"observed_at":"2026-05-11T08:50:57.733504Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-07-06T15:43:07.989730Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2306.09341","doi":"10.48550/arxiv.2306.09341","metadata_source":"pith","pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","venue":"cs.CV","work_id":"40702548-f094-4c67-a5db-a62f426f852e","year":2023},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:3d75d2d0ee43e0f614df9f1150c4763c4f0ea9b932fb21c5b9f6b9dec2cd9513","observation_id":"a0bad713-08ae-4f0d-aeb1-11dfeff4429c","resolution":{"observed_at":"2026-05-11T08:50:57.674091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21059","last_updated":"2026-01-05T02:39:01Z","snapshot_observed_at":"2026-08-03T02:30:08.318253Z","submitted_at":"2024-12-30T16:24:09Z","title":"VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation","version":4},"cited_work":{"arxiv_id":"2412.21059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.21059","snapshot_observed_at":"2026-07-03T00:07:27.977777Z","title":"VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation","venue":"cs.CV","work_id":"63f252a7-e52d-4e87-b849-d1375bee5b37","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2412.21059","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:64473d39d289877e741b4055ad712cb01033bd74e6b0e8ac2a5002dbd5d6056c","observation_id":"e05836b2-5c94-47ac-af7f-1c3503b08eaa","resolution":{"observed_at":"2026-05-16T11:49:14.981353Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T11:26:12.522093Z","title":"Advances in Neural Information Processing Systems36, 15903–15935 (2023)","venue":null,"work_id":"8bcc6308-ca9b-42c4-af19-2d9d269fdc45","year":2023},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:b358b0f382f5dbe6f7f3b11de20cb616db0a6aa97425fc4eefd423fe371cdad8","observation_id":"e33cecd4-3bd8-4029-b71f-a5576ea972c0","resolution":{"observed_at":"2026-05-17T15:09:49.176688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16153","last_updated":"2025-01-26T15:34:59Z","snapshot_observed_at":"2026-07-06T19:37:11.636987Z","submitted_at":"2024-10-21T16:19:41Z","title":"Pangea: A Fully Open Multilingual Multimodal LLM for 39 Languages","version":3},"cited_work":{"arxiv_id":"2410.16153","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.16153","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2410.16153 , year=","venue":null,"work_id":"8b6ef530-72dc-4459-b47b-711096aef295","year":2024},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"cited_paper":"/paper/2410.16153","citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:2d29bd5637922d9a77a370b312bd940f4d1dd795f028ea50d1117898b4a49bba","observation_id":"384d92b7-c210-41f1-b194-5b6b93429485","resolution":{"observed_at":"2026-05-11T08:50:57.745735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7269.4569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What is this?","venue":null,"work_id":"1602a2c4-2eb7-46e9-a279-24fb37d2921c","year":2025},"citing_paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-10T16:29:12.064221Z"},"links":{"citing_paper":"/paper/2604.11490"},"observation_digest":"sha256:985a6ebb9a8ce711ecc825fcea1a4b08b91720e8c71b8025b90b2777f70f064d","observation_id":"cd53b458-c25b-4b1d-8503-4ef903756327","resolution":{"observed_at":"2026-05-11T08:50:57.694639Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.11490","last_updated":"2026-04-16T23:50:04Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T22:59:54.573362Z","submitted_at":"2026-04-13T13:56:00Z","title":"Anthropogenic Regional Adaptation in Multimodal Vision-Language Model"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":8,"metadata_mismatch":10,"parse_uncertain":0,"unresolved":7,"verified_exact":29,"verified_fuzzy":15},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2604.11490."}