{"as_of":"2026-08-17T23:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b16ffafbb72cab1bb7c02b618e7d32147b982f64701c18c9038865f013fe844a","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:56:36.560558Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:07:11.291329Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T10:39:45.683109Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11454","snapshot_observed_at":"2026-08-06T21:07:11.291329Z","title":"Humanibench: A human-centric frame- work for large multimodal models evaluation.arXiv preprint arXiv:2505.11454, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00951","last_updated":"2025-07-12T02:50:17Z","snapshot_observed_at":"2026-08-08T07:11:19.635744Z","submitted_at":"2025-07-01T16:52:25Z","title":"Thinking Beyond Tokens: From Brain-Inspired Intelligence to Cognitive Foundations for Artificial General Intelligence and its Societal Impact","version":3},"reference_index":165,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:11.291329Z"},"links":{"cited_paper":"/paper/2505.11454","citing_paper":"/paper/2507.00951"},"observation_digest":"sha256:6e54b4c4f3eb16a2fc19d3389d2295a262b874d22986d8c0356b62f278e6b574","observation_id":"904389fe-4f4b-4d0a-996e-bf3b301bc515","resolution":{"observed_at":"2026-08-06T21:07:11.291329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"cited_work":{"arxiv_id":"2505.11454","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.11454","snapshot_observed_at":"2026-07-04T10:39:45.683109Z","title":"Humanibench: A human-centric framework for large multimodal models evaluation","venue":"cs.CV","work_id":"24f56d51-3c22-46ab-b5ce-5f0d257ce030","year":2025},"citing_paper":{"arxiv_id":"2605.19846","last_updated":"2026-05-23T07:31:13Z","snapshot_observed_at":"2026-08-02T22:01:11.866294Z","submitted_at":"2026-05-19T13:40:26Z","title":"FineBench: Benchmarking and Enhancing Vision-Language Models for Fine-grained Human Activity Understanding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T06:08:12.887394Z"},"links":{"cited_paper":"/paper/2505.11454","citing_paper":"/paper/2605.19846"},"observation_digest":"sha256:4ac59703a8e7ca766941cdc7b502aebb63a15d4ff6c1503659754674e6ce82e3","observation_id":"df950149-bd4b-4bbf-9d84-453a627bc8c0","resolution":{"observed_at":"2026-06-23T02:12:31.774149Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"cited_work":{"arxiv_id":"2505.11454","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.11454","snapshot_observed_at":"2026-07-04T10:39:45.683109Z","title":"Humanibench: A human-centric framework for large multimodal models evaluation","venue":"cs.CV","work_id":"24f56d51-3c22-46ab-b5ce-5f0d257ce030","year":2025},"citing_paper":{"arxiv_id":"2605.19846","last_updated":"2026-05-23T07:31:13Z","snapshot_observed_at":"2026-08-02T22:01:11.866294Z","submitted_at":"2026-05-19T13:40:26Z","title":"FineBench: Benchmarking and Enhancing Vision-Language Models for Fine-grained Human Activity Understanding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T07:59:57.488107Z"},"links":{"cited_paper":"/paper/2505.11454","citing_paper":"/paper/2605.19846"},"observation_digest":"sha256:9f2b5db506527ead745de63a6c7b4a54c2517366f8d4359a6a38b7d5c5580e3a","observation_id":"2aa59ca8-09c9-4443-820e-42cc715d7ac3","resolution":{"observed_at":"2026-06-23T02:12:31.774149Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"cited_work":{"arxiv_id":"2505.11454","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.11454","snapshot_observed_at":"2026-07-04T10:39:45.683109Z","title":"Humanibench: A human-centric framework for large multimodal models evaluation","venue":"cs.CV","work_id":"24f56d51-3c22-46ab-b5ce-5f0d257ce030","year":2025},"citing_paper":{"arxiv_id":"2605.19846","last_updated":"2026-05-23T07:31:13Z","snapshot_observed_at":"2026-08-02T22:01:11.866294Z","submitted_at":"2026-05-19T13:40:26Z","title":"FineBench: Benchmarking and Enhancing Vision-Language Models for Fine-grained Human Activity Understanding","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T18:09:49.178090Z"},"links":{"cited_paper":"/paper/2505.11454","citing_paper":"/paper/2605.19846"},"observation_digest":"sha256:ad519b3ca219b3de765fc6440d803ec4310cca8ef5f00c9780e3a272d323e185","observation_id":"4aa9a3f8-c033-4922-815c-3175ab7eb789","resolution":{"observed_at":"2026-06-30T18:14:59.987363Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"cited_work":{"arxiv_id":"2505.11454","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.11454","snapshot_observed_at":"2026-07-04T10:39:45.683109Z","title":"Humanibench: A human-centric framework for large multimodal models evaluation","venue":"cs.CV","work_id":"24f56d51-3c22-46ab-b5ce-5f0d257ce030","year":2025},"citing_paper":{"arxiv_id":"2606.23412","last_updated":"2026-06-22T14:36:26Z","snapshot_observed_at":"2026-08-13T10:22:57.438550Z","submitted_at":"2026-06-22T14:36:26Z","title":"UnBias-Plus: Detect, Explain, and Rewrite Bias","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-26T08:36:43.971617Z"},"links":{"cited_paper":"/paper/2505.11454","citing_paper":"/paper/2606.23412"},"observation_digest":"sha256:8f5de0db20554a57628531fdf9956c37abb8257333d8a6dafd833fc2855a92fa","observation_id":"f3fada0c-467d-44fc-901d-cfb3864dccdb","resolution":{"observed_at":"2026-07-04T10:39:45.684449Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.11454/citation-record","integrity":"/paper/2505.11454/integrity","json":"/paper/2505.11454/citation-record.json","paper":"/paper/2505.11454"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-14T03:45:52.225630Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-15T20:56:36.293779Z","title":"Phi-4 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.293779Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:831f2d8873f1c68ec7cffd614cb866acd095f55f9c3fd924e41963c6c1f9cf98","observation_id":"2f6a15e5-1834-440e-a3f2-0082b8f5cd1c","resolution":{"observed_at":"2026-08-15T20:56:36.293779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.688901Z","title":"Regulation(eu)2024/2847oftheeuropeanparliament and of the council","venue":null,"work_id":"869ed5aa-ed1d-4762-90bf-5574c9d7c391","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.298839Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:1a1d1b8b7353860f873dacc6eb2410fc6e5267187ea20e0f2668f06de32177f0","observation_id":"99d90d81-3a26-4a38-bcc8-49c671ed14df","resolution":{"observed_at":"2026-08-15T20:56:37.692656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.678314Z","title":"High-levelexpertgrouponartificialintelligence","venue":null,"work_id":"1cd11460-3088-48b6-8ce6-919054fe5a40","year":2019},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.303008Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:9a766babef4dfaa0df10a253b0bbca6c1f55008022491f6a93ae35347a7a641e","observation_id":"f05a3a29-2d47-496d-b9ce-3d2af0ca012c","resolution":{"observed_at":"2026-08-15T20:56:37.682284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.668057Z","title":"Artificial intelligence risk management framework (ai rmf 1.0)","venue":null,"work_id":"21dea8a6-1009-423c-918e-e6ab8c89f58f","year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.306640Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:84856227c4f35c2fe73765d8cfd8aebcd3c9439f0eaa75d3440c88d08555f133","observation_id":"4e9471be-baa2-4638-b8da-5a62af170912","resolution":{"observed_at":"2026-08-15T20:56:37.671550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-15T20:56:36.310246Z","title":"Qwen2.5-vltechnicalreport","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.310246Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:d6b26348b742c6cc38f35f7822adc9c40e4bba21156ec42cd7ecb241c8b16754","observation_id":"7e39c924-d930-49c9-9314-d00197654a57","resolution":{"observed_at":"2026-08-15T20:56:36.310246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.657854Z","title":"Whatishuman-centeredabouthuman- centered ai? a map of the research landscape, in: Proceedings of the 2023 CHI conference on human factors in computing systems, pp","venue":null,"work_id":"900815af-a0a9-4fb1-a2d1-3397055226dc","year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.314850Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:abb24fe2e2e317b76de30f4466b2f200022a66be3a5a4f62f33a92a1d8884565","observation_id":"c9561e2e-949d-4703-a9fc-e3033a70c779","resolution":{"observed_at":"2026-08-15T20:56:37.661455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.648389Z","title":null,"venue":null,"work_id":"1fbe07b0-981d-41ce-842f-680f2e67d693","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.319137Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:63aed68073683963c3dca03f06979649b8f6ed27fbe5cb4f47ba9bf74aef46eb","observation_id":"e6d4ffd8-04bd-42d9-9d0c-d8f495e29ba7","resolution":{"observed_at":"2026-08-15T20:56:37.651701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.637827Z","title":"Internvl: Scaling up vision foundationmodelsandaligningforgenericvisual-linguistictasks,in: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"33bde945-5618-4971-884c-5383f06f5679","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.326997Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:14ecea6b01f59931cd4b5b3b7d3b7d123aa533c0092c324a87aaef15d5c8136e","observation_id":"2230e95e-4be8-459e-962b-b475e53246dc","resolution":{"observed_at":"2026-08-15T20:56:37.641573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.628200Z","title":"Fairness in large language models:Ataxonomicsurvey","venue":null,"work_id":"d4c4719a-2327-40d5-92aa-932f2f54f632","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.330467Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:17aaeb36b3d336736067f37e41d6ad87750e968ce9f2bbdea700976610a1788b","observation_id":"ae2c6c54-9148-438d-94f6-f900509aeb47","resolution":{"observed_at":"2026-08-15T20:56:37.631477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.618363Z","title":"Gemini 2.0 Flash","venue":null,"work_id":"9d040e35-116d-410e-816f-917c11d7e1d9","year":2025},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.334273Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:5b1ab15a8bef47992bd4ea80cd777f369bf1dfb2c401f9536628ff8145f0a173","observation_id":"165ac2eb-2524-4f68-ba07-e74add8dfa89","resolution":{"observed_at":"2026-08-15T20:56:37.621824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.609032Z","title":"Aya vision: Expanding the worlds ai can see","venue":null,"work_id":"35169ee2-c4d7-4954-a441-ff5a54534939","year":2025},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.337912Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:ae53a17d089b9320c56c4993e08f9a07445948f6a0086b7e9998a8b5a1492cae","observation_id":"f41fc988-e194-406d-b3da-f3d152825230","resolution":{"observed_at":"2026-08-15T20:56:37.612367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.598065Z","title":"Ontherobustness of large multimodal models against image adversarial attacks, in: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"33322573-476e-4752-a4ba-b3bd65cbdf7a","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.341227Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:6de87603fd359ea0e7272dd39ee0261b71b42307cea0e8386e1c988eabcf686a","observation_id":"9186060e-0883-4398-8b6b-d2717f4ef37b","resolution":{"observed_at":"2026-08-15T20:56:37.601379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17146","last_updated":"2024-12-05T14:28:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-25T17:59:51Z","title":"Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17146","snapshot_observed_at":"2026-08-15T20:56:36.344482Z","title":"Molmo and pixmo: Open weights and open data for state-of-the-art multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.344482Z"},"links":{"cited_paper":"/paper/2409.17146","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:a0569bcef8d5bbb80e32878ae64855412273891924bf555d4cbb59954b4145ed","observation_id":"bdda0395-1d6c-4c6e-b476-c598f4c74d30","resolution":{"observed_at":"2026-08-15T20:56:36.344482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.587226Z","title":"Openbias: Open-set bias detection in text-to-image generative models, in: Proceedings of the IEEE/CVF ConferenceonComputerVisionandPatternRecognition,pp.12225– 12235","venue":null,"work_id":"980fcd91-541d-40a7-825c-12035aaf71be","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.349588Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:0a8f9bfc10d891c99a41cd45697a58c69496996111639068d7926f01effccf56","observation_id":"644614d1-8d32-41be-9b6d-acb169fe8918","resolution":{"observed_at":"2026-08-15T20:56:37.591106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T20:56:36.352938Z","title":"Thellama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.352938Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:b2d63bbb6d33fafe491d669adfd3865a37da062822c01e95b6fdecd7a1893d51","observation_id":"9786e7f1-8da4-400d-85aa-93582a1247dc","resolution":{"observed_at":"2026-08-15T20:56:36.352938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.576629Z","title":"A unified framework of five principles for ai in society","venue":null,"work_id":"a8bfc2ee-9de0-4106-acd9-4cdbe70f45bf","year":2022},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.356345Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:e31ebe2cd471194ab1102a5657f9eb6b02f5dcc78dfc78da3a6d3703dcbc81f0","observation_id":"526fe7fb-6d79-4164-9042-3bfe75d42550","resolution":{"observed_at":"2026-08-15T20:56:37.580581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05779","last_updated":"2024-02-08T16:11:23Z","snapshot_observed_at":"2026-08-16T14:20:10.930512Z","submitted_at":"2024-02-08T16:11:23Z","title":"Examining Gender and Racial Bias in Large Vision-Language Models Using a Novel Dataset of Parallel Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05779","snapshot_observed_at":"2026-08-15T20:56:36.360868Z","title":"Examining gender and racial bias in large vision-language models using a novel dataset of parallel images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.360868Z"},"links":{"cited_paper":"/paper/2402.05779","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:0affbe636e4b4f30d6ea8537961a656fb155a87b0482ac2e4692fc68e6ed46d6","observation_id":"ad4947dd-ef26-4641-a9f6-5b1918f51240","resolution":{"observed_at":"2026-08-15T20:56:36.360868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.566210Z","title":"Valuesensitivedesign: Theoryandmethods,in:UniversityofWashingtonTechnicalReport","venue":null,"work_id":"08f20445-2741-4bbf-8fe1-81597d56bea2","year":2002},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.365637Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:909f5a1ae41cda11b1401933551313baa5d3abebb1fdd51c6e73c7587649a1ff","observation_id":"e9a14bd4-4381-4015-a215-13ea0b882756","resolution":{"observed_at":"2026-08-15T20:56:37.569742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15296","last_updated":"2024-12-08T04:24:31Z","snapshot_observed_at":"2026-08-14T10:19:04.189589Z","submitted_at":"2024-11-22T18:59:54Z","title":"MME-Survey: A Comprehensive Survey on Evaluation of Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15296","snapshot_observed_at":"2026-08-15T20:56:36.368922Z","title":"Mme-survey: A compre- hensive survey on evaluation of multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.368922Z"},"links":{"cited_paper":"/paper/2411.15296","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:9adf9be5b6f26ef972e93c14ccb12e8f3839b747a39ee8d19b6def3b78706a7c","observation_id":"24e0e355-e474-4aaf-9baf-b2010ac91391","resolution":{"observed_at":"2026-08-15T20:56:36.368922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-15T20:56:36.372379Z","title":"Chatglm: A family of large language models from glm-130b to glm-4 all tools.arXiv:2406.12793","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.372379Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:e1ac7caa732af6943eacac70d303847275359937b1dd9278fcd771b162878ffb","observation_id":"b360496c-251c-4195-9772-6979bfcb4df5","resolution":{"observed_at":"2026-08-15T20:56:36.372379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.555788Z","title":null,"venue":null,"work_id":"71d29c31-5bc0-423b-b35e-2517f96d2915","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.376339Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:ad894602185b291e030771c5c0e107883bd4dd8d607e983bbda2f211bc754d40","observation_id":"ec9d9c26-7beb-4113-8fc1-0dc878834c18","resolution":{"observed_at":"2026-08-15T20:56:37.559226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.545252Z","title":"Visogender: A dataset for benchmarking gender bias in image-text pronoun resolution","venue":null,"work_id":"a57e03aa-faac-490c-94a0-6d85b841d734","year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.381288Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:f908c1714fe5eaa6f252955729b5b8dcbbbb9a3f9fb08a4e83e9dabd0b28b360","observation_id":"1c9d2ae1-96f4-4edf-91aa-4417e2250ccc","resolution":{"observed_at":"2026-08-15T20:56:37.548998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.534108Z","title":"Ethics guidelinesfortrustworthyAI","venue":null,"work_id":"a7784f52-9f0f-463c-82f0-c4874282d81b","year":2019},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.385724Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:d89ff1155e26233ae8d956f7cb0bd71720a73c964b72655d36403d6f0b134291","observation_id":"e3c16ee8-8a0e-48eb-8072-78f6a17bf361","resolution":{"observed_at":"2026-08-15T20:56:37.538393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16500","last_updated":"2024-08-29T12:59:12Z","snapshot_observed_at":"2026-08-11T07:53:33.804680Z","submitted_at":"2024-08-29T12:59:12Z","title":"CogVLM2: Visual Language Models for Image and Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16500","snapshot_observed_at":"2026-08-15T20:56:36.389705Z","title":"Cogvlm2: Visual lan- guage models for image and video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.389705Z"},"links":{"cited_paper":"/paper/2408.16500","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:abd9d1410ce999695383f74584d42742670a67398ec611175213a7c958255b5b","observation_id":"ea99fcf6-d9f9-4f44-8b0f-263b61269e5d","resolution":{"observed_at":"2026-08-15T20:56:36.389705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.523714Z","title":"Probing and mitigating intersectional social biases in vision-language models with counterfactual examples","venue":null,"work_id":"e9340eaf-00bf-4931-bf43-7ab94d98ad8d","year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.393721Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:6b219a67751d7d630b5e77aa98db685fd4a47894e2c5016a8bd02e5dc08dfc89","observation_id":"bfb50018-0492-4f80-8ac9-31933a175218","resolution":{"observed_at":"2026-08-15T20:56:37.527404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-15T20:56:36.397631Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.397631Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:1802575264ef5a47be01551038ce4db54f7a5b8e58eeb4c76f0a5b0af8c2145e","observation_id":"b3063f6b-c666-414a-85b7-5696697f96e7","resolution":{"observed_at":"2026-08-15T20:56:36.397631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.514288Z","title":"Iso 9241- 210:2019 — ergonomics of human–system interaction — part 210: Human-centred design for interactive systems","venue":null,"work_id":"992fa698-a2e4-48a8-a05e-a74597cf7a9d","year":2019},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.400992Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:f37e337d54d736378a0a406842e92d1de457a755633976b94afa76722b50bff1","observation_id":"3181b8a2-fd00-446d-b527-b9e55856210c","resolution":{"observed_at":"2026-08-15T20:56:37.517441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.504806Z","title":"Information technology — Artificial intelligence — Management system","venue":null,"work_id":"27e1ee1c-990e-4e44-9293-05032493711d","year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.404679Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:c6d64bc387967471bf16cc92e696002859ff78b6494d40b375e0a54dbd71f408","observation_id":"a6ce4c11-da9d-4447-86fb-2d8e3c70eb90","resolution":{"observed_at":"2026-08-15T20:56:37.507931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.495573Z","title":"The global landscape of ai ethics guidelines","venue":null,"work_id":"d22e16c5-c355-4983-8def-ace11f6e36b5","year":2019},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.407822Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:4842f47ff7bb9fdbfe4a6530408220170db11f747ad311895b2a5531a3b1aad5","observation_id":"015e7a40-ce68-4bef-a5fb-6a4f5fce8e85","resolution":{"observed_at":"2026-08-15T20:56:37.498693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.484206Z","title":"imgaug.https://github.com/aleju/imgaug","venue":null,"work_id":"3bcf7798-fda4-4c2e-9b49-34b3676ce037","year":2020},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.411374Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:e08448b4ad365ba6e0743af62b9cc279f34461e69e481b8badab6c883f920ab8","observation_id":"18e9bb52-271c-4461-9acf-d36c1cf3f1be","resolution":{"observed_at":"2026-08-15T20:56:37.488730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.473096Z","title":"Vhelm: A holistic eval- uation of vision language models","venue":null,"work_id":"7c2324f2-d617-4484-8a65-598dc146d29b","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.414922Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:e090eeaf2b8affbba747f53570b17fa348d3c59f7d5915c98078ce30d849f1de","observation_id":"d530d271-be88-43c4-880f-38e25038f4ed","resolution":{"observed_at":"2026-08-15T20:56:37.476873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06777","last_updated":"2024-10-09T11:14:07Z","snapshot_observed_at":"2026-08-16T13:11:09.333324Z","submitted_at":"2024-10-09T11:14:07Z","title":"HERM: Benchmarking and Enhancing Multimodal LLMs for Human-Centric Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06777","snapshot_observed_at":"2026-08-15T20:56:36.418267Z","title":"Herm: Benchmarking and enhancing mul- timodal llms for human-centric understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.418267Z"},"links":{"cited_paper":"/paper/2410.06777","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:e33f122d8da4ab136c0795fc44db991ead4b5d5ab2c395c063f939a56364a511","observation_id":"60c2d99f-43d0-4352-8d4b-19bae665ee01","resolution":{"observed_at":"2026-08-15T20:56:36.418267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12915","last_updated":"2024-01-23T17:07:18Z","snapshot_observed_at":"2026-08-16T14:25:08.079469Z","submitted_at":"2024-01-23T17:07:18Z","title":"Red Teaming Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12915","snapshot_observed_at":"2026-08-15T20:56:36.422175Z","title":"Red teaming visual language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.422175Z"},"links":{"cited_paper":"/paper/2401.12915","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:19f678a8a74ca081cb53ee58e508c84e30a6c4c8475bc768ae5c3e1c65e4aacc","observation_id":"fbe67d39-fa22-434a-ba81-ef0d56e3fe27","resolution":{"observed_at":"2026-08-15T20:56:36.422175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.461773Z","title":"26296–26306","venue":null,"work_id":"0b0b76bc-eacf-4f9f-956e-7969cc56beee","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.425886Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:021c8f9dd09909957e6351c8210561427b7bc791288eea2d55506d3b59a50717","observation_id":"da55b67a-047b-4a9c-9041-f118fb6ce055","resolution":{"observed_at":"2026-08-15T20:56:37.465717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.451146Z","title":"Visual instruction tuning","venue":null,"work_id":"23d575df-3a23-458e-8701-315d489e88f4","year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.429395Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:bf2823a15beab6882832a62b262c979027960349cdd6e282e307cfba89265292","observation_id":"2ae17389-b726-430e-b06c-5f12d49d83e3","resolution":{"observed_at":"2026-08-15T20:56:37.454884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.442271Z","title":"Grounding dino: Marrying dino withgroundedpre-trainingforopen-setobjectdetection,in:European Conference on Computer Vision, Springer","venue":null,"work_id":"aa53b6f7-1790-488f-bd7a-6e4ea3810c87","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.432788Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:136f8dab777743f15bb2d00d92a40987bc1d4ba80a92c37645463f7eb8b3bbc4","observation_id":"dd2d8c7c-38b9-45c0-9dd3-d19409062e8a","resolution":{"observed_at":"2026-08-15T20:56:37.445338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.433233Z","title":"Mm- safetybench: A benchmark for safety evaluation of multimodal large language models, in: European Conference on Computer Vision, Springer","venue":null,"work_id":"f7a76748-77a4-4af0-8fd1-6cb7c7ad97d4","year":2025},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.436718Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:36e8acd479dde493877578dc17f68bb841b25b61a30ec9426c4572f00b93c04f","observation_id":"67904b59-503b-446b-9fb0-4e4cc6d28273","resolution":{"observed_at":"2026-08-15T20:56:37.436400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-11T01:38:59.827005Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-15T20:56:36.439962Z","title":"Deepseek-vl: towards real-world vision-language understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.439962Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:9c618964381afb691eb78b0ad10da52b042e4098c838db01663df31f4a538e4a","observation_id":"95d7047d-585f-4ba1-9f01-8140bcc3a51f","resolution":{"observed_at":"2026-08-15T20:56:36.439962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"y-things/9780465","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:36.847867Z","title":"The Design of Everyday Things: Revised and Expanded Edition","venue":null,"work_id":"84e076b9-b0c3-4156-a5d3-ca07b1bd6d45","year":2013},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.443229Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:fed8f69f36af79ff932135a720fce1946977b532d1a9f4c925b2be1f714e2f1e","observation_id":"c66a8114-89fc-4a2f-9476-f16230e6884c","resolution":{"observed_at":"2026-08-15T20:56:36.858324Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.423982Z","title":"Creating capabilities: The human develop- ment approach","venue":null,"work_id":"ef41754a-9332-4ae2-8574-31b2ddd640e1","year":2011},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.446361Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:e26eb6f49c5740ecd25bac6de9588554fafff2e54848ee86cbca25e26df1bbe8","observation_id":"d60f1d82-77ea-4002-a1e9-246a00e1a941","resolution":{"observed_at":"2026-08-15T20:56:37.427077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.414849Z","title":"Human-centredvaluesandfairness(oecdaiprinciple)","venue":null,"work_id":"05807103-0e3c-4614-9cff-7a8dc9891b97","year":2025},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.450379Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:6c62603eba098c02d14e545651d83eef481ac9d260bc6333295eceb857ff70b5","observation_id":"deea5c98-2124-40e1-b2d0-b923dfb6a3c9","resolution":{"observed_at":"2026-08-15T20:56:37.417947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14167","last_updated":"2023-05-24T02:51:37Z","snapshot_observed_at":"2026-08-16T15:30:35.255795Z","submitted_at":"2023-05-23T15:37:28Z","title":"DetGPT: Detect What You Need via Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14167","snapshot_observed_at":"2026-08-15T20:56:36.453824Z","title":"Detgpt: Detect what you need via reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.453824Z"},"links":{"cited_paper":"/paper/2305.14167","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:cd9da88015abd8afd3c6bc773efbce664d53069aeeb1e649336cbc95d7f0d360","observation_id":"8bc7214d-8c26-4f91-8549-7a00ad107823","resolution":{"observed_at":"2026-08-15T20:56:36.453824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.405697Z","title":"What is thelimitationofmultimodalllms?adeeperlookintomultimodalllms through prompt probing","venue":null,"work_id":"1114e929-d5a1-4768-9885-2d04d3f93599","year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.457073Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:d3d69b6908990e9ee61730a651eb4827fd6b943d3c6a456c017aa0fb57ec045f","observation_id":"53e598a1-041b-4b57-8505-788c98f650f6","resolution":{"observed_at":"2026-08-15T20:56:37.408963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00951","last_updated":"2025-07-12T02:50:17Z","snapshot_observed_at":"2026-08-08T07:11:19.635744Z","submitted_at":"2025-07-01T16:52:25Z","title":"Thinking Beyond Tokens: From Brain-Inspired Intelligence to Cognitive Foundations for Artificial General Intelligence and its Societal Impact","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00951","snapshot_observed_at":"2026-08-15T20:56:36.459918Z","title":"Thinking beyond tokens: From brain-inspired intelligence to cognitive founda- tions for artificial general intelligence and its societal impact","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.459918Z"},"links":{"cited_paper":"/paper/2507.00951","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:d958d5fb36894ecb4823d6d8fe9a26f71f4515fcd9fcf73c3874dd187178f3d0","observation_id":"df8ab31d-04a8-43c0-bad1-e4c641623638","resolution":{"observed_at":"2026-08-15T20:56:36.459918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.396339Z","title":"Respon- sible agentic reasoning and ai agents: A critical survey","venue":null,"work_id":"a4c96f1d-83bc-4c95-85e8-0bea68824d1d","year":2025},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.463208Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:25c2e6e8f4a0612108c0f4420740f7762c9cc6ea6abbbabe79961b7a6ac38090","observation_id":"66441f29-8ab6-4138-8750-f72ed187a4b5","resolution":{"observed_at":"2026-08-15T20:56:37.399466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.386912Z","title":"Human-centered AI","venue":null,"work_id":"9941823a-875a-42bb-9460-691ec8eb455a","year":2022},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.466972Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:e7c127306435bebf62a23962ccb28c344e2c8cd55c70079e3aa6b7ba962650ad","observation_id":"61e3fa6c-8b0a-4c03-b5b0-e87ed2b4421f","resolution":{"observed_at":"2026-08-15T20:56:37.390514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12622","last_updated":"2026-05-05T05:31:40Z","snapshot_observed_at":"2026-07-06T19:04:47.884694Z","submitted_at":"2024-08-14T10:32:06Z","title":"The AI risk repository: A meta-review, database, and taxonomy of risks from artificial intelligence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12622","snapshot_observed_at":"2026-08-15T20:56:36.469948Z","title":"The ai risk repository:Acomprehensivemeta-review,database,andtaxonomyof risks from artificial intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.469948Z"},"links":{"cited_paper":"/paper/2408.12622","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:3ccdbf48844c9ca2b469253439eff85ec2ebbf0dfedc0429dd6b3be0609df024","observation_id":"d8359491-75f9-4331-9a3f-ae9957b2f0ae","resolution":{"observed_at":"2026-08-15T20:56:36.469948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-15T20:56:36.473576Z","title":"Gemma 3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.473576Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:8b0d2b665969dadf84802120e04fe367e1da79c52343b1b1cc34fa9872ddc35f","observation_id":"b17cd142-cd0b-4fc5-b83b-27f46693ef4d","resolution":{"observed_at":"2026-08-15T20:56:36.473576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.375149Z","title":"Eyes wideshut?exploringthevisualshortcomingsofmultimodalllms,in: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"9f3fd43d-ea20-48d3-a893-38b2539e0e33","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.476678Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:fd9a903f4ea8c06c0c3a2a732dba2e89f89bfb0888881b58bd8a0967cd0560b5","observation_id":"0ef0c182-8224-4f1b-a2f2-89cc9f9a5fdf","resolution":{"observed_at":"2026-08-15T20:56:37.379987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.363812Z","title":"Accessed: 2025-11-22","venue":null,"work_id":"7542e958-1a86-482c-8c03-0f113f07d983","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.480266Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:865806c3e9cfbb56aa3d5cb2bd4d11a5138b65ba9984938b9521b447958ccd66","observation_id":"c53eff41-0f23-4d11-8276-1c836efff9aa","resolution":{"observed_at":"2026-08-15T20:56:37.367725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16508","last_updated":"2025-05-01T03:41:42Z","snapshot_observed_at":"2026-08-17T13:19:41.298933Z","submitted_at":"2024-11-25T15:44:42Z","title":"All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16508","snapshot_observed_at":"2026-08-15T20:56:36.484217Z","title":"All languages matter: Evaluating lmms on culturally diverse 100 languages","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.484217Z"},"links":{"cited_paper":"/paper/2411.16508","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:9ec18a6a7541a8526bf4eee600352f832a4b0ac78c603c69e303c9ddc193079f","observation_id":"2917e3a4-b73d-456b-a369-13b74e4e1ffb","resolution":{"observed_at":"2026-08-15T20:56:36.484217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-15T20:56:36.487903Z","title":"Qwen2-vl:Enhancingvision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.487903Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:fda33cc7e55285b4b404e0a03e6e3417968e83b678c0e315d7ee3b4f3454ea54","observation_id":"5f62f770-ae40-41a1-a849-7629ff5f6995","resolution":{"observed_at":"2026-08-15T20:56:36.487903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14181","last_updated":"2024-01-01T14:48:48Z","snapshot_observed_at":"2026-08-16T14:57:50.062295Z","submitted_at":"2023-09-25T14:43:43Z","title":"Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14181","snapshot_observed_at":"2026-08-15T20:56:36.491587Z","title":"Q-bench: A benchmark for general-purpose foundation models on low-level vision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.491587Z"},"links":{"cited_paper":"/paper/2309.14181","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:830e63618c6c3b845225c3429a1656179229af0d4d604c8bea905e2db46ad1ed","observation_id":"86fdc821-6595-4038-b00b-564257566dd2","resolution":{"observed_at":"2026-08-15T20:56:36.491587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09295","last_updated":"2025-06-04T07:53:00Z","snapshot_observed_at":"2026-08-16T13:43:16.050061Z","submitted_at":"2024-06-13T16:30:14Z","title":"AlignMMBench: Evaluating Chinese Multimodal Alignment in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09295","snapshot_observed_at":"2026-08-15T20:56:36.495438Z","title":"Alignmmbench: Evaluating chinese multi- modal alignment in large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.495438Z"},"links":{"cited_paper":"/paper/2406.09295","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:0d709bae4d2354d47dc97144127c4bd362c87812c18edbf8cb820e02227c82db","observation_id":"7d6878f1-ba86-4cc5-9088-27dc6ed95506","resolution":{"observed_at":"2026-08-15T20:56:36.495438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.352704Z","title":"Genderbias-vl:Benchmarkinggenderbiasinvision language models via counterfactual probing","venue":null,"work_id":"5e08a2ac-e73c-44c9-acac-60b1fbcc5006","year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.499022Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:0687f7a908bd28cd8accea41aaa434c5b4b512758d3862b7d81fe3aa23d01571","observation_id":"cf5b171d-c958-45b6-b99d-9a642a005b58","resolution":{"observed_at":"2026-08-15T20:56:37.356923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:36.502103Z","title":"Mm-spubench: Towards better understanding of spurious biases in multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.502103Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:f1b0d694b1b8fcdf393e0f6a2ed8b7c2ee78b87cdf5d6bc29bc00367c7be469f","observation_id":"0c469f49-6c7c-4f3c-8f76-f0e91d69dbaa","resolution":{"observed_at":"2026-08-15T20:56:36.502103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.341872Z","title":null,"venue":null,"work_id":"4b2b601b-b094-4648-9165-27879975f128","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.505438Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:b4d17969511d119fd30dea1ba2638ca20a32858f5c16666a21103344abc37d66","observation_id":"5481c34c-62eb-4f24-a592-f675655817ed","resolution":{"observed_at":"2026-08-15T20:56:37.345622Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.331395Z","title":"M3exam: A multilingual, multimodal, multilevel benchmark for ex- amining large language models","venue":null,"work_id":"52b54c65-d9e4-468c-b092-a435dd16638e","year":2023},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.513737Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:7541c613abe853d687ab90f086489925ee69ed0b77ab343be9a060a49d1a9dc1","observation_id":"758c2e96-f446-4e2a-b816-db02f9975fd1","resolution":{"observed_at":"2026-08-15T20:56:37.335375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.320318Z","title":"Advances in Neural Information Processing Systems 37, 49279– 49383","venue":null,"work_id":"1fb16a56-131a-4768-8bb8-219fd50fd1cd","year":2025},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.517094Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:705525ab4ceca559938c5ee6bfd006eecd275a9a4c8a2c10a322ec20a9fa2829","observation_id":"718e7375-e020-49fb-afc0-ef17d3316b37","resolution":{"observed_at":"2026-08-15T20:56:37.324454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:36.520170Z","title":"Elderly man reading newspaper","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.520170Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:3072498616bb76f2b8552912f90a5c953b69f2a8d4751d874ce32070726beadb","observation_id":"57db2cbb-68d9-4f0a-b2ab-265c43b33fba","resolution":{"observed_at":"2026-08-15T20:56:36.520170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.309280Z","title":null,"venue":null,"work_id":"ee3aa2ef-aee4-4af1-a4b3-399114c0ab45","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.525097Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:fd558675eb8d6db390fd979d84b9cd7af7a7a4902d7304794ecdb1c456344625","observation_id":"83af4a94-ede7-40af-bc89-1ce2d2145757","resolution":{"observed_at":"2026-08-15T20:56:37.313158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.300527Z","title":null,"venue":null,"work_id":"a78f9f07-51f7-4f5d-b7ab-5631d21ff54a","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.528528Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:837e7d04f4cae91d96d1af3a0c5aae036641ba755f81d4893a337ceff754b7b8","observation_id":"538eb889-5c83-4adf-ae00-97d91c4cd205","resolution":{"observed_at":"2026-08-15T20:56:37.303315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.290123Z","title":"Caption\":","venue":null,"work_id":"5e7f60f9-6072-44e0-870b-d2a88cb8345a","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.531890Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:13595845be9a07e78f2176da435d8a9dff052946a43f315e7f6914793bd8bff5","observation_id":"349857c0-33c2-43ba-b64f-faa1a75ab9ff","resolution":{"observed_at":"2026-08-15T20:56:37.294016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.240141Z","title":null,"venue":null,"work_id":"23cc9ef1-4257-4fc8-857d-9dce4ce517a6","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.535039Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:09288ad240b5787f287dfc2ba60e2f0a5d3c3db5c78f06ee89fdd7e9bf07cd50","observation_id":"8561ce38-3acc-47bf-837e-1d2c20c3113a","resolution":{"observed_at":"2026-08-15T20:56:37.283523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.097976Z","title":null,"venue":null,"work_id":"cc34de8a-3501-446a-afb9-213cfc13c17f","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.538347Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:a733b72f7b96de3bfa5d281b6b2caf4dde6e72165e8e1364a376503457830e5f","observation_id":"55402213-7137-40fe-9ccc-b8f80c9b611f","resolution":{"observed_at":"2026-08-15T20:56:37.196007Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.076570Z","title":"All other output rules, bounding boxes, confidence handling, JSON format, are identical to T2","venue":null,"work_id":"be0b0cfb-5389-433e-964e-d80f99f81ad4","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.541525Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:9ac3624cecbaaa1edff8549ea068e5f4a5488f129ac20afd7885d5e60cad276e","observation_id":"2bedcfa0-65b6-4b79-ae75-17d663f6db30","resolution":{"observed_at":"2026-08-15T20:56:37.082083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.065770Z","title":null,"venue":null,"work_id":"9eac5cd6-d108-4bdb-8a8e-37f50c4ab44c","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.545132Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:5c9e6c3a38e7064c8a4b6acee11303b70223bfc0213ac922ff969b980e6c58e8","observation_id":"0786ff0f-c817-4b44-b515-d976ddde2a9d","resolution":{"observed_at":"2026-08-15T20:56:37.068918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.053122Z","title":null,"venue":null,"work_id":"9ee6b258-6ba7-497d-ba5e-c4bf8b34e3ed","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.548314Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:b4c0dfd5ef7702fe63a75110a686e04a941181c40677bef26a48c2ca70bb8565","observation_id":"f01e21ba-e8ed-4535-a259-9dc8f08b9e45","resolution":{"observed_at":"2026-08-15T20:56:37.057052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.040968Z","title":"Identify any errors or unsupported statements","venue":null,"work_id":"76885bf0-65d5-44bd-9d1e-5344303bd8c6","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.551368Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:b2436529f49e251b16355dce9ff0a63243438a89ef5cd51ea6e0bbd5b8ad7419","observation_id":"4a556a3c-543b-4d5f-bb48-3d535275c62d","resolution":{"observed_at":"2026-08-15T20:56:37.045415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.028075Z","title":null,"venue":null,"work_id":"91473657-e5f0-4ac6-832d-349e4f90a9f1","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.554413Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:3d191b4f4ce9359015f58dd7e3056fce307027198ed7643c168a02e35a5180fe","observation_id":"9fab5c9b-9661-4084-b66b-de3a37b841a9","resolution":{"observed_at":"2026-08-15T20:56:37.032857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.012084Z","title":null,"venue":null,"work_id":"3589b571-76a5-48f3-b5b0-c220bc9e6fad","year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.557561Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:c5e3cfaefb78fc4a8c0e811481c4aba3bdaf071c52cd55631fc934edb66f6723","observation_id":"c1a1f5ba-a198-4a0b-a96d-c9c9e09a9a0c","resolution":{"observed_at":"2026-08-15T20:56:37.019493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:56:37.000171Z","title":"on the right track","venue":null,"work_id":"39d6c842-7c7b-48e0-92a8-a1cccffe1acf","year":2020},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.560558Z"},"links":{"citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:e3c915a6c9b3df98ce8b2061ac96bf4f2931d4537f3ee6bf47c424c95db672b5","observation_id":"d20967bc-dc48-4197-ba9b-f2d9daf11205","resolution":{"observed_at":"2026-08-15T20:56:37.004033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14194","last_updated":"2026-04-05T17:10:43Z","snapshot_observed_at":"2026-08-17T22:52:10.617093Z","submitted_at":"2024-06-20T10:56:59Z","title":"VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14194","snapshot_observed_at":"2026-08-15T20:56:36.509921Z","title":"arXiv preprint arXiv:2406.14194","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.509921Z"},"links":{"cited_paper":"/paper/2406.14194","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:4b6a4af81e52dc789bac25a0421936e3101fce91019b9e90295a861da7fbd619","observation_id":"91a46d6b-32b3-4f6d-9d97-f3c2139b2767","resolution":{"observed_at":"2026-08-15T20:56:36.509921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-08-12T12:44:22.350068Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-15T20:56:36.322772Z","title":"arXiv preprint arXiv:2501.17811","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation","version":7},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T20:56:36.322772Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2505.11454"},"observation_digest":"sha256:51d6f79363c24c913b42ecfcd5a444cb7c5120b15b1b4c38780cd8cfaa405147","observation_id":"4b901491-b33f-47a4-a8c8-f0cd14d05f23","resolution":{"observed_at":"2026-08-15T20:56:36.322772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.11454","last_updated":"2026-06-19T13:18:49Z","latest_version":7,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T00:15:09.659241Z","submitted_at":"2025-05-16T17:09:44Z","title":"HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":1,"verified_fuzzy":38},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 5 inbound Pith citation observations for arXiv:2505.11454."}