{"as_of":"2026-08-06T19:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f2ab5f71c560f57161f57498a826da98737a774b9eb24a1963543527c02ecdd","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:25:03.107930Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:48:03.024533Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.02228","last_updated":"2024-07-18T07:18:36Z","snapshot_observed_at":"2026-07-06T16:56:49.877351Z","submitted_at":"2023-12-04T03:05:59Z","title":"PixelLM: Pixel Reasoning with Large Multimodal Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02228","snapshot_observed_at":"2026-08-06T15:25:03.107930Z","title":"Pixellm: Pixel reasoning with large multimodal model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16213","last_updated":"2025-07-22T04:09:14Z","snapshot_observed_at":"2026-08-06T15:12:59.857398Z","submitted_at":"2025-07-22T04:09:14Z","title":"Advancing Visual Large Language Model for Multi-granular Versatile Perception","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:25:03.107930Z"},"links":{"cited_paper":"/paper/2312.02228","citing_paper":"/paper/2507.16213"},"observation_digest":"sha256:f2320c27363e3b7a816f2e572ceedb57477ca39975bece088dc39a64d30af234","observation_id":"5cf9db23-a1b3-4486-9bd3-6d6313aaeca9","resolution":{"observed_at":"2026-08-06T15:25:03.107930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02228","last_updated":"2024-07-18T07:18:36Z","snapshot_observed_at":"2026-07-06T16:56:49.877351Z","submitted_at":"2023-12-04T03:05:59Z","title":"PixelLM: Pixel Reasoning with Large Multimodal Model","version":3},"cited_work":{"arxiv_id":"2312.02228","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.02228","snapshot_observed_at":"2026-07-03T10:48:03.024533Z","title":"Pixellm: Pixel reasoning with large multimodal model","venue":null,"work_id":"38b4d0e7-1c86-4324-9807-6ca932936654","year":2023},"citing_paper":{"arxiv_id":"2509.13484","last_updated":"2026-01-15T21:33:56Z","snapshot_observed_at":"2026-07-06T22:30:07.020487Z","submitted_at":"2025-09-16T19:31:40Z","title":"MINGLE: VLMs for Semantically Complex Region Detection in Urban Scenes","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T15:35:30.549656Z"},"links":{"cited_paper":"/paper/2312.02228","citing_paper":"/paper/2509.13484"},"observation_digest":"sha256:ece3d26719ad1222d436f00fd75be5b7b7f8d57163dc72902d442a4f1496fec6","observation_id":"1a35217e-96be-4a4a-bc27-61c00f6786e8","resolution":{"observed_at":"2026-05-18T15:36:34.027052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02228","last_updated":"2024-07-18T07:18:36Z","snapshot_observed_at":"2026-07-06T16:56:49.877351Z","submitted_at":"2023-12-04T03:05:59Z","title":"PixelLM: Pixel Reasoning with Large Multimodal Model","version":3},"cited_work":{"arxiv_id":"2312.02228","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.02228","snapshot_observed_at":"2026-07-03T10:48:03.024533Z","title":"Pixellm: Pixel reasoning with large multimodal model","venue":null,"work_id":"38b4d0e7-1c86-4324-9807-6ca932936654","year":2023},"citing_paper":{"arxiv_id":"2605.19410","last_updated":"2026-05-19T06:04:23Z","snapshot_observed_at":"2026-07-06T23:30:06.876413Z","submitted_at":"2026-05-19T06:04:23Z","title":"Vision Harnessing Agent for Open Ad-hoc Segmentation","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-20T05:52:40.429412Z"},"links":{"cited_paper":"/paper/2312.02228","citing_paper":"/paper/2605.19410"},"observation_digest":"sha256:78905e84b5dfcb48042a00c77d686dffd0017a790f392ebf7c7f62e014dd32ed","observation_id":"cd626809-10df-47f8-9bf5-15e7b2ba0485","resolution":{"observed_at":"2026-05-20T05:53:04.475649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02228","last_updated":"2024-07-18T07:18:36Z","snapshot_observed_at":"2026-07-06T16:56:49.877351Z","submitted_at":"2023-12-04T03:05:59Z","title":"PixelLM: Pixel Reasoning with Large Multimodal Model","version":3},"cited_work":{"arxiv_id":"2312.02228","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.02228","snapshot_observed_at":"2026-07-03T10:48:03.024533Z","title":"Pixellm: Pixel reasoning with large multimodal model","venue":null,"work_id":"38b4d0e7-1c86-4324-9807-6ca932936654","year":2023},"citing_paper":{"arxiv_id":"2606.12195","last_updated":"2026-06-10T15:17:08Z","snapshot_observed_at":"2026-08-01T02:09:41.655807Z","submitted_at":"2026-06-10T15:17:08Z","title":"InternVideo3: Agentify Foundation Models with Multimodal Contextual Reasoning","version":1},"reference_index":159,"source":"arxiv_source","source_observed_at":"2026-06-27T09:48:27.652901Z"},"links":{"cited_paper":"/paper/2312.02228","citing_paper":"/paper/2606.12195"},"observation_digest":"sha256:2e1e939c84ce882397c61f09c075835a954f68302c6b41011e89edfdd9811c76","observation_id":"592de972-91a7-4d8e-b634-46c85a1f6496","resolution":{"observed_at":"2026-07-03T10:48:03.025941Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2312.02228/citation-record","integrity":"/paper/2312.02228/integrity","json":"/paper/2312.02228/citation-record.json","paper":"/paper/2312.02228"},"outbound":[],"paper":{"arxiv_id":"2312.02228","last_updated":"2024-07-18T07:18:36Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T16:56:49.877351Z","submitted_at":"2023-12-04T03:05:59Z","title":"PixelLM: Pixel Reasoning with Large Multimodal Model"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 4 inbound Pith citation observations for arXiv:2312.02228."}