{"as_of":"2026-08-06T19:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b0c0e585fdac6dbc64fd62e9bbbedd6cbb99cc11064f61a028a2be31d5c720f","coverage":[{"denominator":4,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T10:41:24.300682Z","state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T00:41:35.451383Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.09322","last_updated":"2026-07-15T14:49:37Z","snapshot_observed_at":"2026-08-06T12:52:30.088678Z","submitted_at":"2026-01-14T09:50:09Z","title":"Attentive multilayer fusion for vision transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.09322","snapshot_observed_at":"2026-08-02T03:20:56.091233Z","title":"Beyond the final layer: Attentive multilayer fusion for vision transformers,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13926","last_updated":"2026-07-15T15:07:02Z","snapshot_observed_at":"2026-08-06T17:06:18.498355Z","submitted_at":"2026-07-15T15:07:02Z","title":"S-squared-VLA: Decoupling Semantic and Spatial Streams in Vision-Language-Action Models for Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T03:20:56.091233Z"},"links":{"cited_paper":"/paper/2601.09322","citing_paper":"/paper/2607.13926"},"observation_digest":"sha256:45b3d7ee833fc666eade736283698c073b1f8fe9e0e861afe38e5bfb6f1d48ff","observation_id":"ea238627-d443-4915-a6b1-fd625743b797","resolution":{"observed_at":"2026-08-02T03:20:56.091233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.09322","last_updated":"2026-07-15T14:49:37Z","snapshot_observed_at":"2026-08-06T12:52:30.088678Z","submitted_at":"2026-01-14T09:50:09Z","title":"Attentive multilayer fusion for vision transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.09322","snapshot_observed_at":"2026-08-04T00:41:35.451383Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00110","last_updated":"2026-07-31T08:24:05Z","snapshot_observed_at":"2026-08-06T19:12:14.833565Z","submitted_at":"2026-07-31T08:24:05Z","title":"Distill What RGB Can Recover: Privileged 3D Evidence for RGB-Only Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T00:41:35.451383Z"},"links":{"cited_paper":"/paper/2601.09322","citing_paper":"/paper/2608.00110"},"observation_digest":"sha256:95a49371c9aefc7ee7013a827f5e7ea3aba4971edd8d03c540cc66651cba8bfb","observation_id":"d912a347-f939-48d2-a8fb-cf97511ef4f2","resolution":{"observed_at":"2026-08-04T00:41:35.451383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2601.09322/citation-record","integrity":"/paper/2601.09322/integrity","json":"/paper/2601.09322/citation-record.json","paper":"/paper/2601.09322"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:41:24.286588Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.09322","last_updated":"2026-07-15T14:49:37Z","snapshot_observed_at":"2026-08-06T12:52:30.088678Z","submitted_at":"2026-01-14T09:50:09Z","title":"Attentive multilayer fusion for vision transformers","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-03T10:41:24.286588Z"},"links":{"citing_paper":"/paper/2601.09322"},"observation_digest":"sha256:f7f9e39ae174016b6f66ab4460ec49f0127448fd9afd54e7ab719f2edb2bfd11","observation_id":"c926931a-c02e-4703-bfd7-2d4c89fef64e","resolution":{"observed_at":"2026-08-03T10:41:24.286588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:41:24.291885Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.09322","last_updated":"2026-07-15T14:49:37Z","snapshot_observed_at":"2026-08-06T12:52:30.088678Z","submitted_at":"2026-01-14T09:50:09Z","title":"Attentive multilayer fusion for vision transformers","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-03T10:41:24.291885Z"},"links":{"citing_paper":"/paper/2601.09322"},"observation_digest":"sha256:0d391d93e9f82279427e52ad794670a79dd87ad5768e9bb129e432e712e05a25","observation_id":"519b8829-ed88-48f2-9c0c-edb5cb7f5d90","resolution":{"observed_at":"2026-08-03T10:41:24.291885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:41:24.296400Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.09322","last_updated":"2026-07-15T14:49:37Z","snapshot_observed_at":"2026-08-06T12:52:30.088678Z","submitted_at":"2026-01-14T09:50:09Z","title":"Attentive multilayer fusion for vision transformers","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-03T10:41:24.296400Z"},"links":{"citing_paper":"/paper/2601.09322"},"observation_digest":"sha256:6768652fb0482fa7eacb3cf5bb5df153b68b0d3f32899911ea1d9ceaea5ab9ce","observation_id":"30fb1e38-626a-464f-be05-fb72c89dd1a7","resolution":{"observed_at":"2026-08-03T10:41:24.296400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T10:41:24.300682Z","title":"V 9E̋_d. > ㅞ!Jq 6[6gc QTF","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2601.09322","last_updated":"2026-07-15T14:49:37Z","snapshot_observed_at":"2026-08-06T12:52:30.088678Z","submitted_at":"2026-01-14T09:50:09Z","title":"Attentive multilayer fusion for vision transformers","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-03T10:41:24.300682Z"},"links":{"citing_paper":"/paper/2601.09322"},"observation_digest":"sha256:ebe9e9bbdced6e5aea391379aec30da177ef48c212de32f55eb8b9ee987b4551","observation_id":"9fddd77c-e2c2-431d-9c54-ad609dedd765","resolution":{"observed_at":"2026-08-03T10:41:24.300682Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.09322","last_updated":"2026-07-15T14:49:37Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T12:52:30.088678Z","submitted_at":"2026-01-14T09:50:09Z","title":"Attentive multilayer fusion for vision transformers"},"reference_resolution":{"displayed":4,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":4},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 4 of 4 outbound references and 2 inbound Pith citation observations for arXiv:2601.09322."}