Pith. sign in

Paper Citation Record · LEDGER

Attentive multilayer fusion for vision transformers

As of 6 August 2026, this Paper Citation Record lists 4 of 4 outbound references and 2 inbound Pith citation observations for arXiv:2601.09322.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2601.09322 v2

Coverage vector

measured 4 of 4 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-03T10:41:24.300682Z

measured 6 of 6 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-06T06:34:29.942622+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-04T00:41:35.451383Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

4 of 4 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved3
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation c926931a-c02e-4703-bfd7-2d4c89fef64e · outbound

This paper cites write newline.

Attentive multilayer fusion for vision transformers write newline

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-03T10:41:24.286588Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T10:41:24.286588Z digest=sha256:f7f9e39ae174016b6f66ab4460ec49f0127448fd9afd54e7ab719f2edb2bfd11

Observation 519b8829-ed88-48f2-9c0c-edb5cb7f5d90 · outbound

This paper cites @esa (Ref.

Attentive multilayer fusion for vision transformers @esa (Ref

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-03T10:41:24.291885Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T10:41:24.291885Z digest=sha256:0d391d93e9f82279427e52ad794670a79dd87ad5768e9bb129e432e712e05a25

Observation 30fb1e38-626a-464f-be05-fb72c89dd1a7 · outbound

This paper cites an unresolved cited work.

Attentive multilayer fusion for vision transformers Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-03T10:41:24.296400Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T10:41:24.296400Z digest=sha256:6768652fb0482fa7eacb3cf5bb5df153b68b0d3f32899911ea1d9ceaea5ab9ce

Observation 9fddd77c-e2c2-431d-9c54-ad609dedd765 · outbound

This paper cites V 9E̋_d. > ㅞ!Jq 6[6gc QTF.

Attentive multilayer fusion for vision transformers V 9E̋_d. > ㅞ!Jq 6[6gc QTF

Reference 4

Resolution
malformed identifier
no resolver link, observed 2026-08-03T10:41:24.300682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T10:41:24.300682Z digest=sha256:ebe9e9bbdced6e5aea391379aec30da177ef48c212de32f55eb8b9ee987b4551

Pith citing papers

Observation ea238627-d443-4915-a6b1-fd625743b797 · inbound

S-squared-VLA: Decoupling Semantic and Spatial Streams in Vision-Language-Action Models for Autonomous Driving cites this paper.

S-squared-VLA: Decoupling Semantic and Spatial Streams in Vision-Language-Action Models for Autonomous Driving Attentive multilayer fusion for vision transformers

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T03:20:56.091233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T03:20:56.091233Z digest=sha256:a88b2fc315a0ecf05f170d1b5255eb87b1c948db847bb7edef5ebd8b71ea220f

Observation d912a347-f939-48d2-a8fb-cf97511ef4f2 · inbound

Distill What RGB Can Recover: Privileged 3D Evidence for RGB-Only Vision-Language Models cites this paper.

Distill What RGB Can Recover: Privileged 3D Evidence for RGB-Only Vision-Language Models Attentive multilayer fusion for vision transformers

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-04T00:41:35.451383Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T00:41:35.451383Z digest=sha256:e0b0acfa76f31d983876231c681ae6bd1825b9d9386e2f467281ff3479fa2969