{"as_of":"2026-08-12T16:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a165952329b87d857bc1c62656e38b7921823375230ac12cc8d5c8d8e42c7deb","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:46:08.165002Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02957/citation-record","integrity":"/paper/2507.02957/integrity","json":"/paper/2507.02957/citation-record.json","paper":"/paper/2507.02957"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:13.441504Z","title":null,"venue":null,"work_id":"a6687dab-e1da-4479-ac80-076415ea29f9","year":2020},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:04.813164Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:6d2c2977bd4895f00266e989cc2b9b0b0e65918e5b6a30a45ad6d79637b5d30f","observation_id":"a4a34627-187f-4172-8a3d-da6ecb87ba9d","resolution":{"observed_at":"2026-08-06T21:46:13.514148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:13.290688Z","title":null,"venue":null,"work_id":"d355078b-c0ac-4dfc-9dbd-0cb52d862ce6","year":2020},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:04.878245Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:540727f01a6d8907baec27cef7857ef2f09595c24dda7642e86da028a764cf0d","observation_id":"097b3dda-59d3-4234-92de-67636c640b7e","resolution":{"observed_at":"2026-08-06T21:46:13.372157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:13.156578Z","title":null,"venue":null,"work_id":"9b41022a-ad7c-4abb-ba9a-55830e9882cf","year":2021},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:04.996305Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:621ffe8fffdcc2d897805bcd55e3ea3ebcb05b873f965d253a9e7b213b6667be","observation_id":"634f2674-9092-4b26-8dfe-22f7d30e2514","resolution":{"observed_at":"2026-08-06T21:46:13.221628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:12.975453Z","title":null,"venue":null,"work_id":"f90d7f5d-4083-4471-9f07-358fd4005cc0","year":2020},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:05.105195Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:a059f6fd599ce7716774d2e96fca7667264d25abe608d7a9c5359d9d3a02d4c0","observation_id":"0b46d5ea-5b73-48ee-a89f-aed77f6d956b","resolution":{"observed_at":"2026-08-06T21:46:13.060835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:12.768353Z","title":null,"venue":null,"work_id":"dc06881e-6245-4536-9fdf-51c00a12bb72","year":2021},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:05.216775Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:cf24cb793d4c85e812e8df64b8970dcf53200a7edfeb34836b6b8553ff65db9c","observation_id":"ac4491ab-83e3-422d-a1a1-d3cdb82db32a","resolution":{"observed_at":"2026-08-06T21:46:12.875047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:12.384157Z","title":"Attention is all you need","venue":null,"work_id":"1c4fe187-b6fc-4ad8-b48f-4f20e92b8025","year":2017},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:05.484959Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:ec2519d562a22bc4a3ed6bb22dde809d11f09aafb7bbb5d57e04b2e1b255a43c","observation_id":"1935f8fb-4561-4314-8893-933dfadfec4b","resolution":{"observed_at":"2026-08-06T21:46:12.457029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:12.194017Z","title":"Compressed sensing","venue":null,"work_id":"5b22bef1-ca53-49ea-8fd0-65b0a852f6e8","year":2006},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:05.612772Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:dd8293566c5d1a22f249ed91397da1653ea587b2f56c0be390eb22d8c24e804a","observation_id":"203046bc-7a66-423f-b02e-cea1479d189e","resolution":{"observed_at":"2026-08-06T21:46:12.278794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:12.030599Z","title":null,"venue":null,"work_id":"40f51dc3-e596-4587-af79-bdfd45332355","year":2023},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:05.728210Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:f3495ab455c7717b0555fae04b7376b76510dbb5121f3c09c79ccfb497f70189","observation_id":"3b5cf73f-7130-4a0f-879c-9f2dd829c8dc","resolution":{"observed_at":"2026-08-06T21:46:12.110033Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:11.822802Z","title":"and Vinyals, O","venue":null,"work_id":"97d259cd-c192-486d-8a66-ffeacc57091c","year":2021},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:05.899275Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:380e290785276df530c2e103968cc8f7a1dda3d0a7973fcedd05e4f0ed61d731","observation_id":"8861e467-2a7e-447f-b8a7-88fad94bdfb8","resolution":{"observed_at":"2026-08-06T21:46:11.920575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:11.653844Z","title":"J., Romberg, J","venue":null,"work_id":"5029a3bb-e809-423a-afe9-0f1d8682f90c","year":2006},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:06.049409Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:a75c6ba6e1b99d942ec24902129b7a2d5d6ad424bf4ac1dc56284c6ec90b2017","observation_id":"0de74458-37cb-4d7b-be3b-ffbe4e5c0732","resolution":{"observed_at":"2026-08-06T21:46:11.740497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:11.466719Z","title":null,"venue":null,"work_id":"55986926-dcca-4d9a-8237-7035caba7391","year":2010},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:06.147418Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:739a3d01bdc5ac7f12096a81b392bb72a7c9c6ddda463d1f651e47c706ea5044","observation_id":"722d3ce5-9b34-4d5c-817b-ae328032b166","resolution":{"observed_at":"2026-08-06T21:46:11.542111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:11.329967Z","title":"M., and Pauly, J","venue":null,"work_id":"6ae08061-dec5-48ac-8a7b-46856070ae85","year":2007},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:06.257930Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:08ff940c1e69dd952ff72ff2092cdb22ab65d2413091b09f96feae6b18ecbe73","observation_id":"86bb6d45-fa7e-43ce-9b36-ab2c549fda74","resolution":{"observed_at":"2026-08-06T21:46:11.394267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:11.083119Z","title":"F., Davenport, M","venue":null,"work_id":"b5e31c23-c9c0-4cf8-a19a-d5fec4c54c46","year":2008},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:06.368486Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:7ff819afb2d9d5e71479d770e36e6eb3d08690625e525857ddb73359709657ce","observation_id":"9e9dcca7-d011-497b-90d2-fe5fa1fcb78e","resolution":{"observed_at":"2026-08-06T21:46:11.201970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:10.887713Z","title":null,"venue":null,"work_id":"385670a6-6d23-4e93-a1cf-c7dbc2caa89d","year":2009},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:06.460535Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:807fb4104e5effb9773b753feb352ec4fb8210692a44074efbb0451ce70d53c3","observation_id":"b51ea9b8-2d67-46ec-ad33-90be4a9823b1","resolution":{"observed_at":"2026-08-06T21:46:10.990089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:10.701658Z","title":null,"venue":null,"work_id":"82678186-9bad-40ff-bcb5-087d894db5ef","year":2018},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:06.607661Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:9e1ae0a5caf9cdf015ba074e41b5a6e14ae67575f919c524363848c1fbe112d3","observation_id":"4f15cab6-9822-49a8-b059-9351a324adac","resolution":{"observed_at":"2026-08-06T21:46:10.781796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:10.586543Z","title":null,"venue":null,"work_id":"bed21e6f-e08f-4a05-baf7-66b837a627ed","year":2018},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:06.807582Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:2e5215ff55ebfb84c6359da3e1b0e47f864b94774bfa893854dbff3a2f6cb670","observation_id":"87649138-81b3-401d-b517-87aa19800bd1","resolution":{"observed_at":"2026-08-06T21:46:10.651385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:10.441570Z","title":null,"venue":null,"work_id":"1e1abb5d-0db7-4417-a8a3-ddb1b6a6b418","year":2015},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:06.880628Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:a97ed1ab30b16d9822008b5a0b4655c9f358bc7a24e6f078a0c2eebcc6131ddf","observation_id":"09e1bfb2-e96a-47ef-80e6-c8d5dcaec2ec","resolution":{"observed_at":"2026-08-06T21:46:10.479488Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:10.292226Z","title":null,"venue":null,"work_id":"8f8e66a9-01b5-4259-bc24-dbc00ec4ddc6","year":2015},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:06.966831Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:1722bd5543661a8526d36b5db87477b04723d7254c16fa06cd60c9c73e4a7c06","observation_id":"ef8ff614-2642-4da5-9ab7-ef3f7aa42df7","resolution":{"observed_at":"2026-08-06T21:46:10.378945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:10.101022Z","title":null,"venue":null,"work_id":"6c21fbb2-cc9e-4b2a-938f-82da5b637156","year":2016},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.051167Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:814d011c326acd37b8974d9494d4a5195d92d1b3169643a626293a4cbf3c70b0","observation_id":"a762a702-5cfb-4335-a730-b6a28a212d6a","resolution":{"observed_at":"2026-08-06T21:46:10.178098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:09.930790Z","title":null,"venue":null,"work_id":"81f258f8-3375-48e7-ac9b-17240ec83aa2","year":2019},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.133250Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:4f0029f22a42e976ed62c0481abc9d95e6f7da49294670bd9c5cba9a4f37d71a","observation_id":"75f63d9f-7141-4f3b-b726-0c042f887bb0","resolution":{"observed_at":"2026-08-06T21:46:10.001749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:12.562061Z","title":"Y., and Donoho, D","venue":null,"work_id":"a922bb09-db19-49df-9c1f-3492206614ac","year":2020},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.239310Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:f6f8a6027810c41ee5ec82ec67d21901b798cf5f0fa5c56033b84c32de8e8972","observation_id":"75e8132f-f938-429e-8dc9-4bf5f0ec48fc","resolution":{"observed_at":"2026-08-06T21:46:12.657650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:09.712825Z","title":null,"venue":null,"work_id":"5a4fe0c3-bac2-4193-8b91-80c4e42e8393","year":2006},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.300982Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:f022aa4a94f7c5d0c276667c6f4375bdc3c38438136a7ea72107c3cb61d8253c","observation_id":"22c66c8f-1232-4eca-b39f-a6a048afff82","resolution":{"observed_at":"2026-08-06T21:46:09.830898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"0901.4102","last_updated":"2010-02-22T21:02:14Z","snapshot_observed_at":"2026-07-06T01:48:53.933925Z","submitted_at":"2009-01-26T21:00:09Z","title":"Universal decay cascade model for dynamic quantum dot initialization","version":2},"cited_work":{"arxiv_id":"0901.4102","doi":null,"metadata_source":"pith","pith_arxiv_id":"0901.4102","snapshot_observed_at":"2026-08-06T21:46:08.317167Z","title":"Universal decay cascade model for dynamic quantum dot initialization","venue":"cond-mat.mes-hall","work_id":"5e805fff-cd6e-4663-82a3-40f880958e7a","year":2009},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.369706Z"},"links":{"cited_paper":"/paper/0901.4102","citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:f1f2d38e303851946f02df8c7c8df2853ce0416428fe1644d171a521d8f7b117","observation_id":"7ece550d-ecc5-45e2-ac88-909966b672d6","resolution":{"observed_at":"2026-08-06T21:46:08.344543Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:09.531182Z","title":"Robust uncertainty principles: Exact signal reconstruction from highly incomplete frequency information","venue":null,"work_id":"e5dd28b2-dc0f-4bd9-82cf-8b985c525050","year":2006},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.455375Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:f0a95168324c015acbc10299034555c46f690925afd64c32247fef933794a22b","observation_id":"5781fbf5-3649-4b0d-9a78-1f3257f82fff","resolution":{"observed_at":"2026-08-06T21:46:09.606438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:09.385432Z","title":"S., Donoho, D","venue":null,"work_id":"c4e380ed-e839-49bc-9b65-e892d43cca83","year":2001},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.545627Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:43b67d2186211db583d42d88852a32130d7981575b316423b91412b93ea42bee","observation_id":"0a4cf035-94fd-4b2d-8d1b-ff6560958f96","resolution":{"observed_at":"2026-08-06T21:46:09.447791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:09.254306Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., and Sutskever, I","venue":null,"work_id":"0d0f3c3d-c186-4b10-8e2a-5fa018bacb32","year":2021},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.636982Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:82b8d35b999d2551ebcb1b171f879988e64e96643d787ec14ead7cb16cfeb118","observation_id":"cf9f7cfc-6938-44de-a845-b4b4a36e8583","resolution":{"observed_at":"2026-08-06T21:46:09.315152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:09.064114Z","title":null,"venue":null,"work_id":"1c22cca4-d892-4f53-977a-7dce3396d630","year":2022},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.698638Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:e97086189a01f302fcaf0f22b2e93ac793813ca7e0b6b89ba3508b6158135628","observation_id":"f0bafd4c-a51d-4fe7-8ec4-321fea2f17dc","resolution":{"observed_at":"2026-08-06T21:46:09.168350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-07-06T13:05:12.350238Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-06T21:46:07.771553Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.771553Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:38f510ea37e6ba22272a2ac484b904e025e021d57cbc1cc412750587a21eab50","observation_id":"aef837c9-0992-4bdb-94ae-3e0afcd318a1","resolution":{"observed_at":"2026-08-06T21:46:07.771553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:08.961047Z","title":null,"venue":null,"work_id":"a95e54e3-03ee-4c2a-beab-60fcb799dd0d","year":2021},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.818690Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:9c0cd26eeae20abc046dd95325ad81d811e49990c3c714ae0012e835949f37ea","observation_id":"0ccb9e6b-3b50-4054-84c2-b7089c54d138","resolution":{"observed_at":"2026-08-06T21:46:08.994682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:08.805372Z","title":null,"venue":null,"work_id":"dc1be98d-9b44-45ec-ad71-335014752367","year":2021},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.822130Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:8d33117c5059d36cf77cfee168aaa14127d69dc0803669ff6f4c476cd76f0246","observation_id":"8d1bafe8-540b-427c-ba0e-3477f74bdbf8","resolution":{"observed_at":"2026-08-06T21:46:08.872804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-09T19:46:04.857927Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-06T21:46:07.859298Z","title":"Generating long sequences with sparse transformers","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.859298Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:001c938c7cf444e3d88e70aa9eedbf128229b913683f3065ff8ba3ca8d845572","observation_id":"cef2c18a-7e25-44a7-b8fa-f00d1c358abd","resolution":{"observed_at":"2026-08-06T21:46:07.859298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-06T21:46:07.910631Z","title":"Linformer: Self-attention with linear complexity","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.910631Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:c1e56947c337eacc3e013c789ae02e77be5f7c892c4cd95242272ed68d5aba55","observation_id":"c40ca771-9da1-4d49-acb5-4ab315c71807","resolution":{"observed_at":"2026-08-06T21:46:07.910631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:08.626065Z","title":"Rethinking attention with performers","venue":null,"work_id":"d93fd03c-a6bd-4cd2-aa61-7f143b00f18f","year":2021},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:07.959201Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:c74c530f17d64cbdd5c2290405097a35147773697b2fd7d0436cf790c58191da","observation_id":"8f26e54b-89c6-4dbc-99b7-46f5fdb40751","resolution":{"observed_at":"2026-08-06T21:46:08.712825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-06T21:46:08.020102Z","title":"Longformer: The long-document trans- former","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:08.020102Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:643ec66925cdcee30d3927ac38d158a26ccf09e0564a24940176c0cb37de31e6","observation_id":"f08aa14e-59f9-42cb-87ba-5eee910bfb48","resolution":{"observed_at":"2026-08-06T21:46:08.020102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:08.496992Z","title":"Big bird: Transformers for longer sequences","venue":null,"work_id":"fb73cc85-03f7-40c0-bdcf-5f1bd49e8d6d","year":2020},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:08.096008Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:ccbd870075435f54807fbfacf99241d74a901c3ee8a6ea1cde90105a03e7c4ca","observation_id":"2450f54a-c237-4304-ba9f-d0d3a954782f","resolution":{"observed_at":"2026-08-06T21:46:08.554785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:46:08.395901Z","title":"Learning fast approximations of sparse coding","venue":null,"work_id":"1f81b11f-7b08-4c5e-861f-7b030301866f","year":2010},"citing_paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:46:08.165002Z"},"links":{"citing_paper":"/paper/2507.02957"},"observation_digest":"sha256:4adbfb301723a606ec1f79a31753af0c513a190b40d1e968618b04bbc4ffe33e","observation_id":"cf370313-e3dd-4e72-a9af-df5375df4dc1","resolution":{"observed_at":"2026-08-06T21:46:08.435067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.02957","last_updated":"2025-06-30T02:11:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T07:28:13.283512Z","submitted_at":"2025-06-30T02:11:20Z","title":"CS-VLM: Compressed Sensing Attention for Efficient Vision-Language Representation Learning"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2507.02957."}