{"as_of":"2026-08-23T22:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9aa23a261b982b9494bd4980708e56c748823156344bdbcf86a63cfb5ef476e8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:14:46.090733Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T13:01:23.442335Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-08-07T14:14:46.090733Z","title":"Cafe: Unifying representation and generation with contrastive-autoregressive finetuning.arXiv preprint arXiv:2503.19900, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19650","last_updated":"2025-05-27T11:57:17Z","snapshot_observed_at":"2026-08-13T17:49:48.523840Z","submitted_at":"2025-05-26T08:09:44Z","title":"Modality Curation: Building Universal Embeddings for Advanced Multimodal Information Retrieval","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T14:14:46.090733Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2505.19650"},"observation_digest":"sha256:c5a271717b1e1929e6a6876e5d4cc0abb098142be1cff3bf85a17e842a60240d","observation_id":"25d936f7-e057-4d04-b373-1597cff5eec4","resolution":{"observed_at":"2026-08-07T14:14:46.090733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":"2503.19900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cafe: Unifying representation and generation with contrastive-autoregressive finetuning.arXiv preprint arXiv:2503.19900","venue":null,"work_id":"1d6d7788-bb38-481e-aba9-0602b8b4e115","year":2022},"citing_paper":{"arxiv_id":"2509.24621","last_updated":"2026-05-25T10:53:36Z","snapshot_observed_at":"2026-08-08T21:41:13.842209Z","submitted_at":"2025-09-29T11:28:42Z","title":"FreeRet: MLLMs as Training-Free Retrievers","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T13:00:31.952588Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2509.24621"},"observation_digest":"sha256:36a13b72d03532ec3ccd07e8e3e5be9b359dc0afcb33f56cb9e2935b38a86979","observation_id":"a4adf723-817b-4801-b3c7-c019e1f02a19","resolution":{"observed_at":"2026-05-18T13:01:23.445197Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-08-04T13:51:47.574156Z","title":"Cafe: Unifying representation and generation with contrastive-autoregressive finetuning.arXiv preprint arXiv:2503.19900,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24621","last_updated":"2026-05-25T10:53:36Z","snapshot_observed_at":"2026-08-08T21:41:13.842209Z","submitted_at":"2025-09-29T11:28:42Z","title":"FreeRet: MLLMs as Training-Free Retrievers","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T13:51:47.574156Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2509.24621"},"observation_digest":"sha256:243ec183d22307f46b571e2c1afa4c50274e68f3c8980e2bd917df9602c973a5","observation_id":"8b1ae8c2-680d-4d1b-b0d2-8cf5074c2f69","resolution":{"observed_at":"2026-08-04T13:51:47.574156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":"2503.19900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cafe: Unifying representation and generation with contrastive-autoregressive finetuning.arXiv preprint arXiv:2503.19900","venue":null,"work_id":"1d6d7788-bb38-481e-aba9-0602b8b4e115","year":2022},"citing_paper":{"arxiv_id":"2601.21262","last_updated":"2026-04-16T06:59:30Z","snapshot_observed_at":"2026-08-11T08:05:18.804557Z","submitted_at":"2026-01-29T04:47:27Z","title":"CausalEmbed: Auto-Regressive Multi-Vector Generation in Latent Space for Visual Document Embedding","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T10:14:15.589472Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2601.21262"},"observation_digest":"sha256:876ac38b920e3d554143b846e4aa1787fb473a4223210811bcfb3e4f608f0117","observation_id":"1f307645-8177-4491-b677-ae03b0afe628","resolution":{"observed_at":"2026-05-16T10:17:44.647572Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":"2503.19900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cafe: Unifying representation and generation with contrastive-autoregressive finetuning.arXiv preprint arXiv:2503.19900","venue":null,"work_id":"1d6d7788-bb38-481e-aba9-0602b8b4e115","year":2022},"citing_paper":{"arxiv_id":"2602.19549","last_updated":"2026-04-20T01:43:08Z","snapshot_observed_at":"2026-07-06T22:46:45.213871Z","submitted_at":"2026-02-23T06:45:19Z","title":"Sculpting the Vector Space: Towards Efficient Multi-Vector Visual Document Retrieval via Prune-then-Merge Framework","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T20:56:06.005832Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2602.19549"},"observation_digest":"sha256:d15e7edf35729584d1996061482b3c8dd6f0edefae2631a9e323481ed403e5cd","observation_id":"9f2813a8-002f-4678-9bb6-c811d8ffb558","resolution":{"observed_at":"2026-05-15T20:56:37.061227Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":"2503.19900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cafe: Unifying representation and generation with contrastive-autoregressive finetuning.arXiv preprint arXiv:2503.19900","venue":null,"work_id":"1d6d7788-bb38-481e-aba9-0602b8b4e115","year":2022},"citing_paper":{"arxiv_id":"2604.02073","last_updated":"2026-04-20T03:16:36Z","snapshot_observed_at":"2026-08-12T20:46:06.502061Z","submitted_at":"2026-04-02T14:04:53Z","title":"PLUME: Latent Reasoning Based Universal Multimodal Embedding","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T21:48:40.722921Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2604.02073"},"observation_digest":"sha256:8e3f5007888e1b5226831de207a9a8411b13181a2ba01881fc1e865c3a5ccfe6","observation_id":"9d2a5160-8c06-406c-8ca9-295e6b704ad0","resolution":{"observed_at":"2026-05-13T21:53:20.015992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":"2503.19900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cafe: Unifying representation and generation with contrastive-autoregressive finetuning.arXiv preprint arXiv:2503.19900","venue":null,"work_id":"1d6d7788-bb38-481e-aba9-0602b8b4e115","year":2022},"citing_paper":{"arxiv_id":"2604.11095","last_updated":"2026-04-13T07:12:12Z","snapshot_observed_at":"2026-07-06T22:59:36.571641Z","submitted_at":"2026-04-13T07:12:12Z","title":"Bottleneck Tokens for Unified Multimodal Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:14:00.615638Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2604.11095"},"observation_digest":"sha256:1ff8bf227761da985eb45f1056edcabe7e3b67e990465ded10fdfd7ad201e88f","observation_id":"07513ae9-15e3-4099-949b-691335d695f7","resolution":{"observed_at":"2026-05-11T11:01:03.326814Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":"2503.19900","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cafe: Unifying representation and generation with contrastive-autoregressive finetuning.arXiv preprint arXiv:2503.19900","venue":null,"work_id":"1d6d7788-bb38-481e-aba9-0602b8b4e115","year":2022},"citing_paper":{"arxiv_id":"2604.22280","last_updated":"2026-07-15T17:09:27Z","snapshot_observed_at":"2026-08-12T02:51:12.283101Z","submitted_at":"2026-04-24T06:50:11Z","title":"Beyond Chain-of-Thought: Rewrite as a Universal Interface for Generative Multimodal Embeddings","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T12:46:30.827346Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2604.22280"},"observation_digest":"sha256:0f84922c2ee63ce432a27eb5305ae0d2378bdd0317270b54c8d0f90ad9d9de05","observation_id":"3ba4ca6a-b5b5-4455-83e8-a1c921ef92f0","resolution":{"observed_at":"2026-05-11T19:06:08.409291Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-07-12T18:31:37.144968Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.22280","last_updated":"2026-07-15T17:09:27Z","snapshot_observed_at":"2026-08-12T02:51:12.283101Z","submitted_at":"2026-04-24T06:50:11Z","title":"Beyond Chain-of-Thought: Rewrite as a Universal Interface for Generative Multimodal Embeddings","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-12T18:31:37.144968Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2604.22280"},"observation_digest":"sha256:0d0787e2522969fbcb31aeec78ea4ad9c8ea3959ce8d3f2b4b7a2c4fb04acaee","observation_id":"7d78defd-4783-4ed4-b733-637cf37c92d9","resolution":{"observed_at":"2026-07-12T18:31:37.144968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19900","snapshot_observed_at":"2026-08-02T15:40:29.273705Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.22280","last_updated":"2026-07-15T17:09:27Z","snapshot_observed_at":"2026-08-12T02:51:12.283101Z","submitted_at":"2026-04-24T06:50:11Z","title":"Beyond Chain-of-Thought: Rewrite as a Universal Interface for Generative Multimodal Embeddings","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T15:40:29.273705Z"},"links":{"cited_paper":"/paper/2503.19900","citing_paper":"/paper/2604.22280"},"observation_digest":"sha256:177bd498f26633118edb2a24944638e3a8df539d025a1cd66427f8ae0053c01c","observation_id":"db6aeff2-1dde-4258-b7bb-5bb7e7c40dfb","resolution":{"observed_at":"2026-08-02T15:40:29.273705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.19900/citation-record","integrity":"/paper/2503.19900/integrity","json":"/paper/2503.19900/citation-record.json","paper":"/paper/2503.19900"},"outbound":[],"paper":{"arxiv_id":"2503.19900","last_updated":"2025-03-25T17:57:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T18:32:28.321496Z","submitted_at":"2025-03-25T17:57:17Z","title":"CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2503.19900."}