{"as_of":"2026-08-09T16:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:871cc0aa2bd0c627e854af732fd4b629ce0786278f022808e34fe7af142321d9","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T18:30:14.608010Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06060/citation-record","integrity":"/paper/2608.06060/integrity","json":"/paper/2608.06060/citation-record.json","paper":"/paper/2608.06060"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23115","last_updated":"2025-06-29T06:41:00Z","snapshot_observed_at":"2026-08-07T01:05:19.522559Z","submitted_at":"2025-06-29T06:41:00Z","title":"MoCa: Modality-aware Continual Pre-training Makes Better Bidirectional Multimodal Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23115","snapshot_observed_at":"2026-08-07T18:30:14.527131Z","title":"Moca: Modality-aware continual pre-training makes better bidirectional multimodal embeddings.arXiv preprint arXiv:2506.23115,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.527131Z"},"links":{"cited_paper":"/paper/2506.23115","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:1be0d45dc17454ed3219970e856a862a89b2482a47a2aaf5a5c44dd7d19ea72c","observation_id":"7f1dddab-eb44-4019-8c3f-db21b1a3070f","resolution":{"observed_at":"2026-08-07T18:30:14.527131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.550576Z","title":"Embed-rl: Reinforcement learning for reasoning-driven multimodal embeddings.arXiv preprint arXiv:2602.13823,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.550576Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:1ca0d6b6d4dc6f2101ecaea8dbaf6bdf585fba0fe66cf0d786d8311fd00e39b7","observation_id":"742b9810-5892-4143-b4ab-5b95769784c3","resolution":{"observed_at":"2026-08-07T18:30:14.550576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05160","last_updated":"2025-01-02T05:26:47Z","snapshot_observed_at":"2026-07-06T19:29:05.492290Z","submitted_at":"2024-10-07T16:14:05Z","title":"VLM2Vec: Training Vision-Language Models for Massive Multimodal Embedding Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05160","snapshot_observed_at":"2026-08-07T18:30:14.554873Z","title":"Vlm2vec: Training vision-language models for massive multimodal embedding tasks.arXiv preprint arXiv:2410.05160,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.554873Z"},"links":{"cited_paper":"/paper/2410.05160","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:1fd42fb9c5d00165cde68571debddf054ec80007421f599f58462fd4e8e91f75","observation_id":"40c57ff9-17ae-4ee2-a47f-c7cc6957cb82","resolution":{"observed_at":"2026-08-07T18:30:14.554873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19650","last_updated":"2025-05-27T11:57:17Z","snapshot_observed_at":"2026-08-09T09:30:25.697403Z","submitted_at":"2025-05-26T08:09:44Z","title":"Modality Curation: Building Universal Embeddings for Advanced Multimodal Information Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19650","snapshot_observed_at":"2026-08-07T18:30:14.559722Z","title":"Glint Lab Fanheng Kong, Jingyuan Zhang, Yahui Liu, Hongzhi Zhang, Shi Feng, Xiaocui Yang, Daling Wang, Yu Tian, Fuzheng Zhang, Guorui Zhou, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.559722Z"},"links":{"cited_paper":"/paper/2505.19650","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:e31f5701a88317cd4a2e1e4a8e63f3a98147f61edad77dd45898919f9a00a56c","observation_id":"8ba9a618-5492-42cf-be31-7c0106c94e0c","resolution":{"observed_at":"2026-08-07T18:30:14.559722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.564287Z","title":"Ume-r1: Exploring reasoning- driven generative multimodal embeddings.arXiv preprint arXiv:2511.00405,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.564287Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:9eb1af39eed9ee05c67c0a566c136fa58891d7d1e45d282360ac08c47e8136b5","observation_id":"2d6f7373-29c3-4b45-b6a1-990da47f48b2","resolution":{"observed_at":"2026-08-07T18:30:14.564287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04590","last_updated":"2025-07-07T00:51:57Z","snapshot_observed_at":"2026-08-08T15:48:31.665148Z","submitted_at":"2025-07-07T00:51:57Z","title":"VLM2Vec-V2: Advancing Multimodal Embedding for Videos, Images, and Visual Documents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.04590","snapshot_observed_at":"2026-08-07T18:30:14.572507Z","title":"Vlm2vec-v2: Advancing multimodal embedding for videos, images, and visual documents.arXiv preprint arXiv:2507.04590,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.572507Z"},"links":{"cited_paper":"/paper/2507.04590","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:1a501cbeba827075daadeae7a0ef6e4468369f2d29ee66c2aeae1705ff5fc43c","observation_id":"ab78b92b-216d-47a3-bc02-d8a657440da9","resolution":{"observed_at":"2026-08-07T18:30:14.572507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00741","last_updated":"2024-10-04T16:10:38Z","snapshot_observed_at":"2026-07-06T19:25:19.661028Z","submitted_at":"2024-10-01T14:33:22Z","title":"VideoCLIP-XL: Advancing Long Description Understanding for Video CLIP Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00741","snapshot_observed_at":"2026-08-07T18:30:14.584902Z","title":"Videoclip-xl: Ad- vancing long description understanding for video clip models.arXiv preprint arXiv:2410.00741, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.584902Z"},"links":{"cited_paper":"/paper/2410.00741","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:47458692915dbcab23482c0dd7b7a52e3f418a86d1b34e0ac44f7d8d9927394e","observation_id":"85f421ea-4091-4a7b-82a6-397c160dea31","resolution":{"observed_at":"2026-08-07T18:30:14.584902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12364","last_updated":"2025-06-22T13:42:54Z","snapshot_observed_at":"2026-08-07T00:49:22.617336Z","submitted_at":"2025-06-14T05:55:00Z","title":"MM-R5: MultiModal Reasoning-Enhanced ReRanker via Reinforcement Learning for Document Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12364","snapshot_observed_at":"2026-08-07T18:30:14.590920Z","title":"Internvideo2: Scaling foundation models for multimodal video understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.590920Z"},"links":{"cited_paper":"/paper/2506.12364","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:79c2a0c0ce7b50b52c5639c2e0771e432705cf62f5e4f637e92815788bb0dd1a","observation_id":"6135702c-b638-46ac-b88a-cda1b3231667","resolution":{"observed_at":"2026-08-07T18:30:14.590920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T18:30:14.598702Z","title":"Glint Lab An Yang, Anfeng Li, Baosong Yang, Beichen Zhang, Binyuan Hui, Bo Zheng, Bowen Yu, Chang Gao, Chengen Huang, Chenxu Lv, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.598702Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:11c5fd744bb5b693fcee847992baf4cfd5873dac489a70214060a4d1901036ea","observation_id":"ad2330b3-fa39-44ba-99bb-fd0df4870258","resolution":{"observed_at":"2026-08-07T18:30:14.598702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16855","last_updated":"2025-04-01T08:48:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-22T04:40:24Z","title":"GME: Improving Universal Multimodal Retrieval by Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16855","snapshot_observed_at":"2026-08-07T18:30:14.603232Z","title":"thinking with images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.603232Z"},"links":{"cited_paper":"/paper/2412.16855","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:e03413afeae4850da3e9b30a32cc3a42c22fb9133a674d70ad1af13623ce95c6","observation_id":"a5ffab50-e40f-431a-a8d9-172804f68d5a","resolution":{"observed_at":"2026-08-07T18:30:14.603232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14475","last_updated":"2024-12-19T02:49:55Z","snapshot_observed_at":"2026-08-06T11:46:20.152196Z","submitted_at":"2024-12-19T02:49:55Z","title":"MegaPairs: Massive Data Synthesis For Universal Multimodal Retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14475","snapshot_observed_at":"2026-08-07T18:30:14.608010Z","title":"Megapairs: Massive data synthesis for universal multimodal retrieval.arXiv preprint arXiv:2412.14475,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.608010Z"},"links":{"cited_paper":"/paper/2412.14475","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:4dcf41d1aabf17c63e428d32d725fd0ebdad3c9c4fa364322721b8441fda158f","observation_id":"a7f1fb02-e0e9-475e-aa65-791472167c6d","resolution":{"observed_at":"2026-08-07T18:30:14.608010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T18:30:14.577817Z","title":"Deepseekmath: Pushing the limits of mathemati- cal reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.577817Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:8cc7e2f7775682ba02e3d2d6bb74a410d09eacfd2286bfa553257036a40dc2dd","observation_id":"6efd0bf0-e9c2-4c1d-9862-307840b2d3d5","resolution":{"observed_at":"2026-08-07T18:30:14.577817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.545936Z","title":"Rzenembed: Towards comprehensive multimodal retrieval.arXiv preprint arXiv:2510.27350,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.545936Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:02ab5a945e51010a46b5cc9dceef67a5900fce22b7d944a0703164d0900b9ebd","observation_id":"422daba4-f477-4d6d-80ae-2107f7d2da6a","resolution":{"observed_at":"2026-08-07T18:30:14.545936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.568558Z","title":"Rematch: Boosting representation through matching for multimodal retrieval.arXiv preprint arXiv:2511.19278, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.568558Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:3c2caeee0c5ee28c0b5fce119466cd673606434c16c31f89bbfb395c6e84c2ab","observation_id":"285969cf-af0f-4145-9132-eb5211656639","resolution":{"observed_at":"2026-08-07T18:30:14.568558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:30:14.532201Z","title":"Think then embed: Generative context improves multimodal embedding.arXiv preprint arXiv:2510.05014,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.532201Z"},"links":{"citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:dc30a6be5608eb0db66a54c6be4db8821ae1261c13797b701b2e667d0a0f1029","observation_id":"2baeb1c9-e4c8-4cba-a3e4-4d3d9e67e6e8","resolution":{"observed_at":"2026-08-07T18:30:14.532201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01449","last_updated":"2025-02-28T08:51:57Z","snapshot_observed_at":"2026-07-06T18:39:43.472708Z","submitted_at":"2024-06-27T15:45:29Z","title":"ColPali: Efficient Document Retrieval with Vision Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01449","snapshot_observed_at":"2026-08-07T18:30:14.536725Z","title":"Colpali: Efficient document retrieval with vision language models, 2024.URL https://arxiv","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.536725Z"},"links":{"cited_paper":"/paper/2407.01449","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:9890b4e8c604d747009b2438d2c6f90ae07872510860fd0b4ede3ecca2091e3e","observation_id":"2d898673-6972-4693-bf25-bfa801d33b80","resolution":{"observed_at":"2026-08-07T18:30:14.536725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T18:30:14.541475Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-07T18:30:14.541475Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.06060"},"observation_digest":"sha256:b5f76bbc0660a747b1144d0e65506f2f7262b9649aca06bbec8649c1151bc84f","observation_id":"ea4e211a-a7be-4b94-afdd-2a8fbb05409f","resolution":{"observed_at":"2026-08-07T18:30:14.541475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06060","last_updated":"2026-08-06T14:04:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T16:12:29.362984Z","submitted_at":"2026-08-06T14:04:56Z","title":"Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2608.06060."}