{"as_of":"2026-08-13T06:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:716daf16eed32f7506a38fc15f8e1d304d4cb371eb8e6bebe594c8fb949a2e77","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:13:50.370465Z","state":"measured"},{"denominator":97,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":97,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.00639/citation-record","integrity":"/paper/2412.00639/integrity","json":"/paper/2412.00639/citation-record.json","paper":"/paper/2412.00639"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T05:13:49.965500Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:49.965500Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:e2beaea4c7a817f65ba87d05284c850b4536c058f9faaad5688bd15396f9ffff","observation_id":"f99fdae7-f186-4a29-91aa-be9c0d060fd7","resolution":{"observed_at":"2026-08-12T05:13:49.965500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:49.970814Z","title":"nocaps: novel object captioning at scale","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:49.970814Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:f18eaea53d114f30b3045e63e72816ced390ab7c364c934ed68b045af4f3e238","observation_id":"e51d17be-8da4-4c6d-8303-1c909f63a461","resolution":{"observed_at":"2026-08-12T05:13:49.970814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:49.975713Z","title":"Natural language interfaces to databases–an introduction.Natural language engineering, 1(1):29–81, 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:49.975713Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:811e4cd301970b4f52e4f02f050e8e0b785edc7657720238f3918872798a734b","observation_id":"9c6e25b8-0853-4cc9-ab11-c806ca290241","resolution":{"observed_at":"2026-08-12T05:13:49.975713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:49.980207Z","title":"Modeling score distributions in information retrieval","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:49.980207Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:007b712a1faaa543a5c30675bf2b76181b2765e0923711e544e0dd841f7bfd37","observation_id":"e98e2486-026c-446b-ad42-2cedaeb42f24","resolution":{"observed_at":"2026-08-12T05:13:49.980207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:49.985333Z","title":"The multiplicative weights update method: a meta-algorithm and applications.Theory of computing, 8(1):121–164, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:49.985333Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:3509c247b4d05fe18d22a3491f451e6b696f90f7664ace906b3f08ab86bc41d4","observation_id":"77dd7599-b6a6-4079-a710-bd6b4dc900ef","resolution":{"observed_at":"2026-08-12T05:13:49.985333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:49.989522Z","title":"Deep neural architecture for multi-modal retrieval based on joint embedding space for text and images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:49.989522Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:c3af7e7de4076bab410becd2a67b0d214009c44f6eac4c76a13ebce66dddbe10","observation_id":"57abeed8-565f-4cac-8319-4ce2ace18c6a","resolution":{"observed_at":"2026-08-12T05:13:49.989522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08254","last_updated":"2022-09-03T14:11:33Z","snapshot_observed_at":"2026-07-06T11:19:34.705520Z","submitted_at":"2021-06-15T16:02:37Z","title":"BEiT: BERT Pre-Training of Image Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08254","snapshot_observed_at":"2026-08-12T05:13:49.994257Z","title":"Beit: Bert pre-training of image trans- formers.arXiv preprint arXiv:2106.08254, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:49.994257Z"},"links":{"cited_paper":"/paper/2106.08254","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:68f909b32435b126e1c85d8d9c94de364f9e42295e83f14907627eb17380e49e","observation_id":"38b437d3-b40d-449c-8940-30c75d535822","resolution":{"observed_at":"2026-08-12T05:13:49.994257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:49.999104Z","title":"Lof: identifying density-based local outliers","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:49.999104Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:2cdeef4970838f35017ed181ec51c8bfbf66e45670c372df4e0a54a5547113be","observation_id":"d7091c3c-5543-4e28-8f7c-1df79dc68aa1","resolution":{"observed_at":"2026-08-12T05:13:49.999104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T05:13:50.003495Z","title":"Language models are few-shot learners.arXiv preprint arXiv:2005.14165, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.003495Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:9a70bff60f0084c53f7b3d1b106f4677b2ee9e0ccc2bb3164642c35d8e2db8be","observation_id":"f58a3298-5b37-4db0-986e-9fadf93dbe80","resolution":{"observed_at":"2026-08-12T05:13:50.003495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.007478Z","title":"Large-scale content-based audio retrieval from text queries","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.007478Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:eedfb26ade685c21b6b66691c54d384ff9a7c7da721abe4122e02bbab6de9b8f","observation_id":"5699e3d3-aed3-4c48-a0de-80554a1c9d5f","resolution":{"observed_at":"2026-08-12T05:13:50.007478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.011482Z","title":"Image search with text feedback by visiolin- guistic attention learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.011482Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:ca44dc9b377e6f754f38569775880d630446859a1fb81bf20c0beec9007269da","observation_id":"b9799d22-6efb-4d50-ac87-7651439ed677","resolution":{"observed_at":"2026-08-12T05:13:50.011482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.014877Z","title":"Palm: Scaling language modeling with pathways.Journal of Machine Learning Research, 24(240):1– 113, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.014877Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:34751cc4ad7cf718e725988776dbbb3d6565f2784a5052bfa0a1666e70b5d6f8","observation_id":"d96eb973-9567-41a8-9220-cc07cc9dfd36","resolution":{"observed_at":"2026-08-12T05:13:50.014877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.018126Z","title":"On the inference of average precision from score distributions","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.018126Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:a16e1602a1c3906bafeeb12dcfd9b279bbbe565e9de27513d2ee6a9a0f57a993","observation_id":"25a79af1-081f-4524-ad33-22043aa41391","resolution":{"observed_at":"2026-08-12T05:13:50.018126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.022300Z","title":"Advanced generative ai methods for academic text summarization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.022300Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:398d405019a34e58c08e0492e23a2fca09b7b711fdcd828d3b36ecdbf87ddbd6","observation_id":"aa50658b-cec6-4f16-bc5e-fb550934c407","resolution":{"observed_at":"2026-08-12T05:13:50.022300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-12T05:13:50.026286Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.026286Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:1f329fe2672a44f83ed678bcd067372ac3446bd7ed9e9e16debbe2cc4c3afb45","observation_id":"7e8e4b06-79b1-4fd3-b231-6c39bf7d9fbd","resolution":{"observed_at":"2026-08-12T05:13:50.026286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.030109Z","title":"Chameleon: Foundation models for fairness-aware multi-modal data augmentation to enhance coverage of minorities.Proceedings of the VLDB Endowment, 17(11):3470–3483, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.030109Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:77f6428d0301646eddcd46255d666b60c7a539dd9485665c7779375d30815576","observation_id":"f06a8ab1-4cdd-45ea-8006-5100a071ca6d","resolution":{"observed_at":"2026-08-12T05:13:50.030109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.033689Z","title":"Optimal aggregation algorithms for middleware","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.033689Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:93478786c3b22914244972a79a521d3e7b8a0c7870131c5cfdae2dd7d8753854","observation_id":"d76fb0e0-b9fe-40a3-b236-bf0e5cbaaa33","resolution":{"observed_at":"2026-08-12T05:13:50.033689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.037369Z","title":"Eva: Exploring the limits of masked visual representation learning at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.037369Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:943671beb44a825e791669def21bd9121f8686540c4651dfbe48b475a4cc4fcc","observation_id":"718b4582-6d69-445b-b8fd-71eefe25f421","resolution":{"observed_at":"2026-08-12T05:13:50.037369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.042175Z","title":"Learning to rank for content-based image retrieval","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.042175Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:6caed4840489418d3f07b924203e6f6747f976e1fb72c93c3b3ff3167661423b","observation_id":"0107312c-94cc-49be-b681-6bd2b300f255","resolution":{"observed_at":"2026-08-12T05:13:50.042175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.046114Z","title":"Tagging personal photos with transfer deep learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.046114Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:20a064fef01494738762873a7b231b49930d71377156e388a795b7d035d76764","observation_id":"d71f1b6d-420a-43ae-9bb3-e68e77264893","resolution":{"observed_at":"2026-08-12T05:13:50.046114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.050267Z","title":"Caltech 256, Apr 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.050267Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:23d9045fc9ac2d76671428c01b63d773c4b24646996aacab56f4705b8a051862","observation_id":"2dd88f8f-409b-42bd-ab01-66df36b47123","resolution":{"observed_at":"2026-08-12T05:13:50.050267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.054344Z","title":"Lvis: A dataset for large vocabulary instance segmentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.054344Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:7ca5908c7c2ba2d5c849518303f3fb797633ba6ea4e603e4e52e2bcfd8773d31","observation_id":"4c1834f8-3053-4e0e-9428-7483bf25f9b8","resolution":{"observed_at":"2026-08-12T05:13:50.054344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.421821Z","title":"Query-aware locality- sensitive hashing for approximate nearest neighbor search.Proceedings of the VLDB Endow- ment, 9(1):1–12, 2015","venue":null,"work_id":"3c8a18b7-06a7-47f1-b2da-c9ce9ed98d4e","year":2015},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.058116Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:939437fa729d6bb792a3ee197dad20a2ffba0b51afb87e1a104b4bf36117c472","observation_id":"7ef73d95-267e-4278-a89d-f361fa874559","resolution":{"observed_at":"2026-08-12T05:13:51.426992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.08942","last_updated":"2021-02-17T18:56:03Z","snapshot_observed_at":"2026-08-11T15:57:00.543511Z","submitted_at":"2021-02-17T18:56:03Z","title":"A Survey on Locality Sensitive Hashing Algorithms and their Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.08942","snapshot_observed_at":"2026-08-12T05:13:50.063085Z","title":"A survey on locality sensitive hashing algorithms and their applications.arXiv preprint arXiv:2102.08942, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.063085Z"},"links":{"cited_paper":"/paper/2102.08942","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:b47d52e9f1a928b20031ba1674d88455afb0a50288e4b463be7e6538da30bdce","observation_id":"5ab79138-f222-4035-8262-9d528fc8e689","resolution":{"observed_at":"2026-08-12T05:13:50.063085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.068261Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.068261Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:ebc35b61aadfd499cbb3157b8f6d3e6257e4b7f41b026762cf9c3fafce1cd599","observation_id":"057b21af-7de1-4f0d-a017-abce482aa55c","resolution":{"observed_at":"2026-08-12T05:13:50.068261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.401068Z","title":"Semantically- enhanced kernel canonical correlation analysis: a multi-label cross-modal retrieval.Multimedia Tools and Applications, 78:13169–13188, 2019","venue":null,"work_id":"499132a1-1dc5-49bc-919a-6d68b04b54aa","year":2019},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.072300Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:831e5b1446943d18dd633dbb7352c61124545415c511969f822b25239dca22e6","observation_id":"71b3d95b-8376-4f19-8b7a-af19db71c69b","resolution":{"observed_at":"2026-08-12T05:13:51.405017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.388830Z","title":"Learning image embeddings using convolutional neural networks for improved multi-modal semantics","venue":null,"work_id":"800a7541-3f28-491e-959e-d2bf8b8e8a9e","year":2014},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.076231Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:1d814e76e14e375b622e56a053a49c47092c941877aa190d1db606b6310a3c29","observation_id":"7cfeaa99-326f-44a0-89d3-9c1bace21c85","resolution":{"observed_at":"2026-08-12T05:13:51.393184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.375536Z","title":"Audio retrieval with natural language queries: A benchmark study.IEEE Transactions on Multimedia, 25:2675–2685, 2022","venue":null,"work_id":"08026e11-6eb2-4d68-aac1-d47cc764e885","year":2022},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.080367Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:5f97e5b57275429107805b10fc88812a4dbf12a54ffcd64553c9e4047fe308e2","observation_id":"7627731e-0837-4092-84c9-3b5c377802e9","resolution":{"observed_at":"2026-08-12T05:13:51.380041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.363689Z","title":"V oronoi-based k nearest neighbor search for spatial network databases","venue":null,"work_id":"dba2d688-085c-431e-807c-3b5f0c4a0067","year":2004},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.084103Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:e91a3234c923875d8f7a6625fcfa9462945e231457c81bbd4b8cadf30d7d6f59","observation_id":"26bd95fe-75fb-4c16-9fe7-a8e231623295","resolution":{"observed_at":"2026-08-12T05:13:51.367627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.350401Z","title":"Using synthetic data to train neural networks is model-based reasoning","venue":null,"work_id":"8f1f5710-29a3-44eb-892c-092df01a1fac","year":2017},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.087437Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:a14373a5137619884aac211e7655ec634b70569ff6293e48b07c0cd42a846b48","observation_id":"efadf8ee-9373-4aab-9eb4-ea0dabe58245","resolution":{"observed_at":"2026-08-12T05:13:51.354808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.090743Z","title":"Retrieval-augmented generation for knowledge-intensive nlp tasks.Advances in Neural Information Processing Systems, 33:9459–9474, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.090743Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:2cc1b5d1264c37d3b556983d8abf30fdeff6fa975b2df4905b1f42d5d48a18b9","observation_id":"23120b54-73f8-44b0-ab94-6be37a37aecb","resolution":{"observed_at":"2026-08-12T05:13:50.090743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.331181Z","title":"Nalir: an interactive natural language interface for querying relational databases","venue":null,"work_id":"5b87407c-68e7-470a-aec7-3670a5455395","year":2014},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.093893Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:6e7678d1b27a28174c0139fe82b1643dd76b5be163ba1cf2d26d2fe1a698cbbd","observation_id":"dfe5ea49-a476-47c5-b6d0-d7a12055019d","resolution":{"observed_at":"2026-08-12T05:13:51.334767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14263","last_updated":"2024-09-30T08:17:01Z","snapshot_observed_at":"2026-08-12T01:31:36.142526Z","submitted_at":"2023-08-28T02:38:17Z","title":"Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14263","snapshot_observed_at":"2026-08-12T05:13:50.097722Z","title":"Cross- modal retrieval: a systematic review of methods and future directions.arXiv preprint arXiv:2308.14263, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.097722Z"},"links":{"cited_paper":"/paper/2308.14263","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:c422b22bfee803632e72df8adf91e792d0cf399b378f99784cfa2e57f98b7b14","observation_id":"9d61d628-9655-41a2-aefa-4af862d6f86e","resolution":{"observed_at":"2026-08-12T05:13:50.097722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.102370Z","title":"Can llm already serve as a database interface? a big bench for large-scale database grounded text-to-sqls.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.102370Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:55fd971191dcd48b97f211afa53b2026714539019da7629f0a41e9de7d3f6ec6","observation_id":"af00dcb5-a91e-4baf-9a45-7cfc1593485e","resolution":{"observed_at":"2026-08-12T05:13:50.102370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.107132Z","title":"Blip: Bootstrapping language- image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.107132Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:0e485d668a55bcc4d28995d7e625d0ef0b2ec594af498ee572abfba9e977e05c","observation_id":"c9e7ea36-267b-4194-8266-cf76d7a315d7","resolution":{"observed_at":"2026-08-12T05:13:50.107132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.303182Z","title":"W2vv++ fully deep learning for ad-hoc video search","venue":null,"work_id":"f23086e1-505c-4ff5-b15c-c5ce79a3dce1","year":2019},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.111597Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:87a1a77e2fab53def433f647452fa80193da1d4b6d28be916ef8c91a9daf1804","observation_id":"ff316476-a5d9-4045-8dec-cc3680aa0697","resolution":{"observed_at":"2026-08-12T05:13:51.307829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02115","last_updated":"2024-01-04T07:50:24Z","snapshot_observed_at":"2026-08-13T04:49:11.555432Z","submitted_at":"2024-01-04T07:50:24Z","title":"Using LLM to select the right SQL Query from candidates","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02115","snapshot_observed_at":"2026-08-12T05:13:50.115582Z","title":"Using llm to select the right sql query from candidates.arXiv preprint arXiv:2401.02115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.115582Z"},"links":{"cited_paper":"/paper/2401.02115","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:78d03e07bfd6a492a96194983938d4bb7e49d2de841eddeab7e44b0e8a1e3e46","observation_id":"d148382c-1d54-40ea-a187-a6f4d78989a5","resolution":{"observed_at":"2026-08-12T05:13:50.115582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.120227Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.120227Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:1061178dc545396d4c8b349cb550253d903a8565983991021908a1f670b77108","observation_id":"ab32334b-ac08-4efe-8dc3-960373323dfa","resolution":{"observed_at":"2026-08-12T05:13:50.120227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.282416Z","title":"Learning a recurrent residual fusion network for multimodal matching","venue":null,"work_id":"81b7dea7-0ce7-46b9-992f-af4005b089e2","year":2017},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.124266Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:a610caa159b2da9fe6b5ac73e8a4aacfcdac363bcbf7cb6ac03bd33d7ff346a9","observation_id":"7cfe3bf3-6fc9-447c-9ad6-f3a732555d2a","resolution":{"observed_at":"2026-08-12T05:13:51.286492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08860","last_updated":"2021-05-08T08:25:57Z","snapshot_observed_at":"2026-08-10T14:43:16.360554Z","submitted_at":"2021-04-18T13:59:50Z","title":"CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08860","snapshot_observed_at":"2026-08-12T05:13:50.127973Z","title":"Clip4clip: An empirical study of clip for end to end video clip retrieval.arXiv preprint arXiv:2104.08860, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.127973Z"},"links":{"cited_paper":"/paper/2104.08860","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:cd05eced215215ac9844dfdd296b3a40db163461ac424b4b1845bc9b6751a97d","observation_id":"8ea95b71-15e6-45ac-a3b7-82a473567ab1","resolution":{"observed_at":"2026-08-12T05:13:50.127973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.10074","last_updated":"2020-12-18T06:51:23Z","snapshot_observed_at":"2026-08-04T03:58:50.102350Z","submitted_at":"2020-12-18T06:51:23Z","title":"Mention Extraction and Linking for SQL Query Generation","version":1},"cited_work":{"arxiv_id":"2012.10074","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.10074","snapshot_observed_at":"2026-08-12T05:13:50.603343Z","title":"Mention Extraction and Linking for SQL Query Generation","venue":"cs.CL","work_id":"0da2ab34-227a-444c-bba9-03d1a08dff51","year":2020},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.132060Z"},"links":{"cited_paper":"/paper/2012.10074","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:74f79db173bbaf62573bb2508d38a4c0fec3652c9602b5010189eefd53e56f32","observation_id":"57654ad3-a586-499e-a59b-dd6b3e777317","resolution":{"observed_at":"2026-08-12T05:13:50.610579Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.136325Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.136325Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:c50d75acd39acb35b189766d820989978b3e08d5c5c065cee8ff5e6383d5cd4c","observation_id":"5e18f7a1-3d24-4eb2-9cbe-11042471f245","resolution":{"observed_at":"2026-08-12T05:13:50.136325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.262865Z","title":"Query and keyframe representations for ad-hoc video search","venue":null,"work_id":"574708b8-51ec-41a2-8f0b-fe375ad45146","year":2017},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.140509Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:5d568819c02297d4aabf418702a1f017eaa2462438a51837ec876756296becf0","observation_id":"db902d1f-3118-49e3-a51a-c31594583ccd","resolution":{"observed_at":"2026-08-12T05:13:51.266562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.252147Z","title":"Senticap: Generating image descriptions with sentiments","venue":null,"work_id":"b0612cfb-c323-4062-b8a9-2184ac16a163","year":2016},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.145103Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:65a1ff1f106e5c9fb4b27caa842549df1144f7891ced7046a9a9f51384a60eb6","observation_id":"7c41e9e1-57db-4adc-b5b1-021c1eaa0eff","resolution":{"observed_at":"2026-08-12T05:13:51.255683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03426","last_updated":"2020-09-18T01:56:41Z","snapshot_observed_at":"2026-08-02T15:32:07.466568Z","submitted_at":"2018-02-09T19:39:33Z","title":"UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03426","snapshot_observed_at":"2026-08-12T05:13:50.148488Z","title":"Umap: Uniform manifold approximation and projection for dimension reduction.arXiv preprint arXiv:1802.03426, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.148488Z"},"links":{"cited_paper":"/paper/1802.03426","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:2c1dfccbf343c658ea83299fcbd81483dc70ce4e89971b01203297716178386e","observation_id":"ff1e7170-ea61-4235-a9e6-9c45797df9b7","resolution":{"observed_at":"2026-08-12T05:13:50.148488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.152020Z","title":"Howto100m: Learning a text-video embedding by watching hundred million narrated video clips","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.152020Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:99afdaf9a1afa2bbd676f355ca3f09c9a547c18fd47180b41b24bd01b1ab5924","observation_id":"ecda0958-9b0d-49f1-be43-696cf7c7ba9f","resolution":{"observed_at":"2026-08-12T05:13:50.152020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.231664Z","title":"Learning joint embedding with multimodal cues for cross-modal video-text retrieval","venue":null,"work_id":"01924bdc-32ce-4ea4-ab3a-61077ca87a59","year":2018},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.155828Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:acd85ba4d3a293b6b6a77a75b25789dd9f238ccaf8383ba7a69a6a3d043fd6b5","observation_id":"94cff172-0fa1-4c28-a93c-0cf7b0ab55b7","resolution":{"observed_at":"2026-08-12T05:13:51.235852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.219290Z","title":"Seesaw: interactive ad-hoc search over image databases.Proceedings of the ACM on Management of Data, 1(4):1–26, 2023","venue":null,"work_id":"4e38afcc-ed59-497d-9d01-2862f8b1024f","year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.159210Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:6488fbceef6751812a816e022eb0ba084f543dd61f17b76522d15573b2885983","observation_id":"dc25b34f-f0c4-442e-93e0-9ddf0eb5f190","resolution":{"observed_at":"2026-08-12T05:13:51.223632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.207395Z","title":"Randomized algorithms.ACM Computing Surveys (CSUR), 28(1):33–37, 1996","venue":null,"work_id":"4789969c-bd23-414c-bc74-04d5ea9c4562","year":1996},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.163528Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:80a5170a2f61713a815da6666b1defb446690bfc720099d529b6622fc5a53353","observation_id":"c156cb2f-7059-4f42-833b-4e051564955c","resolution":{"observed_at":"2026-08-12T05:13:51.211325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.194489Z","title":"Learning and transferring mid- level image representations using convolutional neural networks","venue":null,"work_id":"4323262d-a68b-488d-b56a-d4d9cd8373d7","year":2014},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.168245Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:4de068f1097ebc7d199d5aa998054f7043388a829a1d89a276f7ec145f905156","observation_id":"a85a2efa-8d1f-4bf8-832f-8fc776477ff0","resolution":{"observed_at":"2026-08-12T05:13:51.199007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-12T05:13:50.173310Z","title":"Dinov2: Learning robust visual features without supervision.arXiv preprint arXiv:2304.07193, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.173310Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:328eaba597c70ae621e2046bd92e55741b2c214105ffcf8dfb82dd3cedd61ccf","observation_id":"003ebfd0-88fd-46a8-bcf7-baee9dbb1710","resolution":{"observed_at":"2026-08-12T05:13:50.173310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.180016Z","title":"Composing object relations and attributes for image-text matching","venue":null,"work_id":"1e0995ac-3963-435d-ae4f-9e81821c95f4","year":2024},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.178729Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:1d755e50ef35af7061a52363f65e5e8925c92e4924b3ec06dfb7d4bd342f019f","observation_id":"0b3b9726-b634-41f3-9cdf-7f5366ec2e90","resolution":{"observed_at":"2026-08-12T05:13:51.185285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.182720Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.182720Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:88a580cd2bb94dbfa0ebec42286fff28277fc346be22c5441a2d02775e2012ff","observation_id":"8dbc31df-52b8-4149-8ac7-4d1693105ac0","resolution":{"observed_at":"2026-08-12T05:13:50.182720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-12T05:13:50.186761Z","title":"Hierarchical text-conditional image generation with clip latents.arXiv preprint arXiv:2204.06125, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.186761Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:7bc74c3f15878c31439ed06f9e9e0b0aceb6dd366b45d946be71c0a9e18d788d","observation_id":"d0493ea1-7e87-439a-836f-6e106a6499a1","resolution":{"observed_at":"2026-08-12T05:13:50.186761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.161037Z","title":"A new approach to cross-modal multimedia retrieval","venue":null,"work_id":"7170db8b-28c3-4313-ae3f-34843861583b","year":2010},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.190887Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:09fdf02936fbf2f9a0d0873a8343e5be904aef86a14b3a9eb334a27dcedf2004","observation_id":"132c63d3-4d6b-47d1-b15f-b618eacbc94f","resolution":{"observed_at":"2026-08-12T05:13:51.165166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.148356Z","title":"Cola: A benchmark for compositional text-to-image retrieval.Advances in Neural Information Processing Systems, 36:46433–46445, 2023","venue":null,"work_id":"862fd1f1-76a0-4add-b42d-cabdaf6487cc","year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.194703Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:ee300523f8529fc65f24aae35c7582f388a472992942df64c6257ec0c79398eb","observation_id":"5cf954cf-f3db-4a44-9348-a400436f5255","resolution":{"observed_at":"2026-08-12T05:13:51.152604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.198754Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.198754Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:c38be7f15bbae7006931c3f92db73ff736e3282d69dbdd39f003218c5e976706","observation_id":"54fef369-921b-4784-a006-efc7a17d144f","resolution":{"observed_at":"2026-08-12T05:13:50.198754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.127569Z","title":"Multi-modal joint embedding for fashion product retrieval","venue":null,"work_id":"ee8951d0-e83b-42eb-b4ee-7f0f7ac8e3c7","year":2017},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.202732Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:cc639825fee54f80a37433dc93b4f3ac6e2e1da9331185b7a0989a0f5a16b77b","observation_id":"61cb84e6-2eee-4f48-923f-686523a3c392","resolution":{"observed_at":"2026-08-12T05:13:51.132046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.114081Z","title":"Coverage-based data-centric approaches for responsible and trustworthy ai.IEEE Data Eng","venue":null,"work_id":"170225dd-67b5-4491-8919-b1055209f336","year":2024},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.206934Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:1083dd22ae5cc1201cbd00eefefab15d51ac04e51782778bf4387b6db185d0da","observation_id":"6a89fbc5-22b2-48e6-9840-fa3f50d72edd","resolution":{"observed_at":"2026-08-12T05:13:51.118412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.211066Z","title":"Flava: A foundational language and vision alignment model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.211066Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:0fa144e6596d7745ef3b3113ea2762d43a04e8760e8e46afbcab283922dc90f4","observation_id":"1628244f-5705-4288-81be-a87172f5b3de","resolution":{"observed_at":"2026-08-12T05:13:50.211066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09135","last_updated":"2019-04-19T10:05:33Z","snapshot_observed_at":"2026-08-09T21:00:37.431418Z","submitted_at":"2019-04-19T10:05:33Z","title":"Data Augmentation Using GANs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09135","snapshot_observed_at":"2026-08-12T05:13:50.215362Z","title":"Data augmentation using gans","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.215362Z"},"links":{"cited_paper":"/paper/1904.09135","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:4c410a06c2f0b71f6d8fb5d5a627d92634c4c2cbaef2916825624badf2b43cf2","observation_id":"ba62b6fc-fc0c-49de-be79-5ba96d9504f1","resolution":{"observed_at":"2026-08-12T05:13:50.215362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.091008Z","title":"Interacting- enhancing feature transformer for cross-modal remote-sensing image and text retrieval.IEEE Transactions on Geoscience and Remote Sensing, 61:1–15, 2023","venue":null,"work_id":"5fc7fd11-f736-405f-87cc-64d7febe81e3","year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.219014Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:ce978fa5f2183b93b68555707d7e36777168092206ba06e0f02096e7ee6ec082","observation_id":"3834c631-7f7f-478e-8e31-5ffc135ace34","resolution":{"observed_at":"2026-08-12T05:13:51.095571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.222876Z","title":"Winoground: Probing vision and language models for visio-linguistic compositionality","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.222876Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:d5c0b54f1541ce0d6d3e1b4cf549aa3e60924e5a7c3162dc7693be8f672df3f8","observation_id":"dbbc7171-f808-47df-a0ad-6c6c07c49433","resolution":{"observed_at":"2026-08-12T05:13:50.222876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08124","last_updated":"2016-09-26T19:14:12Z","snapshot_observed_at":"2026-08-03T14:48:01.874047Z","submitted_at":"2016-09-26T19:14:12Z","title":"Learning Language-Visual Embedding for Movie Understanding with Natural-Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08124","snapshot_observed_at":"2026-08-12T05:13:50.226247Z","title":"Learning language-visual embedding for movie understanding with natural-language.arXiv preprint arXiv:1609.08124, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.226247Z"},"links":{"cited_paper":"/paper/1609.08124","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:d6cad73ab5635fb71df7dbbe53146ad1fd0b3f4f6da9838440c0350f63f837da","observation_id":"840cb99b-1bc7-408b-a4ef-c713959af5d5","resolution":{"observed_at":"2026-08-12T05:13:50.226247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.230613Z","title":"Training deep networks with synthetic data: Bridging the reality gap by domain randomization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.230613Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:3b87d2f05564c7e3499f0b6df892b8d2b886df4b5c2056f85641aaecd955e145","observation_id":"bd8c26fd-7865-4ca7-b5de-0ed6363d70a5","resolution":{"observed_at":"2026-08-12T05:13:50.230613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.057435Z","title":"Codexdb: Synthesizing code for query processing from natural language instructions using gpt-3 codex.Proceedings of the VLDB Endowment, 15(11):2921–2928, 2022","venue":null,"work_id":"f548aa7b-6570-46ba-b556-bfd25ac93028","year":2022},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.234987Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:181baabc4ad1feb9c14b02430bbf060da5397ecc082748b4d05ab096b0b10777","observation_id":"4db8cbd5-d230-464c-93f7-9d1c5948e843","resolution":{"observed_at":"2026-08-12T05:13:51.062904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.044282Z","title":"Demonstrating gpt-db: Generating query-specific and customizable code for sql processing with gpt-4.Proceedings of the VLDB Endowment, 16(12):4098–4101, 2023","venue":null,"work_id":"2abe152b-edaa-4621-8524-cc422bc15910","year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.239658Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:a036fa66ffda80de2819f7a05b5da2768693d26c241fe47a7a3a4cbb07d43f3c","observation_id":"2a11ac16-5a54-40f7-9e4b-2cf2103b15fd","resolution":{"observed_at":"2026-08-12T05:13:51.048698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02549","last_updated":"2025-06-02T21:47:55Z","snapshot_observed_at":"2026-08-12T23:30:19.038003Z","submitted_at":"2024-07-02T15:27:06Z","title":"Diffusion Models for Tabular Data Imputation and Synthetic Data Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02549","snapshot_observed_at":"2026-08-12T05:13:50.244361Z","title":"Dif- fusion models for tabular data imputation and synthetic data generation.arXiv preprint arXiv:2407.02549, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.244361Z"},"links":{"cited_paper":"/paper/2407.02549","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:b0a066a005c65617e1c42d56bd27817743fd26d7ae34eb4335d61fd0c3706e38","observation_id":"56c70c32-b6a1-4f4a-8a01-6f232292a81d","resolution":{"observed_at":"2026-08-12T05:13:50.244361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.031003Z","title":"Image-text cross- modal retrieval via modality-specific feature learning","venue":null,"work_id":"4e6eb24a-13d8-4017-931a-c2a33ed5dd7b","year":2015},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.248854Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:01a3f73fc3d2833e1e7c53c5e6b611ad574a65b25c6a22f484ed9cfa00dd4264","observation_id":"8817a9e3-cdea-4f7b-90ae-a7f896f402ed","resolution":{"observed_at":"2026-08-12T05:13:51.036041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.017669Z","title":"Cluster-sensitive structured correlation analysis for web cross-modal retrieval.Neurocomputing, 168:747–760, 2015","venue":null,"work_id":"f8c06ae6-ef77-4e63-88f4-8ec537ce6df2","year":2015},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.252920Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:b3f88aefc60e9b78f312acad98d423948b93f9602fa9e7ddfaaca8025709bc67","observation_id":"f3330211-bd5e-4242-952e-72fab252c0f0","resolution":{"observed_at":"2026-08-12T05:13:51.022253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:51.003414Z","title":"Cross- modal retrieval: a systematic review of methods and future directions.Proceedings of the IEEE, 2025","venue":null,"work_id":"6b21f7a1-d470-4aab-ab5d-eb45f3c36fac","year":2025},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.257618Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:da8119d17526f344a82a660367747fa94816cdacb9c1c2ac84acaa529efb9e73","observation_id":"b7c8f82b-1492-498a-bb58-b6a967587808","resolution":{"observed_at":"2026-08-12T05:13:51.008442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.262678Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers.Advances in neural information processing systems, 33:5776–5788, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.262678Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:8836a6f1c81ab51bfe4c664f6d193ef6dd8415be52f503dc18b47f52ba74aed0","observation_id":"d018c000-e9ef-46fc-a56f-9e8fa842977a","resolution":{"observed_at":"2026-08-12T05:13:50.262678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.266174Z","title":"Convnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.266174Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:2b29aa8aa5cfbce6aa66ad9bac27af658bc11efd3582b38d47ab51886449f6a4","observation_id":"003373c8-4e1d-4e0e-9d04-f9b2e30ebb8b","resolution":{"observed_at":"2026-08-12T05:13:50.266174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.971707Z","title":"Improving text-audio retrieval by text-aware attention pooling and prior matrix revised loss","venue":null,"work_id":"a40d76ea-d180-4647-a0db-4799b38680f5","year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.269491Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:ebfdbd153146a67dff37ac5ded2bf7797726b135aa1a50a40591996b3b225588","observation_id":"306cb27b-073f-4b70-928f-6cc02880127b","resolution":{"observed_at":"2026-08-12T05:13:50.976466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.957520Z","title":"Regnet: self-regulated network for image classification.IEEE Transactions on Neural Networks and Learning Systems, 34(11):9562–9567, 2022","venue":null,"work_id":"c2468d9e-d6f2-4351-8da0-7b3a9eb7edb0","year":2022},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.273139Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:2e3c37407b2c3969c83ed522a065ccf9ee966fc5267ecd567491aca605878811","observation_id":"d162a88a-9f7a-42dc-b04d-459d9d2dc2c2","resolution":{"observed_at":"2026-08-12T05:13:50.962144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.944111Z","title":"Re- thinking label-wise cross-modal retrieval from a semantic sharing perspective","venue":null,"work_id":"abb888b2-55b7-4b67-bd61-cbaad1bd8fb1","year":2021},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.277165Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:e38336c77d3a5c40128ca92e36814733a538d5212cac4903bbfb7bef702064af","observation_id":"78bd2647-525b-4f47-aab9-15c6ed938557","resolution":{"observed_at":"2026-08-12T05:13:50.948591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.930325Z","title":"Saliencycut: Augmenting plausible anomalies for anomaly detection.Pattern Recognition, 153:110508, 2024","venue":null,"work_id":"519cc150-7892-4279-ba9d-51cf34ac4969","year":2024},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.281012Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:2f12826280757edc5a59d6497ae9fbbd7f8c6908b21732f15fa119ef46eb4b44","observation_id":"8bb25eb5-e961-4073-bc13-0960d3a6882b","resolution":{"observed_at":"2026-08-12T05:13:50.935283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.916850Z","title":"Data structures and algorithms for nearest neighbor search in general metric spaces","venue":null,"work_id":"a718b5d3-cd63-41c9-b8ae-2cde8ff81504","year":1993},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.285560Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:e2159216cb8d61fa25c815cd052f8e2e93cab10bf396d315f6d93919b439d2fa","observation_id":"5db307f8-62f4-4c37-abaa-198e90b28e8b","resolution":{"observed_at":"2026-08-12T05:13:50.921375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.290261Z","title":"Bdd100k: A diverse driving dataset for heterogeneous mul- titask learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.290261Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:c809583e9516a5d0b249234d86030743042a9f52e11ac780ba3e817c14ca7b60","observation_id":"c626ba84-4d8a-4ea7-9a66-335e54ffb417","resolution":{"observed_at":"2026-08-12T05:13:50.290261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07909","last_updated":"2024-11-08T06:19:33Z","snapshot_observed_at":"2026-08-09T15:37:28.200871Z","submitted_at":"2023-03-14T13:49:54Z","title":"Text-to-image Diffusion Models in Generative AI: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.07909","snapshot_observed_at":"2026-08-12T05:13:50.294956Z","title":"Text-to-image diffusion models in generative ai: A survey.arXiv preprint arXiv:2303.07909, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.294956Z"},"links":{"cited_paper":"/paper/2303.07909","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:18a23717f3bca9ea655631b2768a14eebc42930465668403bf02127bc36aac91","observation_id":"093a73e4-9905-4024-9955-534654d2cf36","resolution":{"observed_at":"2026-08-12T05:13:50.294956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.893989Z","title":"Interactive retrieval based on faceted feedback","venue":null,"work_id":"b6d3048e-9ac7-4591-82c6-763ddb3b21aa","year":2010},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.299464Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:917143f344ef70ce8ff146c9e3506dfc2d97a8e097ea11a30b3ca5186fa11ac0","observation_id":"3abe202b-f128-409b-bc8c-49c9827b9d5d","resolution":{"observed_at":"2026-08-12T05:13:50.898139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.00786","last_updated":"2019-09-10T00:40:29Z","snapshot_observed_at":"2026-08-12T12:26:29.910394Z","submitted_at":"2019-09-02T16:24:57Z","title":"Editing-Based SQL Query Generation for Cross-Domain Context-Dependent Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.00786","snapshot_observed_at":"2026-08-12T05:13:50.303657Z","title":"Editing-based sql query generation for cross- domain context-dependent questions.arXiv preprint arXiv:1909.00786, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.303657Z"},"links":{"cited_paper":"/paper/1909.00786","citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:2877f265f7e9d4369658b7fd08cc8f338aacd3c642d77904b97ebd5a765c107d","observation_id":"a90a289f-4419-4615-b211-270d0e889d74","resolution":{"observed_at":"2026-08-12T05:13:50.303657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.881193Z","title":"Recognize anything: A strong image tagging model","venue":null,"work_id":"979bcbaa-5dfe-4448-ac59-37acdb003093","year":2024},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.308737Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:dbd7cc1d909326eaf371958507fd46475d61c81f42d14b805b38a3ce0c4b0f7c","observation_id":"b712a92d-adc2-4146-be6d-90990570a4cd","resolution":{"observed_at":"2026-08-12T05:13:50.885946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.869193Z","title":"Relevance feedback in image retrieval: A comprehen- sive review.Multimedia systems, 8:536–544, 2003","venue":null,"work_id":"691e82ed-10e9-45c3-a589-fd0265c913bd","year":2003},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.312134Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:8c1888e28ec3c942631a723cd4935aaff51631c70b080cdb655a0eabdfbc592b","observation_id":"fc589fc1-19d9-4da2-bf5c-ca6cce20f353","resolution":{"observed_at":"2026-08-12T05:13:50.872818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4480.8497","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.479839Z","title":"complex","venue":null,"work_id":"60749d7d-90d8-4694-a6fa-f0c883d64cf7","year":2023},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.315751Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:b62082442df1d558ff03c073f5da2ae7ffe131c32d1e8535a569d719776464ea","observation_id":"dc3c0932-c0c9-4094-a893-baaac7a13db1","resolution":{"observed_at":"2026-08-12T05:13:50.487397Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.857672Z","title":"hard categories","venue":null,"work_id":"96544f0b-5351-467d-8574-921e519ec6ac","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.320991Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:11fe652b68d61a4249347c25894ed2c362b5493ce3624afb08e6bc3baf709d1d","observation_id":"4707a352-3bb5-4c85-84f4-3cab6ec2a4dd","resolution":{"observed_at":"2026-08-12T05:13:50.861769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.846496Z","title":"However, while CLIP (in our clip-vit-base-patch32 variant) uses a Vision Transformer for image encoding, ALIGN typically uses a CNN image encoder along with a Transformer for text","venue":null,"work_id":"732db3cc-de7b-4497-95eb-8f0dfdd2bc04","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.325178Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:a1f3a0dfd708dd7c031a8e35752e5d1f00edb2b328c753f244c844717a528aa9","observation_id":"6f59687e-ec73-4c55-b87b-0b3e615186a7","resolution":{"observed_at":"2026-08-12T05:13:50.850455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.835173Z","title":null,"venue":null,"work_id":"83c29472-e7f5-44b1-9337-1597e38801ef","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.329599Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:06b1acfaf22ad14efdeff945a1437a5d9a5fe8dcbdef5a9e5edb4a19901b32d2","observation_id":"44862ebd-8d22-4ba6-b439-a2e7fadbccf4","resolution":{"observed_at":"2026-08-12T05:13:50.839036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.823486Z","title":"The generated captions are then transformed into embeddings with MiniLM [72]30, a robust text encoder widely adopted in industrial applications","venue":null,"work_id":"64f6b978-4614-4745-a1b2-1cc41a9f328f","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.333937Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:d8c9b4b7acbf8b1dfc3a6fe2bcb8d3b50549eb4a967cfb843bd61f5f84429c28","observation_id":"e2dd76e6-d762-4d52-97ba-25e3efecd724","resolution":{"observed_at":"2026-08-12T05:13:50.827473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.811493Z","title":"Its diverse object classes make it a useful benchmark for assessing the robustness of detection and retrieval models","venue":null,"work_id":"ff1a8d14-d01f-4bc7-935d-f1fc844336e0","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.338469Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:91f234863ed44e40d0df3c354c94617d3324f87c11c07e6ca5120482f67edf19","observation_id":"f09832f3-108a-4da3-ac67-d4bbe1e21ff6","resolution":{"observed_at":"2026-08-12T05:13:50.815240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.798202Z","title":"Its comprehensive annotations and varied scene compositions provide a challenging testbed","venue":null,"work_id":"fa81298e-c6f3-47f2-872b-5c2079180474","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.344014Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:6a2563b4f2cd5bd82dbe8a2b51094e3cb4f21d1357faa37a3948523a80b27168","observation_id":"08f3106d-0611-4934-8d62-bee28d29f3eb","resolution":{"observed_at":"2026-08-12T05:13:50.802825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.784934Z","title":"Its focus on rare and fine-grained objects is critical for evaluating retrieval performance on less frequent classes","venue":null,"work_id":"64648281-80be-422c-9823-d3e2d3d2664b","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.348906Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:f7fd2db11deee44cd42c35d25442d6aef7c96069dfa498bde305effe8347d5b7","observation_id":"c9a1bc4f-db46-46be-8cbc-9beef33b8461","resolution":{"observed_at":"2026-08-12T05:13:50.789721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.770841Z","title":null,"venue":null,"work_id":"406bc051-e0b8-4888-a7f8-4c5845437d7d","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.353749Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:384f0797f457873d7ce537b1a4f5480cfe3ba45a077138e3acdd0eed8121883c","observation_id":"fc3f5d7f-ec0d-42ed-8161-fe631ca9a18a","resolution":{"observed_at":"2026-08-12T05:13:50.775213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.758252Z","title":null,"venue":null,"work_id":"74896da6-e1aa-4e15-8342-7bf30865fefc","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.357814Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:52ea26ecfa6bbb1e6ed5b08b09b57059d594ab77e846d3173c08b910d15fc539","observation_id":"2e1f6167-9cf9-404f-8ea5-aa75c944c7d0","resolution":{"observed_at":"2026-08-12T05:13:50.761918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.747027Z","title":"This dataset challenges models to accurately map nuanced language to the corresponding image, serving as a stringent test of fine-grained retrieval performance","venue":null,"work_id":"33f76eda-0e75-4849-9d81-ae40e45c3672","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.362288Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:83f23d383cb2c5a81164d9a656607f5067f758d1c1b6a1f1f0cbade6f0b6323d","observation_id":"28c9aa30-21d8-41f9-bcda-a99997e02d9c","resolution":{"observed_at":"2026-08-12T05:13:50.750959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.736572Z","title":"It is crucial for evaluating a model’s ability to handle zero-shot retrieval on images containing objects not commonly found in standard captioning datasets","venue":null,"work_id":"d390323b-1e9d-4939-9d9f-113f92706c50","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.366427Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:6e2e0e720772d710881724f4f48d3927869db2a74f90e006ae5eedd1d4219013","observation_id":"7e9add9b-2666-45da-902b-a29577210573","resolution":{"observed_at":"2026-08-12T05:13:50.739954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:13:50.724084Z","title":"Left is better,","venue":null,"work_id":"b2df5d61-c1c6-4920-848d-0f79a00212f6","year":null},"citing_paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-12T05:13:50.370465Z"},"links":{"citing_paper":"/paper/2412.00639"},"observation_digest":"sha256:ffe9f21eb4efc59f919a5c390ff5835d46bfb23645ba33dcaaeac9d91ae49a96","observation_id":"6b6530b0-6158-4239-81cb-78b93666f499","resolution":{"observed_at":"2026-08-12T05:13:50.728272Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.00639","last_updated":"2025-06-02T15:22:19Z","latest_version":2,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-12T12:26:41.250733Z","submitted_at":"2024-12-01T01:36:41Z","title":"Needle: A Generative AI-Powered Multi-modal Database for Answering Complex Natural Language Queries"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":2,"verified_fuzzy":42},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 0 inbound Pith citation observations for arXiv:2412.00639."}