{"as_of":"2026-08-13T14:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:030eb019aa90dc2842d66c9340397e1d35abf9ef6cc9f726658814518b37267f","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:23:44.680955Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.06847/citation-record","integrity":"/paper/2412.06847/integrity","json":"/paper/2412.06847/citation-record.json","paper":"/paper/2412.06847"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T20:23:44.417701Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.417701Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:1b4686dfcab60ed059b3fcfb05febe167a416b2da29fba669b65b4382c85eaa7","observation_id":"342daa81-8659-4066-b498-dd6470753374","resolution":{"observed_at":"2026-08-11T20:23:44.417701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.577623Z","title":"Extracting structured data from organic synthesis procedures using a fine-tuned large language model","venue":null,"work_id":"aec7f435-3fc7-4bc8-a531-274a1dd73fee","year":2024},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.422831Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:0aa2cb9d603b2aaa7de36bcbeb78a67bc35f86aeb01d34116173a0608003aebf","observation_id":"07784057-0b44-410a-bc0e-1daacc8182d3","resolution":{"observed_at":"2026-08-11T20:23:45.582393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.563474Z","title":"Geom, energy-annotated molecular conformations for property prediction and molecular generation","venue":null,"work_id":"f864ee7d-b0d5-41af-b76e-359d6db6938b","year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.427228Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:ede9fbd60f53a53dc0511ec8296435f51449895c70aa1b3c8aa00ddc2850637c","observation_id":"4a3b9a83-05fc-43a8-a73c-61518deea8b6","resolution":{"observed_at":"2026-08-11T20:23:45.567816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.550155Z","title":"New substructure filters for removal of pan assay interference compounds (pains) from screening libraries and for their exclusion in bioassays","venue":null,"work_id":"6d6786a9-d70a-4d98-b42b-88c99261e2a8","year":2010},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.431425Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:ee1c272802b49a973675b4ca50442a543b133043ea0d7c8a27fafdd0d141f727","observation_id":"540235d1-ff45-40f0-9c30-f81749cdef03","resolution":{"observed_at":"2026-08-11T20:23:45.554267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.537044Z","title":"Molgpt: molecular generation using a transformer-decoder model","venue":null,"work_id":"fd61080e-18eb-4a8b-9fe0-71e26fa82f3b","year":2021},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.435884Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:470b551a7c93a80b0f2cd5887178c245d8b4c1251a6f2b039a6b74c96bff57e1","observation_id":"be893793-b677-432f-842d-b77c9430985e","resolution":{"observed_at":"2026-08-11T20:23:45.541099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04292","last_updated":"2023-10-18T11:06:43Z","snapshot_observed_at":"2026-08-13T05:55:23.365400Z","submitted_at":"2023-10-06T14:51:17Z","title":"Towards Foundational Models for Molecular Learning on Large-Scale Multi-Task Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04292","snapshot_observed_at":"2026-08-11T20:23:44.440078Z","title":"Towards foundational models for molecular learning on large-scale multi-task datasets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.440078Z"},"links":{"cited_paper":"/paper/2310.04292","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:db4174854a91f7a2e232647e59e5bf9a14b61517bedd980641f48a650f016299","observation_id":"da527c5d-ec37-45e9-ae77-8a6cbd17f570","resolution":{"observed_at":"2026-08-11T20:23:44.440078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.444692Z","title":"The properties of known drugs","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.444692Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:c40d5726173075b9cb89430b6affcad6500007ea3015c6935e693d182dc1a651","observation_id":"09940e0d-5097-4bdd-adbd-2a5f517ef732","resolution":{"observed_at":"2026-08-11T20:23:44.444692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.449037Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.449037Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:713d65fe71223a3108a21613cfec9383c88b49f3e538d8aa831c02ca3abe302f","observation_id":"3f0c9f1b-da99-486b-aad5-4801871d6692","resolution":{"observed_at":"2026-08-11T20:23:44.449037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.506590Z","title":"Artificial intelligence for drug discovery: Resources, methods, and applications","venue":null,"work_id":"51814789-9786-4bbf-8e84-e2b21c528bd9","year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.452939Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:eb3415e0c4dc207185a9205fee57caea158047be8e6951295c23cfa7a8de40a1","observation_id":"75913119-1b1c-4923-ba9d-5e6ea9d9e5f3","resolution":{"observed_at":"2026-08-11T20:23:45.510806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.09885","last_updated":"2020-10-23T04:22:37Z","snapshot_observed_at":"2026-08-08T06:02:13.053327Z","submitted_at":"2020-10-19T21:41:41Z","title":"ChemBERTa: Large-Scale Self-Supervised Pretraining for Molecular Property Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.09885","snapshot_observed_at":"2026-08-11T20:23:44.456519Z","title":"Chemberta: large-scale self-supervised pretraining for molecular property prediction","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.456519Z"},"links":{"cited_paper":"/paper/2010.09885","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:7a531dacbd835194fa2d95d5301076461aafa4e094e80c6f9f30d7ff7eb1b549","observation_id":"721c348c-1c92-48ec-97d7-f66ebb602927","resolution":{"observed_at":"2026-08-11T20:23:44.456519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.493427Z","title":"Molecular representations in ai-driven drug discovery: a review and practical guide","venue":null,"work_id":"e518d4bb-072e-4acb-a198-817625dcc65f","year":2020},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.460380Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:cb294204774ad45a1b02f5f7ba313c95c9656da93e23eae0770bd438491aa56d","observation_id":"efe2a610-3d06-441c-a760-36516f855850","resolution":{"observed_at":"2026-08-11T20:23:45.497819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.479628Z","title":"On the art of compiling and using’drug-like’chemical fragment spaces","venue":null,"work_id":"4582b4fa-efc5-4d93-b111-173def2364d6","year":2008},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.464009Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:b6cf6e36f65fb53c9eb15a02f7fae02f0c9aaefa8d7190c0353007fd5e106d5c","observation_id":"e97d978f-01d2-41a1-b65a-5ee4159f295c","resolution":{"observed_at":"2026-08-11T20:23:45.484240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.466186Z","title":"Glm: General language model pretraining with autoregressive blank infilling","venue":null,"work_id":"d55f8d42-7174-4886-b8bd-de9a4064b680","year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.467861Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:7062e59cd03eee0e11e2185589b50326068114f36c943590559b299ad5cae868","observation_id":"41c05bca-f8fb-42d4-a8e3-829f766f67d5","resolution":{"observed_at":"2026-08-11T20:23:45.470561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T20:23:44.471361Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.471361Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:0c93062764ff06c4fc6eb4cd2ebbd5df5d98a9df5a0ad57fa940bc024fc8e280","observation_id":"f7126646-71b5-4ddf-b8e8-514af8053689","resolution":{"observed_at":"2026-08-11T20:23:44.471361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.452763Z","title":"Molecular structure input on the web","venue":null,"work_id":"f5850f5f-11c4-4714-b2a6-bdd3e2d9ab34","year":2010},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.475673Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:f344570600f173e07bdea9ebc0c16d784853b0b671cd075937cb1a8512b316c6","observation_id":"649c5fca-a46f-4de9-8e79-2747b6faa2d2","resolution":{"observed_at":"2026-08-11T20:23:45.457116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13230","last_updated":"2020-11-26T10:55:05Z","snapshot_observed_at":"2026-08-11T00:35:07.298620Z","submitted_at":"2020-11-26T10:55:05Z","title":"Molecular representation learning with language models and domain-relevant auxiliary tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13230","snapshot_observed_at":"2026-08-11T20:23:44.479766Z","title":"Molecular representation learning with language models and domain-relevant auxiliary tasks","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.479766Z"},"links":{"cited_paper":"/paper/2011.13230","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:0065b3a72f10b235f133e852a7331f763b5074402733e89ae00fb32234c8520e","observation_id":"01dff2ad-aba4-4f00-8d0a-74dfdce009e8","resolution":{"observed_at":"2026-08-11T20:23:44.479766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.438721Z","title":null,"venue":null,"work_id":"7729945d-0914-4aec-8328-099d706ad5f9","year":null},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.484280Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:48868c0b41ac4f36c88c42788bbc4a10b9d27c77fcbc32db441958f1b941633c","observation_id":"ad8680e8-2070-432b-bea9-c88b45b81ac1","resolution":{"observed_at":"2026-08-11T20:23:45.443144Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.424146Z","title":"Probabilistic transformer: Modelling ambiguities and distributions for rna folding and molecule design","venue":null,"work_id":"8411bc17-4b6c-4791-af3a-018e0849d479","year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.488414Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:2c44325caac30f6bea9b09bc67e7cc12ccff2120cbf2e9b15dbca53db37ad75b","observation_id":"5dd08907-e680-4ff1-9fb5-0b1ec54e1a65","resolution":{"observed_at":"2026-08-11T20:23:45.429111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.409191Z","title":"Admetlab 3.0: an updated comprehensive online admet prediction platform enhanced with broader coverage, improved performance, api functionality and decision support","venue":null,"work_id":"256f6288-faca-4d86-b1e2-1644d44e21a1","year":2024},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.492592Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:34e1241205bf82c194323e05cd9b2a9395d4465a82b4ba51264770da436a5b42","observation_id":"47fceb73-e667-40e1-be9c-289ab20cbde1","resolution":{"observed_at":"2026-08-11T20:23:45.413861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.395665Z","title":"Sample efficiency matters: a benchmark for practical molecular optimization","venue":null,"work_id":"0992401b-a521-402a-aa16-7acc48da78de","year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.496598Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:c998858fed2ea0b41ca361fd1a26bac572f94d289d5e7e18c6f802ef6b1c365c","observation_id":"bf9b64c5-33dc-4448-842e-79ff154a2b0f","resolution":{"observed_at":"2026-08-11T20:23:45.399831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.382085Z","title":"Chembl: a large-scale bioactivity database for drug discovery","venue":null,"work_id":"82899299-6661-40c2-b15d-03aadae4bc34","year":2012},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.500932Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:bc13b80296f54abf0e3fd18b9d5e217e2fd62c4d76b412e85c0aca54eac8db7c","observation_id":"e753c78a-584c-41b8-80e8-e2cee12e4e44","resolution":{"observed_at":"2026-08-11T20:23:45.386159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.368545Z","title":"Prefix-tree decoding for predicting mass spectra from molecules","venue":null,"work_id":"19ca7296-108a-4f75-a45f-9018b504849d","year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.504888Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:b0d729c10c844d7d5da9cf8ce1f8a01cc4792388771271e8a7e70a15f4843c1c","observation_id":"47795c5b-3fb8-48c7-bebb-25752fb2b668","resolution":{"observed_at":"2026-08-11T20:23:45.373253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.354514Z","title":"Diffusing on two levels and optimizing for multiple properties: A novel approach to generating molecules with desirable properties","venue":null,"work_id":"3ffdf8d6-b923-4e9a-b3b8-50b6c9893849","year":2024},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.508912Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:3ecafd131e0a2ed8b7313e3e8c40e3ff19b184f6c421de40de3139f75fc3ade2","observation_id":"c0d30177-c030-4647-b395-89f42807bad2","resolution":{"observed_at":"2026-08-11T20:23:45.359016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18365","last_updated":"2023-12-28T04:29:36Z","snapshot_observed_at":"2026-08-13T11:31:47.943019Z","submitted_at":"2023-05-27T14:17:33Z","title":"What can Large Language Models do in chemistry? A comprehensive benchmark on eight tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18365","snapshot_observed_at":"2026-08-11T20:23:44.512969Z","title":"What indeed can gpt models do in chemistry? a comprehensive benchmark on eight tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.512969Z"},"links":{"cited_paper":"/paper/2305.18365","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:49a081e5d3348b557de78733490a0adfa3e87a26cc97dd2cc34185a21e86de5d","observation_id":"49abe2a6-c0e6-408c-b880-3ff61518f8f6","resolution":{"observed_at":"2026-08-11T20:23:44.512969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.517389Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.517389Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:cf9ea213b50b6bea4d97fae0f2acbcbdc542f0772fa2d088e62df0fe333f5e2c","observation_id":"0cb11ef7-0871-43c7-b92d-9d97eb350fb9","resolution":{"observed_at":"2026-08-11T20:23:44.517389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T20:23:44.521340Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.521340Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:f14ad3a89e8646a4ddfa279c92e67166e2fb781f33877d88db86997759ab185f","observation_id":"f25cfd4f-e920-4eb4-aa07-4772ebf5932a","resolution":{"observed_at":"2026-08-11T20:23:44.521340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.331264Z","title":"Principles of early drug discovery","venue":null,"work_id":"bfae3c31-f644-4d69-b56d-59c7bd706e8b","year":2011},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.525455Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:9fb602a7ef0fdcda6b52746c1a3f38796eb7c270ba1e9daadd53cb5c780ad9fe","observation_id":"14f42b1a-cb0e-4c26-af27-8d6c77ad801e","resolution":{"observed_at":"2026-08-11T20:23:45.335743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.317508Z","title":"Zinc- a free database of commercially available compounds for virtual screening","venue":null,"work_id":"362759e4-15f9-4fd6-8a05-a896e46a45bd","year":2005},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.529381Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:047e41687474ce40427c976083e040a0aa74f53b7aed419b62c24731c295593c","observation_id":"a293946b-ca50-4e7b-bc96-733baf6a5d24","resolution":{"observed_at":"2026-08-11T20:23:45.322117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.303650Z","title":"Comprehensive assessment of nine target prediction web services: which should we choose for target fishing? Briefings in Bioinformatics, 24(2):bbad014, 2023","venue":null,"work_id":"ecc0c4c7-ec08-433a-acae-d3873af3997d","year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.533664Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:f48ff4567dcdf1e3a0060cfeee55259a2fbd6961808b4449483a4065fc1b7954","observation_id":"1ec5520c-167f-48b3-b73a-8d603a777c18","resolution":{"observed_at":"2026-08-11T20:23:45.308360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.289776Z","title":"Pubchem substance and compound databases","venue":null,"work_id":"1fd13d0f-6925-41cc-b6f1-2de10005a6a7","year":2016},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.538396Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:6f53c7f0428fea3037bf3c26d20119212de42b92e058022b774bb03f7694da7c","observation_id":"5f5a8207-be54-4c65-b79f-5b912095d582","resolution":{"observed_at":"2026-08-11T20:23:45.294226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.275861Z","title":"Molecule generation by principal subgraph mining and assembling","venue":null,"work_id":"642a5451-0100-4c90-91d6-157acc143bec","year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.542618Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:e0e4a58cadda0e21ea7ffc70e12310fb31f2b07071bf45500b69603db0e83681","observation_id":"841adf63-1e00-455b-98fb-8af23f1e5175","resolution":{"observed_at":"2026-08-11T20:23:45.280413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.262298Z","title":"Natural questions: a benchmark for question answering research","venue":null,"work_id":"d69ba3b8-e3a4-435d-9b92-58f7a00388ea","year":2019},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.546773Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:df3c93a05085c94a18e7b12dbbc40dd8ed244b269be594fbf315836f337bdfac","observation_id":"54518682-161b-469e-8369-aa872adfeeda","resolution":{"observed_at":"2026-08-11T20:23:45.266579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.249660Z","title":"Rdkit documentation","venue":null,"work_id":"54960a9d-0944-46ae-90f0-b9ec5ffd17f4","year":2013},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.550694Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:2cc3e2f4f7301c8b184c01dbaef0adf4e970e5853e8cd0ddf90565decc298218","observation_id":"621179b8-bc8a-4ce7-952c-22a20fe797c1","resolution":{"observed_at":"2026-08-11T20:23:45.253541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.235371Z","title":"Effective drug–target interaction prediction with mutual interaction neural network","venue":null,"work_id":"e8d72b49-6c73-486d-a653-48ce68cfefa8","year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.554807Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:6a171dd192961d7171183dea1361d9a8755c1451759f0f7cd6187f8a1da6b8cb","observation_id":"6dfaa0c4-00aa-4847-8198-a652fb9157e1","resolution":{"observed_at":"2026-08-11T20:23:45.240334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.219700Z","title":"Deep learning methods for molecular representation and property prediction","venue":null,"work_id":"51801e60-6aee-466d-99db-552e376a2c26","year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.558838Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:d2b4d003ed9b26e3b4a25853bde7d4905f7a574d06eb8e8c4ada511167ba46d5","observation_id":"56f2991d-75e6-40e8-bacf-15d5d5f68835","resolution":{"observed_at":"2026-08-11T20:23:45.224604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.204847Z","title":"Git- mol: A multi-modal large language model for molecular science with graph, image, and text","venue":null,"work_id":"1abff81b-cebf-4058-b658-58a0f4b2f454","year":2024},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.563033Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:c40278fb11f37bc7430058b4cad4d60b64ae2ae691b1c3915a52b458716b9178","observation_id":"3f9df5aa-31fd-46c6-818d-7eeeb29eeae7","resolution":{"observed_at":"2026-08-11T20:23:45.209398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.190678Z","title":"A quantitative analysis of knowledge-learning preferences in large language models in molecular science","venue":null,"work_id":"05e55fb4-a4a5-4247-8fbf-bd908f1ab541","year":2025},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.566716Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:2f1b035ddfaac938a510e829f65a8884b6e1cdeb6d280c5bc38347e8d95a7955","observation_id":"6fe094ad-371e-494d-9022-476eaa1be388","resolution":{"observed_at":"2026-08-11T20:23:45.195249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.176534Z","title":"A group symmetric stochastic differential equation model for molecule multi-modal pretraining","venue":null,"work_id":"a6c3d68d-a1f7-47fd-b3e4-0d1ee796760c","year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.570481Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:12fa7b4bc36676ed48c97124f55542fb7c20675384beb87ef8f6e815a0da8e55","observation_id":"251e7753-0bf4-43ef-89f9-a2d3aae5681a","resolution":{"observed_at":"2026-08-11T20:23:45.181022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.162487Z","title":"Multi-modal molecule structure–text model for text-based retrieval and editing","venue":null,"work_id":"edd4bace-5be2-4d8b-89fe-b60398bc3b53","year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.574198Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:9055c761b51a03aac7800f6e49cc680c59d3b4575a92b569ae17a2d24b447527","observation_id":"9d29448a-ca29-491f-8fa9-c21c3a1ae7b9","resolution":{"observed_at":"2026-08-11T20:23:45.167047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.148031Z","title":"Dynamicbind: predicting ligand-specific protein-ligand complex structure with a deep equivariant generative model","venue":null,"work_id":"2c59d889-5f8f-41b2-afa4-e3950fb4aa01","year":2024},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.577971Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:a29a657ec2d19071a2663b92aab264957ffb85f9eaf12299492344b2de851977","observation_id":"4c45f5c0-172e-4c23-8bae-54bcaed832c4","resolution":{"observed_at":"2026-08-11T20:23:45.152949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02229","last_updated":"2022-12-06T16:53:52Z","snapshot_observed_at":"2026-08-13T13:39:29.957433Z","submitted_at":"2022-11-18T18:11:27Z","title":"GPS++: An Optimised Hybrid MPNN/Transformer for Molecular Property Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02229","snapshot_observed_at":"2026-08-11T20:23:44.581668Z","title":"Gps++: An optimised hybrid mpnn/transformer for molecular property prediction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.581668Z"},"links":{"cited_paper":"/paper/2212.02229","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:8d3d23ffad4496b02a7d01e36a7deb83e723ca8b678ff834ce04e9788fd56108","observation_id":"4cceecc7-5b90-41e8-8fb5-7432a365fcb6","resolution":{"observed_at":"2026-08-11T20:23:44.581668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08730","last_updated":"2018-06-20T16:39:26Z","snapshot_observed_at":"2026-07-06T06:46:18.285019Z","submitted_at":"2018-06-20T16:39:26Z","title":"The Natural Language Decathlon: Multitask Learning as Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08730","snapshot_observed_at":"2026-08-11T20:23:44.585913Z","title":"The natural language decathlon: Multitask learning as question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.585913Z"},"links":{"cited_paper":"/paper/1806.08730","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:a6bef6d78f404be64233293cb7389a4a8a34622937de8fac2b1bc5fa8ae6d9dd","observation_id":"c82e1d9d-0496-4e2c-8a02-5956d600d4ab","resolution":{"observed_at":"2026-08-11T20:23:44.585913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03426","last_updated":"2020-09-18T01:56:41Z","snapshot_observed_at":"2026-08-02T15:32:07.466568Z","submitted_at":"2018-02-09T19:39:33Z","title":"UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03426","snapshot_observed_at":"2026-08-11T20:23:44.590198Z","title":"Umap: Uniform manifold approximation and projection for dimension reduction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.590198Z"},"links":{"cited_paper":"/paper/1802.03426","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:edca4a9c94dbf0d581750787ad163ade83e899887e436533b2f354a8143862c6","observation_id":"b0170017-0290-40f0-be88-91d6fdf5b6df","resolution":{"observed_at":"2026-08-11T20:23:44.590198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.594107Z","title":"Open babel: An open chemical toolbox","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.594107Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:9a39f44d4d79b5e59d315fac60f00027c1afaee63b79493a374d85816ca3eeda","observation_id":"a81f9f22-da2e-41ec-95ab-a0e3a97c388b","resolution":{"observed_at":"2026-08-11T20:23:44.594107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.598573Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.598573Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:5ba08f8a4db5814a4720e4422819497140f0b8746b6e1d57631f0e64db04a222","observation_id":"1781459a-1db6-4cbb-86a8-a95cc1426ad5","resolution":{"observed_at":"2026-08-11T20:23:44.598573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.116184Z","title":"Molecular sets (moses): a benchmarking platform for molecular generation models","venue":null,"work_id":"46a8bd99-8843-4b6e-a976-3af147411032","year":2020},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.602675Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:d29d56038705241a0bad79b41664a270d46b7d96fdaa1602f7b508a8284bdaae","observation_id":"4f54f228-a706-48b9-81ad-66745f0c1083","resolution":{"observed_at":"2026-08-11T20:23:45.120233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.08771","last_updated":"2018-09-12T14:13:33Z","snapshot_observed_at":"2026-08-10T08:51:09.033778Z","submitted_at":"2018-04-23T22:54:55Z","title":"A Call for Clarity in Reporting BLEU Scores","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.08771","snapshot_observed_at":"2026-08-11T20:23:44.606669Z","title":"A call for clarity in reporting bleu scores","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.606669Z"},"links":{"cited_paper":"/paper/1804.08771","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:3a63db82f0469a20a2909d30799b3d374646ef31a09dba95c302926086ca8a24","observation_id":"ead41d8c-d4be-4397-bfd2-fd556f1f34f9","resolution":{"observed_at":"2026-08-11T20:23:44.606669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.103143Z","title":"Quantum chemistry structures and properties of 134 kilo molecules","venue":null,"work_id":"adc5505a-ae23-4651-85eb-c7b374071b31","year":2014},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.610888Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:827ba50131516c939b95ad504560dad46a1af7efc24d92df2664783d27992f3c","observation_id":"6bbaef10-8a6b-4ec7-b30d-21d901af7f35","resolution":{"observed_at":"2026-08-11T20:23:45.107326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.088620Z","title":"Self-supervised graph transformer on large-scale molecular data","venue":null,"work_id":"9d1c1b4c-ff51-4a91-a84a-ced92a139c5d","year":2020},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.615058Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:8815ff8c589135a6531719b8a310b9ce3471e35709ff52c069a6b6d3b2826cdf","observation_id":"61ba9ff8-b6a9-452e-b6ea-31ed34c468f7","resolution":{"observed_at":"2026-08-11T20:23:45.093471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.074301Z","title":"Enumeration of 166 billion organic small molecules in the chemical universe database gdb-17","venue":null,"work_id":"a6488b37-e3ae-40e1-bd78-2ae23055cd7c","year":2012},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.619166Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:481ac7679413ee9a26ac4ff831a18448da30a594150a64e67b75c766e5758b94","observation_id":"e0f1d78f-a1f0-4144-946f-d3fbb3fb7c87","resolution":{"observed_at":"2026-08-11T20:23:45.078940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.060084Z","title":"A comprehensive map of molecular drug targets","venue":null,"work_id":"c3add7bf-d879-4c7d-9057-4d90688a6f65","year":2017},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.623320Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:a9d9f3997f9ded77b69a578a904f25b6b0c62ed1de4670c5abbf9ba0c0b51235","observation_id":"dea4ce02-d5a9-41c0-abf2-d120a41abfb7","resolution":{"observed_at":"2026-08-11T20:23:45.064868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.627447Z","title":"Equivariant flow matching with hybrid probability transport for 3d molecule generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.627447Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:bf2ec13a43e71537645917eb9fe8f65ee93e2c0174421156f4f1ae88d68141fa","observation_id":"54c61ef4-6e38-44fe-b54e-f7a1e7db5ae7","resolution":{"observed_at":"2026-08-11T20:23:44.627447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.036032Z","title":"Evidence-based absorption, distribution, metabolism, excretion (adme) and its interplay with alternative toxicity methods","venue":null,"work_id":"75854e1d-4b35-4073-9af3-ac7c8c341d8d","year":2016},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.631587Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:8ab2b0d07774ebee7939192fa3b4d1bbfcdc863b57d3c1d93fb4188d9ff78499","observation_id":"64e0b337-53db-4f52-aed0-59a572294ecf","resolution":{"observed_at":"2026-08-11T20:23:45.040899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-11T20:23:44.635762Z","title":"Glue: A multi- task benchmark and analysis platform for natural language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.635762Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:9a950937438c82db5934c62fdcfbb2a34224c9f691651f77e1768be2d28802f0","observation_id":"f6d4ca9e-25f1-440d-a945-f02d77584ce3","resolution":{"observed_at":"2026-08-11T20:23:44.635762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.021590Z","title":"Deep learning approaches for de novo drug design: An overview","venue":null,"work_id":"870d330e-430d-4d1b-b445-e9f1798a8c8b","year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.640563Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:3d48dbeb7c6043af8d2e2712fb3ff6a32d1aa7c98a3bb5cea29cc911cfd076f4","observation_id":"aecb832e-a49c-447d-a200-4cd90ae35831","resolution":{"observed_at":"2026-08-11T20:23:45.026238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:45.007446Z","title":"Multitask joint strategies of self- supervised representation learning on biomedical networks for drug discovery","venue":null,"work_id":"7d05f2c7-deca-48c4-9f0b-6dbc5573c976","year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.644567Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:2f1b8c0f8781c51988c51da63786b273b4d3f68acaa4e7d924255d02c53c7e2a","observation_id":"cacbdd2e-2d84-4e15-801e-dd8fcbb64373","resolution":{"observed_at":"2026-08-11T20:23:45.011938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16666","last_updated":"2024-04-19T13:19:53Z","snapshot_observed_at":"2026-08-13T05:15:33.975594Z","submitted_at":"2023-11-28T10:28:35Z","title":"MultiModal-Learning for Predicting Molecular Properties: A Framework Based on Image and Graph Structures","version":2},"cited_work":{"arxiv_id":"2311.16666","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.16666","snapshot_observed_at":"2026-08-11T20:23:44.715125Z","title":"MultiModal-Learning for Predicting Molecular Properties: A Framework Based on Image and Graph Structures","venue":"cs.LG","work_id":"46136db9-369e-4655-9a88-a25c429d755d","year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.648543Z"},"links":{"cited_paper":"/paper/2311.16666","citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:f169a26838ef02e8d266339df77d1c64d321fcb97ecde23c924c4f68c480490b","observation_id":"820a7390-bed4-4b94-8261-a18a73d3c97d","resolution":{"observed_at":"2026-08-11T20:23:44.721154Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.993773Z","title":"Moleculenet: a benchmark for molecular machine learning","venue":null,"work_id":"628c5364-8525-4396-b5dc-bece2e431ff1","year":2018},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.652793Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:d85173920062350a18277477cbe88f5d59902e5653e820f62cf1faff36f6c76e","observation_id":"49787b15-2cd1-409a-9e6c-2db199eccf78","resolution":{"observed_at":"2026-08-11T20:23:44.998084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.980195Z","title":"Hit and lead discovery with explorative rl and fragment-based molecule generation","venue":null,"work_id":"90f40f40-de00-4c13-b96f-202d4ec73620","year":2021},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.656760Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:4ce36c1965d3b26c2a3f4c9f16112e5e9e722406ff0bd4b3b0cbed3b2e156080","observation_id":"82e11962-525f-4820-a242-e8aebac133ff","resolution":{"observed_at":"2026-08-11T20:23:44.984715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.965472Z","title":"Quandb: a quantum chemical property database towards enhancing 3d molecular representation learning","venue":null,"work_id":"eefe3db4-171b-4c37-97c0-0d47a6bfe5cb","year":2024},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.660771Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:4d9033cff6063150fefea4adb2db8712206490c63e2a9fe9433384f18867f737","observation_id":"78188a9b-8257-4aaa-b1d1-ce8cf87a8468","resolution":{"observed_at":"2026-08-11T20:23:44.969962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.950769Z","title":"Drugassist: A large language model for molecule optimization","venue":null,"work_id":"46d28b38-1ed0-493d-bd84-2ca461ccc44f","year":2025},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.665090Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:14d935eafcaae772da7fd1b70b43acff500df081d01383c27545aadf80fa0fab","observation_id":"ff217361-f230-4c9e-9109-eb2ccbf8b6d9","resolution":{"observed_at":"2026-08-11T20:23:44.955140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.935973Z","title":"A unified drug–target interaction prediction framework based on knowledge graph and recommendation system","venue":null,"work_id":"e8339eae-14b2-4444-8fa4-dbd571b04584","year":2021},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.669042Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:240ee243f5680939e50fd4f28991ed908bfe8692732db4c4bda3d62d391c2790","observation_id":"77d442c8-e3be-4e62-9325-205d4e5a274d","resolution":{"observed_at":"2026-08-11T20:23:44.941330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.922286Z","title":"Multimodal molecular pretraining via modality blending","venue":null,"work_id":"ba45bd80-9e03-4902-af87-206964a1008d","year":2023},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.673241Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:11569e0c6836fcc76f973f76f0fa4ae5386da797fc7f415534e06129d39606a2","observation_id":"1ba6f37b-9012-4b37-8d24-930721ef07cd","resolution":{"observed_at":"2026-08-11T20:23:44.926749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.908671Z","title":"Moflow: an invertible flow model for generating molecular graphs","venue":null,"work_id":"3f6e8bf0-0eb1-4efa-87cc-872ae4449fbb","year":2020},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.677270Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:52cc0f7f72c2cab10ffa46a9f7d3186d310be0fae7df94e53c449155beef2d23","observation_id":"85fd23a8-12c8-49d1-902c-8a6fb97c0548","resolution":{"observed_at":"2026-08-11T20:23:44.913107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:23:44.894090Z","title":"A deep-learning system bridging molecule structure and biomedical text with comprehension comparable to human professionals","venue":null,"work_id":"9ef29109-7167-41a9-815a-0079ede0030a","year":2022},"citing_paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T20:23:44.680955Z"},"links":{"citing_paper":"/paper/2412.06847"},"observation_digest":"sha256:f09ffccccb6b84393b5f0916ba5aa0f22a4f89a0c5a8749a879a4ea21781b9bb","observation_id":"1cf5ca1f-428b-49a2-9119-4089a62eb854","resolution":{"observed_at":"2026-08-11T20:23:44.898807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.06847","last_updated":"2025-03-16T12:37:49Z","latest_version":2,"primary_category":"q-bio.QM","snapshot_observed_at":"2026-08-12T06:58:29.445852Z","submitted_at":"2024-12-08T03:43:07Z","title":"M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":45},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2412.06847."}