{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2023:UM2DPY7DSJ2YPEW67QG64K5U26","short_pith_number":"pith:UM2DPY7D","schema_version":"1.0","canonical_sha256":"a33437e3e392758792defc0dee2bb4d7abaec047266269c22de684056eb65e59","source":{"kind":"arxiv","id":"2401.10334","version":1},"attestation_state":"computed","paper":{"title":"DrugAssist: A Large Language Model for Molecule Optimization","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.AI","cs.CL","cs.LG"],"primary_cat":"q-bio.QM","authors_text":"Geyan Ye, Houtim Lai, Junhong Huang, Longyue Wang, Wei Liu, Xiangxiang Zeng, Xibao Cai, Xing Wang","submitted_at":"2023-12-28T10:46:56Z","abstract_excerpt":"Recently, the impressive performance of large language models (LLMs) on a wide range of tasks has attracted an increasing number of attempts to apply LLMs in drug discovery. However, molecule optimization, a critical task in the drug discovery pipeline, is currently an area that has seen little involvement from LLMs. Most of existing approaches focus solely on capturing the underlying patterns in chemical structures provided by the data, without taking advantage of expert feedback. These non-interactive approaches overlook the fact that the drug discovery process is actually one that requires "},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2401.10334","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","primary_cat":"q-bio.QM","submitted_at":"2023-12-28T10:46:56Z","cross_cats_sorted":["cs.AI","cs.CL","cs.LG"],"title_canon_sha256":"c675479b5737b33b4ea43d112a0bd6bb69d627b0a083f8074d9f16251c0456ca","abstract_canon_sha256":"cf746be155b3c82988eabeb2db3bd15202446b64fec46ae9a04cf3e649838deb"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T07:35:10.352132Z","signature_b64":"1+40Ev77n+IszdIRPdMFP88OFXJrGAONOCiP/sJsUMBkNyz8S+pOmcEJbudwMr33vsGjMlb+I3AoEGyboe2SDQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"a33437e3e392758792defc0dee2bb4d7abaec047266269c22de684056eb65e59","last_reissued_at":"2026-07-05T07:35:10.351670Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T07:35:10.351670Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"DrugAssist: A Large Language Model for Molecule Optimization","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.AI","cs.CL","cs.LG"],"primary_cat":"q-bio.QM","authors_text":"Geyan Ye, Houtim Lai, Junhong Huang, Longyue Wang, Wei Liu, Xiangxiang Zeng, Xibao Cai, Xing Wang","submitted_at":"2023-12-28T10:46:56Z","abstract_excerpt":"Recently, the impressive performance of large language models (LLMs) on a wide range of tasks has attracted an increasing number of attempts to apply LLMs in drug discovery. However, molecule optimization, a critical task in the drug discovery pipeline, is currently an area that has seen little involvement from LLMs. Most of existing approaches focus solely on capturing the underlying patterns in chemical structures provided by the data, without taking advantage of expert feedback. These non-interactive approaches overlook the fact that the drug discovery process is actually one that requires "},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2401.10334","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2401.10334/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2401.10334","created_at":"2026-07-05T07:35:10.351726+00:00"},{"alias_kind":"arxiv_version","alias_value":"2401.10334v1","created_at":"2026-07-05T07:35:10.351726+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2401.10334","created_at":"2026-07-05T07:35:10.351726+00:00"},{"alias_kind":"pith_short_12","alias_value":"UM2DPY7DSJ2Y","created_at":"2026-07-05T07:35:10.351726+00:00"},{"alias_kind":"pith_short_16","alias_value":"UM2DPY7DSJ2YPEW6","created_at":"2026-07-05T07:35:10.351726+00:00"},{"alias_kind":"pith_short_8","alias_value":"UM2DPY7D","created_at":"2026-07-05T07:35:10.351726+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":3,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2411.14721","citing_title":"MolReFlect: Towards In-Context Fine-grained Alignments between Molecules and Texts","ref_index":43,"is_internal_anchor":false},{"citing_arxiv_id":"2605.10831","citing_title":"SLIM: Sparse Latent Steering for Interpretable and Property-Directed LLM-Based Molecular Editing","ref_index":13,"is_internal_anchor":false},{"citing_arxiv_id":"2506.13131","citing_title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","ref_index":119,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/UM2DPY7DSJ2YPEW67QG64K5U26","json":"https://pith.science/pith/UM2DPY7DSJ2YPEW67QG64K5U26.json","graph_json":"https://pith.science/api/pith-number/UM2DPY7DSJ2YPEW67QG64K5U26/graph.json","events_json":"https://pith.science/api/pith-number/UM2DPY7DSJ2YPEW67QG64K5U26/events.json","paper":"https://pith.science/paper/UM2DPY7D"},"agent_actions":{"view_html":"https://pith.science/pith/UM2DPY7DSJ2YPEW67QG64K5U26","download_json":"https://pith.science/pith/UM2DPY7DSJ2YPEW67QG64K5U26.json","view_paper":"https://pith.science/paper/UM2DPY7D","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2401.10334&json=true","fetch_graph":"https://pith.science/api/pith-number/UM2DPY7DSJ2YPEW67QG64K5U26/graph.json","fetch_events":"https://pith.science/api/pith-number/UM2DPY7DSJ2YPEW67QG64K5U26/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/UM2DPY7DSJ2YPEW67QG64K5U26/action/timestamp_anchor","attest_storage":"https://pith.science/pith/UM2DPY7DSJ2YPEW67QG64K5U26/action/storage_attestation","attest_author":"https://pith.science/pith/UM2DPY7DSJ2YPEW67QG64K5U26/action/author_attestation","sign_citation":"https://pith.science/pith/UM2DPY7DSJ2YPEW67QG64K5U26/action/citation_signature","submit_replication":"https://pith.science/pith/UM2DPY7DSJ2YPEW67QG64K5U26/action/replication_record"}},"created_at":"2026-07-05T07:35:10.351726+00:00","updated_at":"2026-07-05T07:35:10.351726+00:00"}