{"as_of":"2026-08-08T10:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:502495de3cddac3a71cd0ac7a4f515d765251157de11ff8e5f43ef5d168acafd","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:47:21.920389Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.07035/citation-record","integrity":"/paper/2506.07035/integrity","json":"/paper/2506.07035/citation-record.json","paper":"/paper/2506.07035"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:21.392741Z","title":"Guiding generative pro- tein language models with reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.392741Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:f48a32b78a4e18ea33df6ae01a21689bf88af249475f515a37ab194c9edc4c1f","observation_id":"e230158e-d9f8-474f-9577-93182e6e412c","resolution":{"observed_at":"2026-08-07T05:47:21.392741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:22.875503Z","title":"Saprot: Protein language modeling with structure-aware vocabulary","venue":null,"work_id":"be483c4a-cd84-481c-a2bb-50838257fe3a","year":2023},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.461837Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:6ab6927127ee54d975002d277b3c422fcb88291daae9560817d2fe25d4eec8a2","observation_id":"17e3a6be-1575-4161-b0aa-d1fc6e42461b","resolution":{"observed_at":"2026-08-07T05:47:23.037812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:22.624313Z","title":"Aligning protein generative models with experimental fitness via direct preference optimization","venue":null,"work_id":"db78b779-0566-46c0-b7d2-c1773f5ddd08","year":2024},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.517211Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:e261ff1eea51551c9bf417a0895918028c0d3256d4c77575742a25bdfa2f6412","observation_id":"0cce96fb-6f87-44c8-bf1b-47cabfec4727","resolution":{"observed_at":"2026-08-07T05:47:22.737356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10719","last_updated":"2024-10-10T08:30:17Z","snapshot_observed_at":"2026-07-06T18:01:05.698046Z","submitted_at":"2024-04-16T16:51:53Z","title":"Is DPO Superior to PPO for LLM Alignment? A Comprehensive Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10719","snapshot_observed_at":"2026-08-07T05:47:21.619389Z","title":"Is dpo superior to ppo for llm alignment? a comprehensive study","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.619389Z"},"links":{"cited_paper":"/paper/2404.10719","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:6204820c66158c6ad8587d59a5704e562b5034e42d78fd83bce5d596d553da45","observation_id":"43348961-396d-47d9-b7bd-1a31a60c7432","resolution":{"observed_at":"2026-08-07T05:47:21.619389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-04T23:38:14.844517Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-07T05:47:21.717895Z","title":"Rrhf: Rank responses to align language mod- els with human feedback without tears","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.717895Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:53fe7c513c186bf52cd052330b1c4d380d3b0a83a05f2b1c6c4f089e2b75b564","observation_id":"eb4a2363-412a-44da-98fa-a8a3cae7000a","resolution":{"observed_at":"2026-08-07T05:47:21.717895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11147","last_updated":"2022-06-03T16:31:08Z","snapshot_observed_at":"2026-07-06T12:31:34.241274Z","submitted_at":"2022-01-23T14:49:49Z","title":"OntoProtein: Protein Pretraining With Gene Ontology Embedding","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11147","snapshot_observed_at":"2026-08-07T05:47:21.783284Z","title":"Ontoprotein: Pro- tein pretraining with gene ontology embedding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.783284Z"},"links":{"cited_paper":"/paper/2201.11147","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:b863d108fe28c0418c5771b8509c7e262a2e96c0b441e015a234983628f3ba89","observation_id":"d06950e3-aa5f-4e06-87ce-3bb124a3dfb5","resolution":{"observed_at":"2026-08-07T05:47:21.783284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:22.488282Z","title":"Decoding the molecular language of proteins with evolla","venue":null,"work_id":"eee17376-2e49-45c4-8c1e-7faa389dcbf8","year":2025},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.850473Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:dfe0907c6f72f86ea7085d0b5e29573ab3253e4bbb6db6da0e1774dc97a30888","observation_id":"83c208dc-075b-4955-9cfb-625fdae660a2","resolution":{"observed_at":"2026-08-07T05:47:22.526889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T05:47:21.920389Z","title":"M., Stiennon, N., Wu, J., Brown, T","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.920389Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:cff5e16c7f6f3124ece56de419da367ba8b1088b29d30f2a1f5c184f32637200","observation_id":"6d074d5a-0045-44fa-9da1-ca76a3a4ef20","resolution":{"observed_at":"2026-08-07T05:47:21.920389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T05:47:20.296473Z","title":"Training a helpful and harmless assistant with rein- forcement learning from human feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.296473Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:626c812e8551d5d56a99c352dee5c2d8ac6a62b17e0a953519883f3aca31ff29","observation_id":"a7fc07ef-37c0-4ecf-8406-ac0e3d9eb7b0","resolution":{"observed_at":"2026-08-07T05:47:20.296473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14375","last_updated":"2022-09-28T19:04:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-28T19:04:43Z","title":"Improving alignment of dialogue agents via targeted human judgements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14375","snapshot_observed_at":"2026-08-07T05:47:20.522484Z","title":"Improving alignment of dialogue agents via targeted human judgements","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.522484Z"},"links":{"cited_paper":"/paper/2209.14375","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:0b041500093002a0e4dac0dc724b161d3db24fc67cc5323d3306cfe183bd3a62","observation_id":"95abaa59-ef2e-489d-afe8-9d151204e6df","resolution":{"observed_at":"2026-08-07T05:47:20.522484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-07T05:47:20.398463Z","title":"Raft: Re- ward ranked finetuning for generative foundation model alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.398463Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:ba8f203872995f6446701cd76f8a53c33a2bfe597881c8e7c9f3dbb86167742f","observation_id":"998e4fe7-f916-4953-b0e4-569012ae9acb","resolution":{"observed_at":"2026-08-07T05:47:20.398463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08146","last_updated":"2024-10-10T17:31:23Z","snapshot_observed_at":"2026-08-02T06:08:09.777151Z","submitted_at":"2024-10-10T17:31:23Z","title":"Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08146","snapshot_observed_at":"2026-08-07T05:47:21.311124Z","title":"Re- warding progress: Scaling automated process verifiers for llm reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.311124Z"},"links":{"cited_paper":"/paper/2410.08146","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:a5b8e023ea725755305a334be080a313b5878fd88872d45abdf7b4e7e43ccd44","observation_id":"980cfff8-9240-45bc-91ff-15cf896c17c1","resolution":{"observed_at":"2026-08-07T05:47:21.311124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:23.215061Z","title":"and Consortium, U","venue":null,"work_id":"85ff23f7-517f-4919-8794-439fce5bb83c","year":2011},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.149795Z"},"links":{"citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:8c7aa9605dbc45dbc3087351aefabfeefb29e51a8d5194cedc918a33c30fc907","observation_id":"acd71fa8-76be-4dc6-b46e-5717aec335d6","resolution":{"observed_at":"2026-08-07T05:47:23.363316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T05:47:21.248673Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.248673Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:00df188cc5fffcbbcb6535ec5a628c5302d2cf2c00b7104d16374f1d9e97b121","observation_id":"b576ddf5-c069-4db5-b88c-d3126faa2b27","resolution":{"observed_at":"2026-08-07T05:47:21.248673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10963","last_updated":"2024-06-25T03:14:10Z","snapshot_observed_at":"2026-08-05T17:51:38.668510Z","submitted_at":"2024-02-13T20:16:29Z","title":"GLoRe: When, Where, and How to Improve LLM Reasoning via Global and Local Refinements","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10963","snapshot_observed_at":"2026-08-07T05:47:20.679825Z","title":"Glore: When, where, and how to improve llm reason- ing via global and local refinements","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.679825Z"},"links":{"cited_paper":"/paper/2402.10963","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:c32c6b96feabf607e9e80d61f473923fd91200fd5690785cd439af54118df59b","observation_id":"b44131e8-95ac-4c9b-991f-64554fd390d4","resolution":{"observed_at":"2026-08-07T05:47:20.679825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15007","last_updated":"2025-01-25T00:59:12Z","snapshot_observed_at":"2026-08-07T22:22:36.153221Z","submitted_at":"2025-01-25T00:59:12Z","title":"Controllable Protein Sequence Generation with LLM Preference Optimization","version":1},"cited_work":{"arxiv_id":"2501.15007","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15007","snapshot_observed_at":"2026-08-07T05:47:22.262029Z","title":"Controllable Protein Sequence Generation with LLM Preference Optimization","venue":"cs.AI","work_id":"396a9fce-7055-4083-8d44-2fd5735653af","year":2025},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.987776Z"},"links":{"cited_paper":"/paper/2501.15007","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:1b1e81a4e0deaebe8ab5cd10620e259be1cfa69ef6a1803baf15ba243658ae79","observation_id":"94071797-2ba7-4f93-af11-be65da36226d","resolution":{"observed_at":"2026-08-07T05:47:22.322892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10584","last_updated":"2024-02-25T19:15:26Z","snapshot_observed_at":"2026-07-06T17:04:09.326801Z","submitted_at":"2023-12-17T02:14:15Z","title":"Policy Optimization in RLHF: The Impact of Out-of-preference Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10584","snapshot_observed_at":"2026-08-07T05:47:20.823057Z","title":"Policy optimization in rlhf: The impact of out-of-preference data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:20.823057Z"},"links":{"cited_paper":"/paper/2312.10584","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:6e2948477ed9f5fde3a6cba6c9c4c91e215d6f82f439648d65364d44a33f0a0b","observation_id":"cbcaa8fe-2360-4a59-8d31-ee40a228821a","resolution":{"observed_at":"2026-08-07T05:47:20.823057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.03497","last_updated":"2020-03-08T04:27:16Z","snapshot_observed_at":"2026-07-06T09:10:40.408664Z","submitted_at":"2020-03-08T04:27:16Z","title":"ProGen: Language Modeling for Protein Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.03497","snapshot_observed_at":"2026-08-07T05:47:21.080984Z","title":"S., Anand, N., Eguchi, R","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:21.080984Z"},"links":{"cited_paper":"/paper/2004.03497","citing_paper":"/paper/2506.07035"},"observation_digest":"sha256:9185c7f364e70b02dcd73da67f64fcb4a448bb085691b35c12caf09c1a23a58b","observation_id":"d4301f0d-e67f-4db0-bc1f-60f5b22cdf68","resolution":{"observed_at":"2026-08-07T05:47:21.080984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07035","last_updated":"2025-06-08T07:59:09Z","latest_version":1,"primary_category":"q-bio.BM","snapshot_observed_at":"2026-08-07T05:41:12.179171Z","submitted_at":"2025-06-08T07:59:09Z","title":"AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2506.07035."}