{"as_of":"2026-08-07T23:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:90cba19700ba128e7c2caff66480c12bb49c80dd4836bd336196881786556197","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:10:47.738852Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.08643/citation-record","integrity":"/paper/2506.08643/integrity","json":"/paper/2506.08643/citation-record.json","paper":"/paper/2506.08643"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.168998Z","title":null,"venue":null,"work_id":"b2a65e27-2765-42d4-a4a6-0d22bf1e9082","year":2022},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.622410Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:3eefe4380e4870acfc9571a0224c8ec4a2e3db2b010e8a1df297db7f43b00ef1","observation_id":"27882341-1330-4df4-a831-7b405c940710","resolution":{"observed_at":"2026-08-07T05:10:48.172701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.156737Z","title":"Deep Reinforcement Learning from Human Preferences.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"c58067be-fb49-4810-84ac-760e20166d72","year":2017},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.626913Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:125d984467e928fa969aed48ccd2ab64de1e181480f54153974dcb0a8071c467","observation_id":"58cdae0f-28af-4945-9fb0-aee46b596d3b","resolution":{"observed_at":"2026-08-07T05:10:48.161122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-07T05:10:47.630917Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model.arXiv preprint arXiv:2305.18290, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.630917Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:fd5b8a4d8cd3af51f06b585b7db212fd4c9fd3439b4b9adf2617a1335b2d85f7","observation_id":"bfdf5909-7334-42f5-a450-a7b5d1f9b5c4","resolution":{"observed_at":"2026-08-07T05:10:47.630917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T05:10:47.635344Z","title":"Deepseekmath: Pushing thelimitsofmathematicalreasoninginopenlanguagemodels.arXivpreprintarXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.635344Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:053d1c7f9d15da963415a0a64d8c5e735a087c7f365de08fcc73aec58d9fc376","observation_id":"dbfc23ff-a6e2-47f1-b1dc-e4eb0066af96","resolution":{"observed_at":"2026-08-07T05:10:47.635344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19332","last_updated":"2024-11-05T07:21:18Z","snapshot_observed_at":"2026-07-06T18:22:10.094519Z","submitted_at":"2024-05-29T17:59:07Z","title":"Self-Exploring Language Models: Active Preference Elicitation for Online Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19332","snapshot_observed_at":"2026-08-07T05:10:47.640424Z","title":"Self-exploring language models: Active preference elicitation for online alignment.arXiv preprint arXiv:2405.19332, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.640424Z"},"links":{"cited_paper":"/paper/2405.19332","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:16509fd4a6f75c6c3d5a195c845fbb46c4b1ec2cad1caa31aca1a1e013c4a404","observation_id":"95de08ac-82bd-4bc9-aeae-fa829c9d921b","resolution":{"observed_at":"2026-08-07T05:10:47.640424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.143466Z","title":"Rlhf workflow: From reward modeling to online rlhf, 2024","venue":null,"work_id":"2ab49006-818b-4d82-95b3-5feaf2700001","year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.645289Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:9cfd5a652d5319b7e60ca38439c7e81207117620a4cbb098ac8e7ae793ea8b5f","observation_id":"61805581-0aa0-46b5-bd5d-072e76c637b2","resolution":{"observed_at":"2026-08-07T05:10:48.147719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.130396Z","title":"Iterative reasoning preference optimization, 2024","venue":null,"work_id":"daf3c87f-ee4d-48a8-a5c3-5892d2308bbc","year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.650814Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:46fb9d938bff9a857e39ae426a3b563ff3682c0a6e7e8315e325cc1e734b4a43","observation_id":"62ebd2c6-aafd-4c20-a118-1df51773acc9","resolution":{"observed_at":"2026-08-07T05:10:48.135347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.119331Z","title":"Self-consistencyimproveschainofthoughtreasoninginlanguage models, 2023","venue":null,"work_id":"fdc6f4ba-8bcc-45d2-bf61-10ec0e15257d","year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.654564Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:bf43357c7129415450b82dfa9dd627e8d22e0b4378651aac247907b9ba2a4442","observation_id":"3ea0c8e9-79b3-4378-886f-c3d82cd5f275","resolution":{"observed_at":"2026-08-07T05:10:48.123023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.106750Z","title":"LLM-Blender: Ensembling Large Language Models with Pairwise Ranking and Generative Fusion, 2023","venue":null,"work_id":"da90c0d1-099c-402a-b70a-2e42a9c384c4","year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.657915Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:823111f7715dca520f624b5b8a08e3533d279e2780b1a7dfaaaac9779830ceec","observation_id":"9dfa1c39-c779-4b98-b9b2-af5917958369","resolution":{"observed_at":"2026-08-07T05:10:48.111650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.094553Z","title":"Self-refine: Iterative refinement with self-feedback, 2023","venue":null,"work_id":"cb4f8a2f-ad9b-4915-ba28-e21d528caf8d","year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.661140Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:f8b4b7d933d6728a9a88b7bca03d1674e88634137a7b6f292e6df6c7d86ff9ec","observation_id":"c2b5542a-cc9a-49fd-97c4-98d0d2093555","resolution":{"observed_at":"2026-08-07T05:10:48.099223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04692","last_updated":"2024-06-07T07:04:10Z","snapshot_observed_at":"2026-08-07T21:51:22.136369Z","submitted_at":"2024-06-07T07:04:10Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04692","snapshot_observed_at":"2026-08-07T05:10:47.664602Z","title":"Mixture-of-agents enhances large language model capabilities.arXiv preprint arXiv:2406.04692, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.664602Z"},"links":{"cited_paper":"/paper/2406.04692","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:571be5d5eaaa78c3f022a63a180ff1bba89f7a25fffefe944378613ffcf58031","observation_id":"a094e9af-d346-4177-9362-b7fa7e2527f2","resolution":{"observed_at":"2026-08-07T05:10:47.664602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-07T05:10:47.668467Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations.arXiv preprint arXiv:2312.08935, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.668467Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:5c6955b2c82f6a1f3fdc2e59a2e544c295add500cf4baaa347e5bf31878ebfc1","observation_id":"8cf393f2-5050-43b1-a125-9ebde517fe12","resolution":{"observed_at":"2026-08-07T05:10:47.668467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.672230Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.672230Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:e6b8ff75cb7306f65b40263015b35d012505b6efbe07be17cf9703630046df8c","observation_id":"987e069c-93af-41e1-af18-175339f600f2","resolution":{"observed_at":"2026-08-07T05:10:47.672230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.676429Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.676429Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:06321f593141d265d2873c206135f0dbc5cb13af6e5f5126d6f101fc23d56bff","observation_id":"0dec1e55-ad11-4e91-9a5c-75e7c0d30d8c","resolution":{"observed_at":"2026-08-07T05:10:47.676429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.680150Z","title":"Proximal Policy Optimization Algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.680150Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:35b2b7e13e2fb68d18ac227601d2f0b2dd945e67c9c5731d3576a79bc9feef8a","observation_id":"ac9d8ef4-c215-4eb4-a48f-6cdc67a58d81","resolution":{"observed_at":"2026-08-07T05:10:47.680150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T05:10:47.683724Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.683724Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:b3114437f3fc3b7b91a13578154999d993831ecd41d84f7d500c801e7fec880e","observation_id":"beddbc8d-7e06-4ce8-be57-2db901814d09","resolution":{"observed_at":"2026-08-07T05:10:47.683724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.061725Z","title":"Introducing openai o3 and o4-mini","venue":null,"work_id":"66d83253-1c39-4f7e-b5c1-99158076deff","year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.687742Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:0358b9eb1b4ea478b495dd13c50fa90ccd6229acbfd4931029d3d8970e6c3523","observation_id":"ad9307ea-2f30-4894-b58f-e8a7cbacd983","resolution":{"observed_at":"2026-08-07T05:10:48.065812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T05:10:47.692219Z","title":"Chain-of-thought prompting elicits reasoning in large language models.arXiv preprint arXiv:2201.11903, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.692219Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:04dbedd3f9fdfec06a1aba682d4522ebf605097a04f8d9847e4817edb1bc1c96","observation_id":"74987d55-c4a2-49a2-a2ef-ccb0736a1bd5","resolution":{"observed_at":"2026-08-07T05:10:47.692219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.695845Z","title":"Least-to-most prompting enables complex reasoning in large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.695845Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:04601a2a72a1a38bfee165e28c13898f04d3779b5366ba0bdeae311d728d53df","observation_id":"326c78ae-8728-4f82-a649-650eb2bd7896","resolution":{"observed_at":"2026-08-07T05:10:47.695845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02561","last_updated":"2023-06-30T21:39:54Z","snapshot_observed_at":"2026-08-05T15:27:19.717152Z","submitted_at":"2023-06-05T03:32:26Z","title":"LLM-Blender: Ensembling Large Language Models with Pairwise Ranking and Generative Fusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02561","snapshot_observed_at":"2026-08-07T05:10:47.699915Z","title":"Llm-blender: Ensembling large language models with pairwise ranking and generative fusion.arXiv preprint arXiv:2306.02561, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.699915Z"},"links":{"cited_paper":"/paper/2306.02561","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:f0b3b14c36ea5a7ae4bee8aa9bd676560aff0989c2b8479489834d0839e11938","observation_id":"6b271064-6b92-40f7-b857-bd7ba9331e1c","resolution":{"observed_at":"2026-08-07T05:10:47.699915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.042289Z","title":"University of Michigan Press, 1975","venue":null,"work_id":"70287e79-33fe-4689-b86b-fa174e7eef22","year":1975},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.703283Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:3fa7465fc44844609b9381898285e3aaaa24ae46a3006fcebfd386234954378d","observation_id":"c7a3e8e7-6e2e-4467-9b44-58a8ec10ad32","resolution":{"observed_at":"2026-08-07T05:10:48.045880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.030426Z","title":null,"venue":null,"work_id":"d8798a5c-ff9d-4220-9bcf-2cd591cb56ea","year":1983},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.706864Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:2066d5c64cb3d399d12d56b303a851bf4ee7d4ce45ecb684c47130e053f832b5","observation_id":"da481354-9ed3-460d-85e9-a803f3ad467d","resolution":{"observed_at":"2026-08-07T05:10:48.034197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.017856Z","title":"Onevolution,search,optimization,geneticalgorithmsandmartialarts: Towards memetic algorithms","venue":null,"work_id":"b2c3fc13-d060-4894-9954-862f24aeb317","year":1989},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.710202Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:9a55482e84a14364df97e3e2de6ea54071328e395ceea2f3f17c3318a462c030","observation_id":"3d61b798-5180-475c-9188-4a74497663fb","resolution":{"observed_at":"2026-08-07T05:10:48.022055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:48.005927Z","title":"Memetic computation—past, present & future [research frontier].IEEE Computational Intelligence Magazine, 5(2):24–31, 2010","venue":null,"work_id":"6d42e529-2a52-4677-bf24-dded5bfdab2f","year":2010},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.713154Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:198250fa1a8a598cf83fb95c99ab7f5961f4bba76ee0991197e16415500cd3c7","observation_id":"4778488d-0245-4a4e-8f9a-8ea03269eb1b","resolution":{"observed_at":"2026-08-07T05:10:48.010168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.993177Z","title":"Omran, A.P","venue":null,"work_id":"c113442b-291b-44ac-b6d7-54275c34fe55","year":2005},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.716566Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:fd30a2a2f33917944353c3213c6c0036854fbb626b62f27ef991d762e2576da9","observation_id":"26ea52d5-a577-43f9-92ca-c25801b56d7b","resolution":{"observed_at":"2026-08-07T05:10:47.997441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.981159Z","title":"Evolving code with a large language model, 2024","venue":null,"work_id":"ab873d59-a568-4643-b86a-22720c077f44","year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.719755Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:e6ab3f544f16f0878f5e33d68394ed593228b0ce104b7bbb2567c7198c14b071","observation_id":"5904a2f6-ff94-4461-ac0c-1406a6003c47","resolution":{"observed_at":"2026-08-07T05:10:47.985176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.969926Z","title":"Evolving deeper llm thinking, 2025","venue":null,"work_id":"ab4a0e58-bd85-4770-8057-f149a6e7906d","year":2025},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.722758Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:ae01201b9e58a5db1149f6cd5d1e52f8690fd99345636ee094635039c2ef0617","observation_id":"0c959754-f7ed-4857-b1bf-b5d850e2932a","resolution":{"observed_at":"2026-08-07T05:10:47.973970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.955448Z","title":"Llmrefine: Pinpointing and refining large language models via fine-grained actionable feedback, 2024","venue":null,"work_id":"433e04b0-ad07-47da-b7e8-fb54a9b0df42","year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.726073Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:e0b8c338f68d755d6c2fe8b8dda4bffeb9da3c68fb63d37b347fca2b83ac543c","observation_id":"2c1c3d80-f312-4fc0-ba9c-e86e7df256c8","resolution":{"observed_at":"2026-08-07T05:10:47.961634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.729198Z","title":"What makes a reward model a good teacher? an optimization perspective.arXiv preprint arXiv:2503.15477, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.729198Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:51e69bcda0b0cc43ca22a52ca208f47a6e991bed06fff96f79e20e8ed780eeca","observation_id":"6276d0b8-982b-4b02-92cc-5e67f32e6b2e","resolution":{"observed_at":"2026-08-07T05:10:47.729198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:10:47.732461Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.732461Z"},"links":{"citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:f8300a3895a4e251478b6392d2c2cb0115ae4a3734a9fd9d226ad3f5fccd500c","observation_id":"74b1f979-cc8e-47cb-b73b-fd3f452de62d","resolution":{"observed_at":"2026-08-07T05:10:47.732461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19409","last_updated":"2024-04-30T09:57:21Z","snapshot_observed_at":"2026-07-06T18:07:34.924208Z","submitted_at":"2024-04-30T09:57:21Z","title":"Countering Reward Over-optimization in LLM with Demonstration-Guided Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19409","snapshot_observed_at":"2026-08-07T05:10:47.735478Z","title":"Countering reward over-optimization in llm with demonstration-guided reinforcement learning.arXiv preprint arXiv:2404.19409, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.735478Z"},"links":{"cited_paper":"/paper/2404.19409","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:8d11efd3c900d9e5294628295217a0d29eb8a16d49fe4ee8aba47f59d73ef475","observation_id":"71434e16-9a23-4888-9167-faa6a70701b9","resolution":{"observed_at":"2026-08-07T05:10:47.735478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04373","last_updated":"2023-10-10T15:01:11Z","snapshot_observed_at":"2026-08-03T12:56:26.490744Z","submitted_at":"2023-10-06T16:59:17Z","title":"Confronting Reward Model Overoptimization with Constrained RLHF","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04373","snapshot_observed_at":"2026-08-07T05:10:47.738852Z","title":"Confronting reward model overoptimization with constrained rlhf.arXiv preprint arXiv:2310.04373, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:10:47.738852Z"},"links":{"cited_paper":"/paper/2310.04373","citing_paper":"/paper/2506.08643"},"observation_digest":"sha256:a1103096cff2800c4d09a01de2638e690213d076820aad57d3e96e4f876de251","observation_id":"bae79e4c-a56b-4df0-a91f-d32ef34bc8cd","resolution":{"observed_at":"2026-08-07T05:10:47.738852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.08643","last_updated":"2025-06-10T09:55:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T22:00:08.822941Z","submitted_at":"2025-06-10T09:55:53Z","title":"MEMETRON: Metaheuristic Mechanisms for Test-time Response Optimization of Large Language Models"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2506.08643."}