{"as_of":"2026-08-21T01:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:faecae402c7a6540460f4b95838e82c6f6b2be4f03d96af62e9c715e7d3d9565","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T18:28:55.455816Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17316/citation-record","integrity":"/paper/2607.17316/integrity","json":"/paper/2607.17316/citation-record.json","paper":"/paper/2607.17316"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:48.242207Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:48.242207Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:ce4de4f1fef08b1d58fff975db4bc0f510fc3c7d9cbb871caa44d8dff4ba9ab8","observation_id":"b40b50a1-578c-4b91-a251-121d2c4f9890","resolution":{"observed_at":"2026-08-01T18:28:48.242207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:48.281237Z","title":", title =","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:48.281237Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:73900756969f58b4f620c595fd45b1c6fb963369e094ad070263c4bd789381c6","observation_id":"335cbe2e-9771-47d0-a97a-befee8cd600d","resolution":{"observed_at":"2026-08-01T18:28:48.281237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:48.343371Z","title":"and de Palma, Andr\\'","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:48.343371Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:a06af52d3509446bf152396e4785ae1f1df600bed7f41e9ed7f07cd3277d6cb6","observation_id":"950422e8-d2fc-4e9f-a5ed-77f948eba23e","resolution":{"observed_at":"2026-08-01T18:28:48.343371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:48.412428Z","title":"Economic Theory , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:48.412428Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:c7025cecb702ca6dfbc4f7dbed85fd42894bbffdc56d60eeb3ffec9ffe7d4995","observation_id":"25aec13f-4bad-4f9d-a47d-e2ac98366f96","resolution":{"observed_at":"2026-08-01T18:28:48.412428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:48.531743Z","title":"Proceedings of the 34th International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:48.531743Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:318f1486dc3b7e43618acefbc25bc55c4c8b8f1fa94da88069ebb40841c173fa","observation_id":"42dde635-2264-4dd8-97c9-376b43c91bf8","resolution":{"observed_at":"2026-08-01T18:28:48.531743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:48.683512Z","title":"Econometrica , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:48.683512Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:367725fca672d9cde65ebe85be626f9bcc37f07e5b4213eab839dfcecb631617","observation_id":"a3565a2f-f6fe-4112-874a-220bc018fb9e","resolution":{"observed_at":"2026-08-01T18:28:48.683512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:48.830759Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:48.830759Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:1d3be1c98fd7b73c58c03409f4c1514480a36a358b8a339fc249ffbc839f7099","observation_id":"7e73fd76-40ea-4405-b161-f69eb7c47320","resolution":{"observed_at":"2026-08-01T18:28:48.830759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:48.940718Z","title":"Proceedings of the 33rd International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:48.940718Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:f66d0bbbdcc843bc27c1edd30597e1297450bd14237260606496bb8ee5418725","observation_id":"db529397-fe0a-45a3-ba28-ac081b86c4e3","resolution":{"observed_at":"2026-08-01T18:28:48.940718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T18:28:49.085333Z","title":"arXiv preprint arXiv:1707.06347 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.085333Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:4a761e08cbde543c037b0cf3842062e80120c871bdec8ef18db12532ce59ea8f","observation_id":"93b04f69-7633-46f9-841d-fb67d3c2808c","resolution":{"observed_at":"2026-08-01T18:28:49.085333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:49.159678Z","title":"arXiv preprint arXiv:2602.03003 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.159678Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:de5c7b44a430e97b22dd84b9b69ad993df14267ab5e0792a81733cf3fb1bbd7c","observation_id":"97880510-b62e-4fe2-9903-e4fb6ffce648","resolution":{"observed_at":"2026-08-01T18:28:49.159678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:49.216440Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.216440Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:41c2e0e598ca51e73032fa78f64cbec71f3913341f6c8f72e234ff9e551fb64d","observation_id":"b7115f89-6916-43cb-9137-41a51e329a89","resolution":{"observed_at":"2026-08-01T18:28:49.216440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:49.324629Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.324629Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:cd06e29514afc5d2bb9a67f7b8d1d7e1dad0aca60e69e0a6e2343ec3ebf85347","observation_id":"627254ae-d071-4446-a1e8-4d65ba8086aa","resolution":{"observed_at":"2026-08-01T18:28:49.324629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:49.423970Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.423970Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:8cc94a841cfe8b776781a7d890ee8f066fe7f7d0154258e1058f72cd34c2a8d9","observation_id":"d992a7ce-aab8-4297-80be-ef07ad5eba2f","resolution":{"observed_at":"2026-08-01T18:28:49.423970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:49.524738Z","title":"SIAM Journal on Computing , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.524738Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:b4d296b781f0c601eca590aede26ec446548c87d3dd88c5cfca92912798ea55e","observation_id":"ee6eaf42-f7c5-48f2-877c-5d48d1ab5690","resolution":{"observed_at":"2026-08-01T18:28:49.524738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:49.618943Z","title":"Rank analysis of incomplete block designs:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.618943Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:5cc8bcf363845b2c935bdd22f950587af78c16745290b3fcb28854243fd36128","observation_id":"208bb23a-ad66-4939-8cb2-94a5d2295b33","resolution":{"observed_at":"2026-08-01T18:28:49.618943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:49.678625Z","title":"Discrete dynamic choice: An extension of the choice models of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.678625Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:5420799dd7a0f762df9cf12c34b5867abc5b5e0373ade7cc141d2068f1a0fe40","observation_id":"081e96f5-df0a-4dff-b752-8222426b47c6","resolution":{"observed_at":"2026-08-01T18:28:49.678625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:49.757285Z","title":"Econometrica , volume=","venue":null,"work_id":null,"year":1958},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.757285Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:219d78404797332c6b27e95e45c035413f6c83cc46b61cecc25ab67e83b63640","observation_id":"bcd44c34-2e4a-471d-a4c8-0ae5534124e7","resolution":{"observed_at":"2026-08-01T18:28:49.757285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:49.900005Z","title":"Maximum entropy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:49.900005Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:f9338d3c127d55100da2d06e30617c45e670588ef5120215badf0b04f4390f75","observation_id":"3e45ed55-8e0d-4b5b-a0a5-5187058530a5","resolution":{"observed_at":"2026-08-01T18:28:49.900005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:50.022723Z","title":"Econometrica , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.022723Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:eb27346a0da5f6c6279cac076177d6f5086d30ec816b053ab5ae102092eff8f8","observation_id":"92d888bf-a657-4d48-b3e2-4e036e22dd9f","resolution":{"observed_at":"2026-08-01T18:28:50.022723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:50.141675Z","title":"Econometrica , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.141675Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:94cfa637664faf66630853c000f349eccb9f7863aaceec182b1a9fc5a5a84837","observation_id":"f4d38ad2-1c1d-4b8f-aac2-57ffca21afb0","resolution":{"observed_at":"2026-08-01T18:28:50.141675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:50.249802Z","title":"A theory of regularized","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.249802Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:c8f69323eb17b19962f2ca84a3811e0d4ad3330350c2c43a7432e7cd170ddf9b","observation_id":"cd96e5c3-02e8-4923-a221-b8e01cede5ce","resolution":{"observed_at":"2026-08-01T18:28:50.249802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:50.397118Z","title":"Experimental Economics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.397118Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:8d1d657a95b55daf65b453eca2dde3e38e4a54c8560212f25b01c64d7d030b26","observation_id":"71c6c130-2e91-4b4f-aada-504bc87d1a4f","resolution":{"observed_at":"2026-08-01T18:28:50.397118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:50.508190Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.508190Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:d3ffc23acd2b61821280fad257f769ebe7bae89cd998a28adb6b3f1242fdd208","observation_id":"a0aae1cb-3657-443f-91cd-2e13b8e0e1a0","resolution":{"observed_at":"2026-08-01T18:28:50.508190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:50.610113Z","title":"American Economic Review , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.610113Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:c0c20786d8b636be11bed9f97d56a4d44291066d9918e0c3c16cb18cb4078080","observation_id":"631ca61a-b7e3-45b4-bd9c-9406d0ea2266","resolution":{"observed_at":"2026-08-01T18:28:50.610113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:50.707769Z","title":"Review of Economic Studies , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.707769Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:87f26d1121c464b6faed776e37a35959dacde958d911a1b752c123abd24bda27","observation_id":"559df4c0-17da-459a-b235-16850a459402","resolution":{"observed_at":"2026-08-01T18:28:50.707769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:50.798340Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.798340Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:ccf4956ce4261ec42d875f52a9b93130f07f7edce25c2022e21e74217917ebe8","observation_id":"d4c7c88e-cf07-4662-8e0a-d20ff17aa812","resolution":{"observed_at":"2026-08-01T18:28:50.798340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00909","last_updated":"2018-05-20T20:03:59Z","snapshot_observed_at":"2026-08-08T20:31:18.897748Z","submitted_at":"2018-05-02T17:11:20Z","title":"Reinforcement Learning and Control as Probabilistic Inference: Tutorial and Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00909","snapshot_observed_at":"2026-08-01T18:28:50.880539Z","title":"arXiv preprint arXiv:1805.00909 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.880539Z"},"links":{"cited_paper":"/paper/1805.00909","citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:9960464ea655372cddcf789675bd2cb059c17fe03ab26dc2114fac12ebc5fe81","observation_id":"d9193c35-e87f-4425-a764-6ee235af086e","resolution":{"observed_at":"2026-08-01T18:28:50.880539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:50.993316Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:50.993316Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:194dd4694ad8223ca4191e1c3e674b4b9b4997437f055dc3c2faabbf4ac11281","observation_id":"6333b233-4ba9-420b-8ad7-6bce3420d6b7","resolution":{"observed_at":"2026-08-01T18:28:50.993316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.075752Z","title":"Jackpot!","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.075752Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:77701047997f58987b58d28f1739d9b4a301a628c69ec4451aae3b2b5c890d3c","observation_id":"02d9aded-1401-4d7f-a58f-b35d1a73f9e3","resolution":{"observed_at":"2026-08-01T18:28:51.075752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.135935Z","title":"Frontiers in Econometrics , pages=","venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.135935Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:37df8e3248ca5e3544db282b5f78b07f4a378f3aecbbb29c9b8944b432bd1ad2","observation_id":"14c44b66-6469-4fb1-844c-0143671e5fa8","resolution":{"observed_at":"2026-08-01T18:28:51.135935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.253208Z","title":"Games and Economic Behavior , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.253208Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:1dbc91f099772718663c72f40c65f9c85dbb7d90622a6caa37ee231fd20d4f73","observation_id":"817f91e7-a59c-4ba8-a090-2c2c576a96cd","resolution":{"observed_at":"2026-08-01T18:28:51.253208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.346080Z","title":"Essentially Sharp Estimates on the Entropy Regularization Error in Discrete Discounted","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.346080Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:ec1c1a9de8c48f596fb6f54fd1e6f1cfc09bc416577fb34d7c24a5291739204a","observation_id":"a4f702c8-35a3-4aa6-b8d1-a1895dc4c41b","resolution":{"observed_at":"2026-08-01T18:28:51.346080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.380404Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.380404Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:6965457ce4c8d6e731764a15ac949dceac8508cece284e235f7e316a58a5c753","observation_id":"4426944a-3fd5-4d57-b65f-907a9c30481e","resolution":{"observed_at":"2026-08-01T18:28:51.380404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.447473Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.447473Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:e670a627734251d4b860d3e6aa92da938b8a600960aa27f4e6cebbd182aca592","observation_id":"f74fae7d-9020-407d-b14e-dbd833ab7f52","resolution":{"observed_at":"2026-08-01T18:28:51.447473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07798","last_updated":"2017-05-22T15:06:25Z","snapshot_observed_at":"2026-08-14T20:59:03.934741Z","submitted_at":"2017-05-22T15:06:25Z","title":"A unified view of entropy-regularized Markov decision processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07798","snapshot_observed_at":"2026-08-01T18:28:51.501243Z","title":"A unified view of entropy-regularized","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.501243Z"},"links":{"cited_paper":"/paper/1705.07798","citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:06979433f42f859f229a94782c69ca4682a0d209f786c0c8e91a5e6fef64e743","observation_id":"75d2bf01-84fc-4483-818d-af0451e354d6","resolution":{"observed_at":"2026-08-01T18:28:51.501243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.538849Z","title":"Proceedings of the Royal Society A , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.538849Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:3e1a0d5f71512183c83b84a48b7b6b12df51e1e4b401c086742645429de71211","observation_id":"9b69b1cd-ca3f-4f96-8035-44167e97c15d","resolution":{"observed_at":"2026-08-01T18:28:51.538849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.616718Z","title":"AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.616718Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:30c6ca47ca9d86836913b60aea9264b227506c403ecb105b0c5fa21658c81692","observation_id":"91aa61e9-1792-45a0-8125-a00412ee0605","resolution":{"observed_at":"2026-08-01T18:28:51.616718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.683388Z","title":"Consistent aggregation of objectives with diverse time preferences requires non-","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.683388Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:79bd3a8c0400049296c6088381656466f223239b1d7cf713df1aae460f00c402","observation_id":"25d6f79f-14d8-496e-ba3d-8f463073ebb9","resolution":{"observed_at":"2026-08-01T18:28:51.683388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.751425Z","title":"Optimal replacement of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.751425Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:56da652945e1cd68c8e58642cffb02f85826b92b66b35c43ea177533823e0d85","observation_id":"1ca142b0-f32b-4d37-a367-f7899f17a796","resolution":{"observed_at":"2026-08-01T18:28:51.751425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.826961Z","title":"IEEE Transactions on Information Theory , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.826961Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:307cfa17c4cb5b48d4039e9fed82639d3995ad58e26a85533eac8858ac6eb32c","observation_id":"7ab444e6-5117-4ed6-95b0-c42ecd9d8cd4","resolution":{"observed_at":"2026-08-01T18:28:51.826961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.895674Z","title":"Quarterly Journal of Economics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.895674Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:b7453ae3d92297571029b8e7e29277ff4490ac931b46b0e949f13f0579201508","observation_id":"eb1a2b11-9443-4d08-9b65-18d5afcdbf81","resolution":{"observed_at":"2026-08-01T18:28:51.895674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:51.959050Z","title":"Journal of Monetary Economics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:51.959050Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:5381b083dce3d08aecbfc91f7305fb738a238659430362c1124ae017e200e6b4","observation_id":"c4786e39-bd02-4331-8196-8e3a4feade1b","resolution":{"observed_at":"2026-08-01T18:28:51.959050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.006475Z","title":"Linearly-solvable","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.006475Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:84f70c70b6f58ef1a249b7e870ac78a205774906c0ebb26e48aeb84fb86e69dc","observation_id":"b27fb68c-f687-4122-a284-a50095087077","resolution":{"observed_at":"2026-08-01T18:28:52.006475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.21172","last_updated":"2026-05-07T20:33:28Z","snapshot_observed_at":"2026-08-13T23:32:20.094926Z","submitted_at":"2025-09-25T13:53:43Z","title":"Inverse Reinforcement Learning with Just Classification and a Few Regressions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.21172","snapshot_observed_at":"2026-08-01T18:28:52.061963Z","title":"arXiv preprint arXiv:2509.21172 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.061963Z"},"links":{"cited_paper":"/paper/2509.21172","citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:b77c2f918c11d9a1112340a2178b92645f333a584aaffdd261d947fc41dcc303","observation_id":"681ed67e-9371-44e3-8adc-e0cfc612b3fc","resolution":{"observed_at":"2026-08-01T18:28:52.061963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.136344Z","title":"The relationship between","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.136344Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:1bef27595dd1f65b1c341c74e615df02ad03917d360f22d34c7f00352f76fab8","observation_id":"7a3c39a1-e549-4f09-a086-c603e01944f0","resolution":{"observed_at":"2026-08-01T18:28:52.136344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.188702Z","title":"Bell System Technical Journal , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.188702Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:1f610f3469334593ce0290049592257f1a876e905058a1b041a451b8db339252","observation_id":"69b3c5ce-d9b7-4527-8fce-ad03491a4e25","resolution":{"observed_at":"2026-08-01T18:28:52.188702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.269282Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.269282Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:3f4f48795d015a0d94444c8392ff170562a5f0aa9fea8cff1fe43c7184dbe4fb","observation_id":"48696af6-1907-4877-b6f0-868df506489c","resolution":{"observed_at":"2026-08-01T18:28:52.269282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.351494Z","title":"On the Expressivity of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.351494Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:b7768c1973f4cac4bcecda4eae10b6b47f08d0050cad0e963cc19c77118d4a0c","observation_id":"e01cd1a1-93d8-4ff6-a547-d22db62f782f","resolution":{"observed_at":"2026-08-01T18:28:52.351494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.398943Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.398943Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:109275acc6b35281376e32725db9776f81347701f27a51153b5f035c93c2d21d","observation_id":"aeea18e4-7cb3-41b5-a83d-e113918926f3","resolution":{"observed_at":"2026-08-01T18:28:52.398943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.467669Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.467669Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:2c31faa7d188908dce028803bc31310cea8745f9d0f508ef99cc1eaaedd9f6de","observation_id":"5bc22723-1c28-4417-8e85-4e7af1b0d84b","resolution":{"observed_at":"2026-08-01T18:28:52.467669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.515973Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.515973Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:48cb7a6bc6fc597540b4e8974365a83ab5c8e86bee7fc3c9a9ed3d544841c7aa","observation_id":"483eae9d-cba7-40d8-90d8-fad05dad8288","resolution":{"observed_at":"2026-08-01T18:28:52.515973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.554653Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.554653Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:6d0bc67081c74d9857afa3f0a162a9a2a0972c6a1fa532b2702b73f2df4c7fc2","observation_id":"e32692cb-40c1-4fc0-be8d-07cd39fceed4","resolution":{"observed_at":"2026-08-01T18:28:52.554653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.601520Z","title":"IEEE International Conference on Robotics and Automation , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.601520Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:9a6b3ec4fc4bdae4d9aee387e3f82d9b82d3589b74daacb8708e358a7816b1f8","observation_id":"25470362-2d0c-4561-a02d-7bf6ac5cd888","resolution":{"observed_at":"2026-08-01T18:28:52.601520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.664609Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.664609Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:7cc03a45999ccec92169472c6744328ab02f98a81d050c930c591fdab9fc4dcc","observation_id":"74b2290f-259f-4aac-9c43-c271a90d10d6","resolution":{"observed_at":"2026-08-01T18:28:52.664609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.704395Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.704395Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:b6f5bf4e6174056f0430e666e101b639e6664a5711b729de54c6af63e058a3f7","observation_id":"3398a470-71ef-4f94-a73c-3caaabe4277b","resolution":{"observed_at":"2026-08-01T18:28:52.704395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.775769Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.775769Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:e4e94ae0f4bf9dbf273da432fa792b8d053c1333100a2618133708558bdb92fb","observation_id":"7e4ea90a-4138-42f3-9165-4ac485b3be24","resolution":{"observed_at":"2026-08-01T18:28:52.775769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.834530Z","title":"arXiv preprint arXiv:2506.07085 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.834530Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:c8b8639dde8f9d9257187b3ca2d83555c596d11432c42768f128d517d6225653","observation_id":"111ad93e-8e70-44be-a9d6-f99508c46f72","resolution":{"observed_at":"2026-08-01T18:28:52.834530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.918184Z","title":"American Economic Review , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.918184Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:33fdde7be5e2fff00af436f04b170d8b4fda5143e5d07be8837c83abc73f2d6c","observation_id":"36d928cc-ce24-4378-8186-c9618d5e45a6","resolution":{"observed_at":"2026-08-01T18:28:52.918184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:52.996004Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:52.996004Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:7f4336a4c20ae0b5bff5e4c32ce9cb2f4f636f5ecea65953f336295553b0acaf","observation_id":"00d4160b-b908-49ec-aaf0-a48579ec4fda","resolution":{"observed_at":"2026-08-01T18:28:52.996004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:53.071066Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:53.071066Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:0a6b417bc2a91a3be48ec6f7179e98deddb15b53736becae665f8c4c7c8c2d02","observation_id":"daec7778-e0ce-4863-9069-66ca7b6093b8","resolution":{"observed_at":"2026-08-01T18:28:53.071066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:53.169297Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:53.169297Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:dcaf8fe61d4b1ba1223292831ea96df3075bc77d774cea2d721d35a3942d531b","observation_id":"8990c1d5-40b7-453a-b095-1d5d2e7ded02","resolution":{"observed_at":"2026-08-01T18:28:53.169297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:53.284948Z","title":"Path Consistency Learning in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:53.284948Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:d2f471ced3ec4e4e81ab5ec4f20500c781a9e2db046580597104ae1fb38a683b","observation_id":"543c241b-7642-41fe-be71-6b6aeacf0358","resolution":{"observed_at":"2026-08-01T18:28:53.284948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:53.388338Z","title":"Proceedings of EMNLP , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:53.388338Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:3a7cd74abb61653824ff50b9ef9c880c9aee7c0d9e7e1ebb04f1dc221e7981ff","observation_id":"43948743-3d41-40f0-b000-08f3bee4f3d3","resolution":{"observed_at":"2026-08-01T18:28:53.388338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-01T18:28:53.561499Z","title":"arXiv preprint arXiv:1609.08144 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:53.561499Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:4270f2737f8c51fc84249c0de28e6bbe12ace5d184edc5263481d1e33823cec1","observation_id":"30323d48-e6c2-49c0-bcb6-2c3540c07811","resolution":{"observed_at":"2026-08-01T18:28:53.561499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:53.688197Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:53.688197Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:6bdbcf86041e8347c2c78c45164b25931e5bd9f6b6dfa67377370cb1b3a0eba6","observation_id":"eb44c635-4fb0-4382-8ffc-142f14509cd8","resolution":{"observed_at":"2026-08-01T18:28:53.688197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:53.801855Z","title":"2018 , publisher=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:53.801855Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:7b7239549ff68db7177c8fa171c5ae52831e886ab87e96b79fd074ab355bf3ce","observation_id":"f6f63ce7-58d2-4fda-bdd9-d8a31bb36f76","resolution":{"observed_at":"2026-08-01T18:28:53.801855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:53.925903Z","title":"Contributions to Probability and Statistics: Essays in Honor of Harold Hotelling , editor=","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:53.925903Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:1ca12aef504e66c5170844bb85471fc3cade3ee62f9111a22639020ff759c5f7","observation_id":"8c268920-9e4a-4508-9b7c-dc811199ba7f","resolution":{"observed_at":"2026-08-01T18:28:53.925903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:54.094516Z","title":"Journal of Mathematical Psychology , volume=","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:54.094516Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:53ff3193ec532fb6aaf7a19443bbac7b0c53612a92e46e4679f0520f5ea5859c","observation_id":"1a65f7ff-759d-4598-adb2-aafc0c02dfb2","resolution":{"observed_at":"2026-08-01T18:28:54.094516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:54.208331Z","title":"and Jaakkola, Tommi and Jordan, Michael I","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:54.208331Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:f0f4c9efce77038867843448648d7a31e6b0eb407844f4c548cd573e7255723a","observation_id":"3b043083-c878-4b75-9bec-edbaff42a4d4","resolution":{"observed_at":"2026-08-01T18:28:54.208331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:54.344689Z","title":"1947 , edition=","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:54.344689Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:3207aabec37d3db1bc7c237131dbfbf20b70f762b6ebd285a291b23d779d8208","observation_id":"89ed9888-2568-4683-b102-23d48ec24e8b","resolution":{"observed_at":"2026-08-01T18:28:54.344689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:54.468132Z","title":"Econometrica , volume=","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:54.468132Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:21e10ae225575f9cf6c59140527d4831c25593de5e9e17d01cc1b308a0d3e95d","observation_id":"b5e097d8-810a-48fd-b518-af55c36fc57b","resolution":{"observed_at":"2026-08-01T18:28:54.468132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:54.576176Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:54.576176Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:cd9b6556afe731d83c8d3bc2cf7ade55bf9a6fea767fded9f3b30e0665596a95","observation_id":"884ac54e-57ab-4ffb-919d-f60e78c05068","resolution":{"observed_at":"2026-08-01T18:28:54.576176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:54.698846Z","title":"Spatial Interaction Theory and Planning Models , pages=","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:54.698846Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:f0bbd0b241e0912ed075b0125def9dc9cc61646e58bb5b7a40b5062304390020","observation_id":"d6856093-f250-42dd-9a56-b7fd93ec0628","resolution":{"observed_at":"2026-08-01T18:28:54.698846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:54.885003Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:54.885003Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:99e62a2060535da83f8f742bc8eaef90e594745f415c84026c1bf96bb1baccfe","observation_id":"9a32bfbb-d0f8-476c-acd7-dd2a1f12a71a","resolution":{"observed_at":"2026-08-01T18:28:54.885003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:55.001386Z","title":"American Economic Review , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:55.001386Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:5ad59b91b40ec2d81a8415d0d7a5bd5de4dcdb843db71e008aa647ef91fe5eb9","observation_id":"c976fe31-f99e-4013-848f-b81ce401038a","resolution":{"observed_at":"2026-08-01T18:28:55.001386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:55.102965Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:55.102965Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:42710b2418ce4840766295af026b476263aaec03922e42bbe4494bcc8256b170","observation_id":"eac3a7b8-8af8-4fa6-a831-38b280251d2b","resolution":{"observed_at":"2026-08-01T18:28:55.102965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:55.223542Z","title":"and Zachary, Stan , title =","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:55.223542Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:5a92624034ce27776af7e42c40aef066da7a4e42caea737382fbf66bd8fd7ad5","observation_id":"af691483-0960-4da5-8031-d843474f23e5","resolution":{"observed_at":"2026-08-01T18:28:55.223542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:55.339420Z","title":"Structural Analysis of Discrete Data with Econometric Applications , editor =","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:55.339420Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:4a60737eae8455c9f61bd4c3acb09c8aefe2cac056639c053df20c8c75545e89","observation_id":"da30ee14-6136-44bc-a853-191e7a69e043","resolution":{"observed_at":"2026-08-01T18:28:55.339420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:28:55.455816Z","title":"and Sarver, Todd , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-01T18:28:55.455816Z"},"links":{"citing_paper":"/paper/2607.17316"},"observation_digest":"sha256:b2b7f114276f18134be6d3fdf5d67b5bd9a56b6a405f148953da587040d14e9d","observation_id":"0202116a-9486-4aba-b8c4-0cf4a0626433","resolution":{"observed_at":"2026-08-01T18:28:55.455816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17316","last_updated":"2026-07-19T16:01:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T22:12:19.798089Z","submitted_at":"2026-07-19T16:01:04Z","title":"Rationalizing Boltzmann Rationality: An Axiomatic Characterization of Entropy-Regularized Policies"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":79,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 0 inbound Pith citation observations for arXiv:2607.17316."}