{"as_of":"2026-08-12T09:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:41d37192258c164f9151b4d8af37fa2da8b413619c7f1ebc7a2f6b5f670d3bbc","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:36:13.335046Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07769/citation-record","integrity":"/paper/2507.07769/integrity","json":"/paper/2507.07769/citation-record.json","paper":"/paper/2507.07769"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:11.862425Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:11.862425Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:0759eca414073aca0917e2203f6656383bd836be492c6c44d0fb035dada09275","observation_id":"e2880171-3ab1-4877-8316-94f1118f9b33","resolution":{"observed_at":"2026-08-06T18:36:11.862425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:16.772142Z","title":"Using dimensionality reduction to exploit constraints in reinforcement learning","venue":null,"work_id":"96006c50-52c2-41a9-ab51-6ea380ed9f34","year":2010},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:11.899100Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:0b537fb4c3da24d70ba55a7d29b966244b8c318d5fbd65be5eaca5c6e7112452","observation_id":"09acc911-2842-4439-8733-f42a542709fc","resolution":{"observed_at":"2026-08-06T18:36:16.834354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:16.622524Z","title":"Learning action representations for reinforcement learning","venue":null,"work_id":"df4bea25-1b3e-40ff-b3cd-5a5319e8474e","year":2019},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:11.961588Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:e07583531f3c75d1e15cf593a29834572cb22c486f9803bb602b6a8073fc9a26","observation_id":"332e8486-5d8f-442a-b27d-cd1fe1196164","resolution":{"observed_at":"2026-08-06T18:36:16.695821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:16.411552Z","title":"B., Lawrie, L","venue":null,"work_id":"a7165afc-d955-4c25-b90d-cf8c45fb1414","year":2001},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.022934Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:fcc504aa4f2c2b2da87e4e1b31ff79ca02221851469ec5883b2538e5b2403f24","observation_id":"8cfd6854-8973-479b-a1ca-cb726c07060d","resolution":{"observed_at":"2026-08-06T18:36:16.496432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:16.254295Z","title":"and Chen, Q","venue":null,"work_id":"becbf745-7cc9-42a0-af0d-9bfe6238c322","year":2021},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.065494Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:870fcbb727a92ddb447c9eab9f90ad0d3b1618a3ddaf1099fc9fbee5b139aa5c","observation_id":"24761ec9-8dfb-4c9e-8e72-b5ab203188cd","resolution":{"observed_at":"2026-08-06T18:36:16.311689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:16.024658Z","title":"Us department of energy commercial reference building models of the national building stock","venue":null,"work_id":"8787e4c7-30f6-42ca-8e28-c893bda1b225","year":2011},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.102221Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:9be913aa2cb8d3477101babbe9c1de5705d1f1066da12608d06528b146569aa6","observation_id":"e61b0259-8353-4980-8074-05b2ce34cb4f","resolution":{"observed_at":"2026-08-06T18:36:16.105339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:15.854520Z","title":"Cross temporal-spatial transferability investigation of deep reinforcement learning control strategy in the building hvac system level","venue":null,"work_id":"152d05b1-57b8-4afe-8725-4214d42ed238","year":2023},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.167384Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:044608d3e7cd495d7e0d15626bf83e972936d0bca3abcba1293f38b94bab9eb8","observation_id":"4d2210d7-dc5f-43a7-8ff8-2c767f322682","resolution":{"observed_at":"2026-08-06T18:36:15.950970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03756","last_updated":"2025-01-31T14:29:42Z","snapshot_observed_at":"2026-07-06T19:28:01.764884Z","submitted_at":"2024-10-02T06:30:07Z","title":"The Smart Buildings Control Suite: A Diverse Open Source Benchmark to Evaluate and Scale HVAC Control Policies for Sustainability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03756","snapshot_observed_at":"2026-08-06T18:36:12.260140Z","title":"and Sipple, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.260140Z"},"links":{"cited_paper":"/paper/2410.03756","citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:5441ff6b9728ec33cb3caafe40553c7f5315523ffa9cb6ecc09063262b0e3892","observation_id":"3796c1f3-1f3f-4f9c-8977-c1fe4a1202cb","resolution":{"observed_at":"2026-08-06T18:36:12.260140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:15.693180Z","title":null,"venue":null,"work_id":"8fc0f574-c4e0-41a8-bb13-efaec7559127","year":2023},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.337763Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:04de9b08f5fd85a908273f3733bf5a680f8d6aedb592ffe91a2a907b120367c8","observation_id":"7e338b9b-3b6a-4612-9ba7-8a4b83a84c62","resolution":{"observed_at":"2026-08-06T18:36:15.777801Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:15.533381Z","title":"Efficient discovery of pareto front for multi-objective reinforcement learning","venue":null,"work_id":"2af694bf-df0a-4dbc-ad59-acfeb2d84b0b","year":2025},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.402969Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:73650b9859da8d706b01c3b53c602c09140d791ffd497700765acd5faf3167c1","observation_id":"fbe5da35-16c8-485c-a3d6-5d56ab7e2f2e","resolution":{"observed_at":"2026-08-06T18:36:15.598425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:15.385289Z","title":"Predictive control for energy efficient buildings with thermal storage: Modeling, stimulation, and experiments","venue":null,"work_id":"570f0115-9a19-430a-94a9-734db329abd8","year":2012},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.434153Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:0cad9f1233d16749b38f151e300563dcf0474f799d4ac03e0fe895facda8131a","observation_id":"71213e5d-931a-4b88-be4b-c37306ddefc2","resolution":{"observed_at":"2026-08-06T18:36:15.451131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:15.206467Z","title":"The citylearn challenge 2022: Overview, results, and lessons learned","venue":null,"work_id":"d7d591dd-f754-46f3-af65-0a67c695a98b","year":2022},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.533104Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:091e7d9f022dc2443e938b0a0734037240cd6941d91c152f28f4dfd39f3affec","observation_id":"574cc0d7-b1c0-4d5d-8c32-733838c4d622","resolution":{"observed_at":"2026-08-06T18:36:15.289449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:15.056139Z","title":"Rewarded soups: towards pareto-optimal alignment by interpolating weights fine-tuned on diverse rewards","venue":null,"work_id":"7fc755ef-7c24-43ec-84dd-6511f07077a1","year":2023},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.589535Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:703a7b45dc607170e004fece7f7e6ab50a3dd9efaad5991486366a0ef17d6a00","observation_id":"02cb8dd7-6355-4702-b030-903394be36f6","resolution":{"observed_at":"2026-08-06T18:36:15.121549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:12.637945Z","title":"Multi-task reinforcement learning with context-based representations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.637945Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:5002d3b284e212f8424f8db6374aff257f0efd6a34973aa98d996246eae0c9d7","observation_id":"5d9f325c-bfc5-4e58-9f8b-819b7e8eb0b6","resolution":{"observed_at":"2026-08-06T18:36:12.637945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:14.846821Z","title":"M., Quan, J., Kirkpatrick, J., Hadsell, R., Heess, N., and Pascanu, R","venue":null,"work_id":"afa7785a-b0a6-44f4-b859-fd620acc2100","year":2017},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.717345Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:ae04d3d870e12dcbb7fa1208b983b5ef64170d0125dd6967af85faafa4519ad4","observation_id":"d0cbf9f2-c5e5-4f35-a785-279dc2b7725c","resolution":{"observed_at":"2026-08-06T18:36:14.908393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:14.678287Z","title":"On generalization across environments in multi-objective reinforcement learning","venue":null,"work_id":"35c22cd1-4c49-4208-822a-4b1942a9046d","year":2025},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.776443Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:4cc012d4befd5bf2e9248c70614f8ef001f695042aed792ee804e52f6e814ed9","observation_id":"8947f91b-404a-46fe-8d93-f5553c467199","resolution":{"observed_at":"2026-08-06T18:36:14.745639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:14.534122Z","title":"A multi-objective home energy management system based on internet of things and optimization algorithms","venue":null,"work_id":"798630dc-27a6-4be3-b817-15657e090e7d","year":2021},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.827164Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:b53711be23fbda56e3bfcd7c9720976de35c85ed5e035d810fb50e7a399e5beb","observation_id":"195cf371-0783-4259-a98b-09f921ed8b65","resolution":{"observed_at":"2026-08-06T18:36:14.597813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:14.334072Z","title":"S., and Pang, X","venue":null,"work_id":"f6a7b36c-b3f9-4944-9e87-d6c15c76970d","year":2014},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:12.943812Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:69d2f254869d8f187ee06e10a9727f51bf55091aa282c2b9cb66d4f546cb8014","observation_id":"8080af4b-af12-455c-86b2-e5e888d62eba","resolution":{"observed_at":"2026-08-06T18:36:14.421172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:14.162675Z","title":"One for many: Transfer learning for building hvac control","venue":null,"work_id":"fab8a64a-2031-44d5-a23a-bc0b4aff9cf2","year":2020},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:13.017102Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:1fbba417e9aacb562b31a7a32e9356a14da2d602923a4c7e64c668b4d8daecce","observation_id":"b849946b-8d6a-46b5-839a-caa312e42903","resolution":{"observed_at":"2026-08-06T18:36:14.221959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:14.020747Z","title":"A generalized algorithm for multi-objective reinforcement learning and policy adaptation","venue":null,"work_id":"70d7e7a3-3a89-4983-a970-41e28cfe6f2a","year":2019},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:13.098757Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:15fd5d8569d8abc7ee6ca376ea5287da5007848abc40299e9329a4f497251990","observation_id":"187809e8-0078-40a4-a280-7ab5e4319edd","resolution":{"observed_at":"2026-08-06T18:36:14.071847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:13.841334Z","title":"A review of deep reinforcement learning for smart building energy management","venue":null,"work_id":"cabe6f93-3e2c-469f-8f8d-181718468305","year":2021},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:13.187391Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:ee2dbd6ed227b720f200236492e56194889a56c6c23510131aeb904b0daabee5","observation_id":"9cf3ac7b-4688-4458-89ca-9249904bca01","resolution":{"observed_at":"2026-08-06T18:36:13.897647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:13.686380Z","title":"Bear: Physics-principled building environment for control and reinforcement learning","venue":null,"work_id":"a8c54087-62e6-4cc7-b521-16fd5c4287fe","year":2023},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:13.266654Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:e39f3dab66a9f84ce6392df892fdf1cf39983b11ee0d2427648d30fece633051","observation_id":"4c05aa4e-ee06-4cad-965e-52d68b3be1b3","resolution":{"observed_at":"2026-08-06T18:36:13.749228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:13.521798Z","title":"J., Graf, P., and Jiang, H","venue":null,"work_id":"01f33fd5-dd27-4094-a221-38b2bbdf5a3e","year":2020},"citing_paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T18:36:13.335046Z"},"links":{"citing_paper":"/paper/2507.07769"},"observation_digest":"sha256:8a90f158775677f5283a824c658fed39c222148d01ad1bdc6ffe10c2fd5dfc33","observation_id":"dccbc056-a223-418e-a555-101906c4ca90","resolution":{"observed_at":"2026-08-06T18:36:13.574074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07769","last_updated":"2025-07-25T22:18:43Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T04:12:53.050342Z","submitted_at":"2025-07-10T13:54:38Z","title":"BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2507.07769."}