{"as_of":"2026-08-07T08:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8ef90d2cf79f2c68914afb9f67598d90688739635f89e84623c7874fc4dc5a68","coverage":[{"denominator":99,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":99,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:57:07.014317Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T00:26:54.019256Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"cited_work":{"arxiv_id":"2507.17257","doi":"10.48550/arxiv.2507.17257","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17257","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"ArXiv.org","work_id":"76b7d015-09aa-4e60-a5de-216763dce98f","year":2025},"citing_paper":{"arxiv_id":"2605.30169","last_updated":"2026-07-02T23:58:01Z","snapshot_observed_at":"2026-08-01T18:48:30.510137Z","submitted_at":"2026-05-28T16:20:19Z","title":"Dissociative Identity: Language Model Agents Lack Grounding for Reputation Mechanisms","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-06-29T00:26:54.019256Z"},"links":{"cited_paper":"/paper/2507.17257","citing_paper":"/paper/2605.30169"},"observation_digest":"sha256:9fe8f7a6b3ebb0a08368f932d5d2c064b25ad33bf643a77cfcbcd1f9a94d515f","observation_id":"e75ce735-be26-4773-b040-641474872e2b","resolution":{"observed_at":"2026-06-29T00:32:53.095668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.17257/citation-record","integrity":"/paper/2507.17257/integrity","json":"/paper/2507.17257/citation-record.json","paper":"/paper/2507.17257"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.01502","last_updated":"2024-07-01T17:48:14Z","snapshot_observed_at":"2026-08-06T22:15:08.500389Z","submitted_at":"2024-07-01T17:48:14Z","title":"AI Agents That Matter","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01502","snapshot_observed_at":"2026-08-06T14:57:06.463141Z","title":"Siegel, Nitya Nadgir, and Arvind Narayanan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.463141Z"},"links":{"cited_paper":"/paper/2407.01502","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3c3113eedaac2800d03fd0fac3c470f602d70389092c00b24afcab9214494f7e","observation_id":"90bd6375-8c91-4597-a574-77070359b937","resolution":{"observed_at":"2026-08-06T14:57:06.463141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.475113Z","title":"Introducing Devin, the first AI software engineer, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.475113Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:1393c89f9228c6b719219f1b230b704e6924a937586fb87d2dba0ec073ba3f16","observation_id":"945f1a7b-6fd7-4e19-ac75-042c8c279e6e","resolution":{"observed_at":"2026-08-06T14:57:06.475113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.480272Z","title":"GAIA: a benchmark for General AI Assistants, November 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.480272Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:40a962a80296e3197b461135cc89b1d7be38f6a290316b4941ca3e8aeb634c52","observation_id":"69472970-6998-4831-9543-b426b146d6de","resolution":{"observed_at":"2026-08-06T14:57:06.480272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04682","last_updated":"2025-04-16T22:20:21Z","snapshot_observed_at":"2026-08-04T11:48:51.949350Z","submitted_at":"2024-08-08T05:45:42Z","title":"ToolSandbox: A Stateful, Conversational, Interactive Evaluation Benchmark for LLM Tool Use Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04682","snapshot_observed_at":"2026-08-06T14:57:06.486170Z","title":"ToolSandbox: A Stateful, Conversational, Interactive Evaluation Benchmark for LLM Tool Use Capabilities, August 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.486170Z"},"links":{"cited_paper":"/paper/2408.04682","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:551d00bae008559e8cb2a957a969ef255ce07e75ab06aa98b3cd48251a7553b3","observation_id":"8985ac9c-af6b-44df-94c6-5f026bf80eae","resolution":{"observed_at":"2026-08-06T14:57:06.486170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08926","last_updated":"2025-04-12T21:26:07Z","snapshot_observed_at":"2026-08-06T12:22:30.341073Z","submitted_at":"2024-08-15T17:23:10Z","title":"Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08926","snapshot_observed_at":"2026-08-06T14:57:06.491612Z","title":"Zhang, Neil Perry, Riya Dulepet, Eliot Jones, Justin W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.491612Z"},"links":{"cited_paper":"/paper/2408.08926","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:5cd3538a2fe1e79a3fffd251f516284c2097026a61c157c68954f3963c549589","observation_id":"a2e33d96-9c84-4793-a4d4-08cedb088a61","resolution":{"observed_at":"2026-08-06T14:57:06.491612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-06T14:57:06.497559Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.497559Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:2568a92c55bce330532e1bd5f264c0ecf134f7cfe854e796b014cc8b13806b42","observation_id":"32ab33e2-503c-4e5c-8737-589af7213ef5","resolution":{"observed_at":"2026-08-06T14:57:06.497559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.502779Z","title":"Jimenez, John Yang, Kevin Liu, and Aleksander Madry","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.502779Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3201c0772550f60884b555e8176f754673509041f783fdbaa206bcbcd6af2786","observation_id":"c5116462-c38d-4f22-9bee-eaecab64161e","resolution":{"observed_at":"2026-08-06T14:57:06.502779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12856","last_updated":"2024-02-25T16:17:43Z","snapshot_observed_at":"2026-07-06T15:57:53.178833Z","submitted_at":"2023-07-24T14:56:30Z","title":"A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12856","snapshot_observed_at":"2026-08-06T14:57:06.508586Z","title":"A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis, February 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.508586Z"},"links":{"cited_paper":"/paper/2307.12856","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:ec2b7a2276317563558e60124486d4c6d59b937cca48216cc7203e2410a48fef","observation_id":"e10fb22f-ea94-4a24-88c8-0d62453d73a5","resolution":{"observed_at":"2026-08-06T14:57:06.508586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.513987Z","title":"MultiOn AI, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.513987Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:da3f7bb45c0cc2accdd1e845ebf2243cca408f461b440974bfd7442d8c82f047","observation_id":"7434111f-2dea-4750-9cbc-7bc751762b1c","resolution":{"observed_at":"2026-08-06T14:57:06.513987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.519681Z","title":"Agents that reduce work and information overload.Communications of the ACM, 37(7):30–40, July 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.519681Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:2e99f92f304ad1127e3e2e1cd93942395d00e92ca4b120d587499a4ec6bd6daf","observation_id":"8b2999e5-6fd0-465a-8655-893edee84222","resolution":{"observed_at":"2026-08-06T14:57:06.519681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.525291Z","title":"Artificial life meets entertainment: lifelike autonomous agents.Communications of the ACM, 38(11):108–114, November 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.525291Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:7ad1dd118638d3820c1ddd5bac504ad6b9be4a03425d6870f84790feb100ed23","observation_id":"a7759664-acff-462f-b635-aac716f94f0a","resolution":{"observed_at":"2026-08-06T14:57:06.525291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.530778Z","title":"Autonomous interface agents","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.530778Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:a3744dfb278ed313b42a5ba3522e216ae895e15c42e9727067399ea5ee3a9f29","observation_id":"db8ed391-0c32-4d5a-82b0-45fed6ecde76","resolution":{"observed_at":"2026-08-06T14:57:06.530778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.535664Z","title":"A roadmap of agent research and development.Autonomous agents and multi-agent systems, 1:7–38, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.535664Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3ab96d163870a92a174390296e54ab0ad984368107085378bca0189c73872bee","observation_id":"a4f0d0d0-972e-4622-9d3f-d5e27980c9d1","resolution":{"observed_at":"2026-08-06T14:57:06.535664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.541028Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.541028Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:431cb07ecbe465b32a18ce6c48396acd39da984cb7bdc5bd1d29c26bbc6d5b20","observation_id":"d0e3df6e-dbf9-44d7-98e4-270a481e4533","resolution":{"observed_at":"2026-08-06T14:57:06.541028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.546230Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.546230Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:6ea4633b7c07af07fcaccad9839b7163e83fe6672be4e39de385d3b3f2437424","observation_id":"83473c7d-0f6a-4595-a04b-0cbccf4774c7","resolution":{"observed_at":"2026-08-06T14:57:06.546230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.551410Z","title":"Russell and Peter Norvig.Artificial Intelligence: A Modern Approach","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.551410Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:462e192fe6be04c326e48e9da11d1fd73d36be5967773d34a74df442cf14ac3d","observation_id":"672f404c-3772-4a1a-abcd-3d86ff36d32b","resolution":{"observed_at":"2026-08-06T14:57:06.551410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.556692Z","title":"Harms from Increasingly Agentic Algorithmic Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.556692Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:261fb261089ef7c752f129ffccd390a6a86997fcb059f4dd8d544591dac3f094","observation_id":"de2bfb9b-e387-4eff-8d0c-2dc7856635f9","resolution":{"observed_at":"2026-08-06T14:57:06.556692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-07-31T19:03:03.494918Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-06T14:57:06.562823Z","title":"White, Doug Burger, and Chi Wang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.562823Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:5d0c36385026f6c5037e71357b130d7f81db59e1cf626b71505a27c59a86c40c","observation_id":"746aebd6-f3a8-416f-a363-6e72ba19984a","resolution":{"observed_at":"2026-08-06T14:57:06.562823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.569557Z","title":"OpenAI Charter, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.569557Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:98b5ab2a57fd08f23c2b979d392e928dbe1241ea40107b97d18ca6787898f5f0","observation_id":"2c1ea291-854c-4179-95d8-01de49566168","resolution":{"observed_at":"2026-08-06T14:57:06.569557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16244","last_updated":"2024-04-28T18:28:33Z","snapshot_observed_at":"2026-08-06T06:48:41.511859Z","submitted_at":"2024-04-24T23:18:46Z","title":"The Ethics of Advanced AI Assistants","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16244","snapshot_observed_at":"2026-08-06T14:57:06.575199Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.575199Z"},"links":{"cited_paper":"/paper/2404.16244","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:2e120d0dafbd39c56735de6ce475f4a8b74f61fdb58a872f1a9246d5236f18f7","observation_id":"1326a40c-96ed-4430-8f13-415b0a409744","resolution":{"observed_at":"2026-08-06T14:57:06.575199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.581377Z","title":"Governing AI Agents, April 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.581377Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:34318b353fa4b216ee3a5dcc7b2ca23cd842e15acae645b9e99e4b59bd383c06","observation_id":"d75cdf1d-b80b-47e8-b82b-df8b4258541e","resolution":{"observed_at":"2026-08-06T14:57:06.581377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.588723Z","title":"Potter and Kevin J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.588723Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:8ecae328d8208a1a76e894cf6cc82e86087ccea38523dc70f7f59c9b70e453c1","observation_id":"0a6431b4-4476-4047-b056-7635743f9d17","resolution":{"observed_at":"2026-08-06T14:57:06.588723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.593854Z","title":"Position: Stop acting like language model agents are normal agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.593854Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:97cfaf06031a78d3fc538b01b20a7324a3c177bbbaedc0e726595ff3935ad9d4","observation_id":"17a9dce9-82a0-4fdc-ae1a-ae463859cd48","resolution":{"observed_at":"2026-08-06T14:57:06.593854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.599169Z","title":"Emergent causality and the foundation of consciousness","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.599169Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:c358fc7fa0b6fffe7086b9c56e14d26149275b695cac9a964506f24af141c65e","observation_id":"d3dc9ae4-b0f9-40aa-8832-27e2b4d228dc","resolution":{"observed_at":"2026-08-06T14:57:06.599169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.604343Z","title":"Compression, the fermi paradox and artificial super-intelligence","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.604343Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:4e06b2bd1d6812aaf6ede230060fc8dadd986d4ada83252b982c4b74ccc6c9a0","observation_id":"ec33ae29-47cb-4f7f-9595-e578ed8ad0d4","resolution":{"observed_at":"2026-08-06T14:57:06.604343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.609869Z","title":"World Scientific, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.609869Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:9e22bc145831f81c0b2b9afd8b89dcf6edc34390b854540c8765b39e54f18750","observation_id":"7889ef22-788c-4144-8b6f-8664c3391ed8","resolution":{"observed_at":"2026-08-06T14:57:06.609869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.620551Z","title":"Thorisson.A New Constructivist AI: From Manual Methods to Self-Constructive Systems, pages 145–171","venue":null,"work_id":"ab643dff-4ed6-4f16-abea-df50fb05f764","year":2012},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.614775Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:17c85e89b97151a3541c2939794a9219032ecee98714353db550059a8a252600","observation_id":"cf7a54d8-162a-401d-bd87-f4d51fce04f4","resolution":{"observed_at":"2026-08-06T14:57:08.627558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.600730Z","title":"Artificial general intelligence: Concept, state of the art.Journal of Artificial General Intelligence, 5(1):1–48, 2014","venue":null,"work_id":"4ec0208a-f982-4ee2-b4b8-a1339690a60e","year":2014},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.620260Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:2077bd732a9ed939e35a21d1ed48fa4c965b1301636405af93f5d43e121aff58","observation_id":"bc84d72b-86d4-4056-87a0-310a48c5281c","resolution":{"observed_at":"2026-08-06T14:57:08.607831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-06T20:36:41.418114Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-06T14:57:06.625605Z","title":"Agentbench: Evaluating llms as agents.arXiv preprint arXiv:2308.03688, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.625605Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:a6470a49f3f5aa447076e9bb0d6fcbeba64c66c177cfc6909c9612422354cb0d","observation_id":"e2bcb39f-eb72-46e0-be5f-d87dec9d79ce","resolution":{"observed_at":"2026-08-06T14:57:06.625605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12983","last_updated":"2023-11-21T20:34:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-21T20:34:47Z","title":"GAIA: a benchmark for General AI Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12983","snapshot_observed_at":"2026-08-06T14:57:06.633930Z","title":"Gaia: a benchmark for general ai assistants.arXiv preprint arXiv:2311.12983, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.633930Z"},"links":{"cited_paper":"/paper/2311.12983","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b1faf6d5d3dfa455a55874133aa349a3900e1c21ac0527b5475f9a0a78ecf14b","observation_id":"52b961ae-a22f-47fa-96da-851c8e5427a0","resolution":{"observed_at":"2026-08-06T14:57:06.633930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03302","last_updated":"2024-04-14T21:02:16Z","snapshot_observed_at":"2026-08-03T01:30:37.931398Z","submitted_at":"2023-10-05T04:06:12Z","title":"MLAgentBench: Evaluating Language Agents on Machine Learning Experimentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03302","snapshot_observed_at":"2026-08-06T14:57:06.640490Z","title":"Mlagentbench: Evaluating language agents on machine learning experimentation.arXiv preprint arXiv:2310.03302, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.640490Z"},"links":{"cited_paper":"/paper/2310.03302","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:cf18c1379622ebb3eeb48b6a354bf38f1e7743a272ad17efedbc1876ba00261f","observation_id":"43152c97-83f1-4231-afce-e6da05582938","resolution":{"observed_at":"2026-08-06T14:57:06.640490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04026","last_updated":"2023-08-08T03:59:28Z","snapshot_observed_at":"2026-07-06T16:03:46.860343Z","submitted_at":"2023-08-08T03:59:28Z","title":"AgentSims: An Open-Source Sandbox for Large Language Model Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04026","snapshot_observed_at":"2026-08-06T14:57:06.646251Z","title":"Agentsims: An open-source sandbox for large language model evaluation.arXiv preprint arXiv:2308.04026, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.646251Z"},"links":{"cited_paper":"/paper/2308.04026","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:99c043178bd530e845d11d4386f0c4eba9954d53dc725d7a67d4866cb2cfa7c5","observation_id":"33891f3f-acec-4c08-bd5c-dcd9349a5315","resolution":{"observed_at":"2026-08-06T14:57:06.646251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01275","last_updated":"2024-01-09T18:54:05Z","snapshot_observed_at":"2026-08-06T18:03:53.256713Z","submitted_at":"2024-01-02T16:20:40Z","title":"CharacterEval: A Chinese Benchmark for Role-Playing Conversational Agent Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01275","snapshot_observed_at":"2026-08-06T14:57:06.652456Z","title":"Charactereval: A chinese benchmark for role-playing conversational agent evaluation.arXiv preprint arXiv:2401.01275, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.652456Z"},"links":{"cited_paper":"/paper/2401.01275","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:ef7f9d3dea879263faf7ea1dcc9158b119b60f4420c79099977fe15e21721f90","observation_id":"c549e7f8-995f-4bfa-ac27-180421bcdbd8","resolution":{"observed_at":"2026-08-06T14:57:06.652456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17332","last_updated":"2025-06-24T04:10:59Z","snapshot_observed_at":"2026-07-06T20:56:49.300474Z","submitted_at":"2025-03-21T17:32:32Z","title":"CVE-Bench: A Benchmark for AI Agents' Ability to Exploit Real-World Web Application Vulnerabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17332","snapshot_observed_at":"2026-08-06T14:57:06.658280Z","title":"Cve-bench: A benchmark for ai agents’ ability to exploit real-world web application vulnerabilities.arXiv preprint arXiv:2503.17332, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.658280Z"},"links":{"cited_paper":"/paper/2503.17332","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:aa9f6c09330ae3995ff669a192b66250450bf5cc9285dcc8b008cb430d359e03","observation_id":"3ef074a3-eee1-4112-841a-28577879b915","resolution":{"observed_at":"2026-08-06T14:57:06.658280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-07-06T20:45:59.818273Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-06T14:57:06.663765Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents.arXiv preprint arXiv:2503.01935, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.663765Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:305f466a54397e71a776120c685b102b78c5d112ab47d19bc7057c7fea7a0aec","observation_id":"d02d8bf0-e065-4fe5-8a9a-ad4782b7ba78","resolution":{"observed_at":"2026-08-06T14:57:06.663765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04808","last_updated":"2025-04-14T19:46:56Z","snapshot_observed_at":"2026-07-06T21:05:15.750647Z","submitted_at":"2025-04-07T08:03:36Z","title":"ELT-Bench: An End-to-End Benchmark for Evaluating AI Agents on ELT Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04808","snapshot_observed_at":"2026-08-06T14:57:06.669214Z","title":"Elt-bench: An end-to-end benchmark for evaluating ai agents on elt pipelines.arXiv preprint arXiv:2504.04808, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.669214Z"},"links":{"cited_paper":"/paper/2504.04808","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:cdd35988a6c4b6f9d8995b39986fdf8fdfeb349b6503b4a425392b342738f1d1","observation_id":"804ceb17-0626-4071-be1b-d4827f4bb80f","resolution":{"observed_at":"2026-08-06T14:57:06.669214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07869","last_updated":"2025-02-23T15:16:14Z","snapshot_observed_at":"2026-08-03T02:45:25.114808Z","submitted_at":"2024-10-10T12:41:19Z","title":"Benchmarking Agentic Workflow Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07869","snapshot_observed_at":"2026-08-06T14:57:06.674390Z","title":"Benchmarking agentic workflow generation.arXiv preprint arXiv:2410.07869, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.674390Z"},"links":{"cited_paper":"/paper/2410.07869","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:1691c11b04486faea4886fd7a16d2ddafbc8507ffb46a6ab9edd5be6bde24462","observation_id":"a9ee71b9-a33c-4ed2-bda6-c1bd3e44cf3c","resolution":{"observed_at":"2026-08-06T14:57:06.674390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00081","last_updated":"2024-10-31T17:53:12Z","snapshot_observed_at":"2026-07-06T19:43:09.889618Z","submitted_at":"2024-10-31T17:53:12Z","title":"PARTNR: A Benchmark for Planning and Reasoning in Embodied Multi-agent Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00081","snapshot_observed_at":"2026-08-06T14:57:06.679450Z","title":"Turner, Eric Undersander, and Tsung-Yen Yang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.679450Z"},"links":{"cited_paper":"/paper/2411.00081","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3355943ee9205017e9ddfbf293091fe6d358f96887664c3ddef561391430e35a","observation_id":"f9a3f08d-56b6-4d43-b786-a86940cb4b05","resolution":{"observed_at":"2026-08-06T14:57:06.679450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.684556Z","title":"John wiley & sons, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.684556Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:95d7729a78abaa7563f83d3e3f0df0b1b4bcfff5c2db8184308ae622a37aeb59","observation_id":"2b1e2002-fd6c-43b5-aad9-15252b844b2d","resolution":{"observed_at":"2026-08-06T14:57:06.684556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.568214Z","title":"Is it an agent, or just a program? a taxonomy for autonomous agents","venue":null,"work_id":"b040fed2-67c0-472d-b792-1a6de2f73b5c","year":1997},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.689804Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:de0e4e3916fa65b5fe5240aeb0d81eaa5094e411536b62260fe3ba16a9ea021e","observation_id":"cd8da897-fddb-42aa-acf7-3c7fd8515160","resolution":{"observed_at":"2026-08-06T14:57:08.573766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.694956Z","title":"Jennings","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.694956Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:1a81a548995676ea6a54c460e523c72b593182bb0ef8e739fc835956f83c0c1c","observation_id":"04543301-01cb-4902-a72a-ad8da4b74a81","resolution":{"observed_at":"2026-08-06T14:57:06.694956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.532565Z","title":"Adversarial nli: A new benchmark for natural language understanding","venue":null,"work_id":"f587af69-616c-40f6-b08a-eba4563018b3","year":2020},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.700379Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:cc0665faa6978a29f96d4d774cfc7c1d683496db17a3e078bec4bc88bd2bfb6a","observation_id":"a607cefc-00b4-419f-940b-2a2a753c0a26","resolution":{"observed_at":"2026-08-06T14:57:08.539061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.513882Z","title":"Metagpt: Meta programming for multi-agent collaborative framework","venue":null,"work_id":"05ac7e90-e21a-444a-bd71-3706b0e9dbd9","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.705353Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:41d1f613a7e3395a8c9fd6d2ff02966c8f1001d9e78e2f597ccbc84ac8b4c6ef","observation_id":"95826660-379d-4eb6-9756-e95ab877cf27","resolution":{"observed_at":"2026-08-06T14:57:08.519669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T14:57:06.710356Z","title":"Universal and transferable adversarial attacks on aligned language models.arXiv preprint arXiv:2307.15043, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.710356Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:60e1129b0243040b44e2881eb4d2d25569d2e877cbc1bfd18d09f8da37e18cf5","observation_id":"0d7e05da-9a35-4c94-9b5d-ee9effd20baf","resolution":{"observed_at":"2026-08-06T14:57:06.710356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.716016Z","title":"Langchain.https://github.com/langchain-ai/langchain, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.716016Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3b33cdf66910ce94b12f996e55ad34e457c443b622b09f018d9735b0b696283c","observation_id":"f23d8a28-6c94-450f-98d5-75788a28f913","resolution":{"observed_at":"2026-08-06T14:57:06.716016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.474952Z","title":"Thórisson","venue":null,"work_id":"592f0da0-4e83-4519-ad93-a1020e50bcd7","year":2020},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.721374Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:aa060199458876c627afaa9f8d98e9b7f76e9f267950c8cb43c6650f0dcd0f52","observation_id":"a4a7f49f-a8d2-47bd-bf03-dd47b7d09ada","resolution":{"observed_at":"2026-08-06T14:57:08.480959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.455844Z","title":"Autocatalytic endogenous reflective architecture","venue":null,"work_id":"2cdb7efe-ea59-4e44-a7d4-4fd4c6a5b13a","year":2013},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.726076Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:432cbc96412ec25c3042d493eafca0f3ea680c5ad2f2c59db52ad37a505b7d08","observation_id":"74d8fa55-dc95-48bc-bf98-dda8ff0f92f4","resolution":{"observed_at":"2026-08-06T14:57:08.461528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.435084Z","title":"Wang.Rigid Flexibility: The Logic of Intelligence","venue":null,"work_id":"180d817d-476a-413b-9264-364c1d54370c","year":2006},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.730962Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:67fda9fe2035a981b6ff67d7579bc17f1a8585d354ceb1492ec96824a4ec6a9f","observation_id":"a2c2b775-dd2f-49a8-afee-f14d11658249","resolution":{"observed_at":"2026-08-06T14:57:08.441732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.417605Z","title":"‘opennars for applications’: Architecture and control","venue":null,"work_id":"6a615305-de9b-4202-8429-db6407bf2283","year":2020},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.736311Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:98b15df237a7b4da47f6bbabd27f9f5e92c33db72f4501f072fa4a2f3054ac2f","observation_id":"2bcc24a6-5df1-4d5c-a8be-4f9cece8686c","resolution":{"observed_at":"2026-08-06T14:57:08.422928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.398593Z","title":"The general theory of general intelligence: A pragmatic patternist perspective","venue":null,"work_id":"5c559967-f775-4f0c-bec9-ba9821e9d217","year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.742133Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:fe179ecba0d69289a458f36cf77873d375ef274fa44d419eeeb3029a430c9104","observation_id":"cdf351cb-faeb-43dc-81e8-c24744186362","resolution":{"observed_at":"2026-08-06T14:57:08.404633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.378355Z","title":"Opencog hyperon: A framework for agi at the human level and beyond","venue":null,"work_id":"cd7253f7-3ffd-4a78-803b-b2a82e423e57","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.747813Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b77412e88548696230239033be1b2a47ef149695bfe7273a84ab3a107ec81d68","observation_id":"da8d3d15-f4dc-45e4-b0a8-05e76f77a4d3","resolution":{"observed_at":"2026-08-06T14:57:08.384987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02427","last_updated":"2024-03-15T15:44:11Z","snapshot_observed_at":"2026-08-03T00:38:27.580701Z","submitted_at":"2023-09-05T17:56:20Z","title":"Cognitive Architectures for Language Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02427","snapshot_observed_at":"2026-08-06T14:57:06.753218Z","title":"Sumers, Shunyu Yao, Karthik Narasimhan, and Thomas L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.753218Z"},"links":{"cited_paper":"/paper/2309.02427","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:891fc840190522f34c5ac66176a2fef0ac9144b7cdb1ea6e1d424cf4a0f540d1","observation_id":"915ff8e5-45f6-4f21-bc6c-1d10ed3a60b4","resolution":{"observed_at":"2026-08-06T14:57:06.753218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.358277Z","title":"Language agents in the digital world: Opportunities and risks.princeton-nlp.github.io, Jul 2023","venue":null,"work_id":"c58c002c-1def-44a0-a823-3e4738d170f9","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.758612Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:bb75d55397d9409b61c60d8864b21fe7b4e9c7d32c339bbf46b05debcb671281","observation_id":"92bad81b-a4ac-45d9-ac1b-510ddd997125","resolution":{"observed_at":"2026-08-06T14:57:08.363823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.339247Z","title":"Practices for governing agentic ai systems","venue":null,"work_id":"f2ac6e3f-cecf-4673-a1af-a38ddb560e9c","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.763988Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:eed6b115cde388f2238581b9d56dc375ae57f7eae3ae26c486e5733b4229f003","observation_id":"5f24bec1-a7ad-4d23-b8df-a93f33229745","resolution":{"observed_at":"2026-08-06T14:57:08.345775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.319264Z","title":"Langlois, Pedro A","venue":null,"work_id":"0cc84f51-892c-4dea-9a81-8fcd32ede338","year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.769739Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b705cc17a5089c207fd2520e015b8fa9bd8ca29a77b276c9e44a5fbf421583ef","observation_id":"fbd1cec1-c232-4682-a0d0-5ce705925f94","resolution":{"observed_at":"2026-08-06T14:57:08.324834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13138","last_updated":"2024-05-17T17:45:05Z","snapshot_observed_at":"2026-08-04T05:27:14.089281Z","submitted_at":"2024-01-23T23:18:33Z","title":"Visibility into AI Agents","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13138","snapshot_observed_at":"2026-08-06T14:57:06.774550Z","title":"Visibility into AI agents.arXiv: 2401.13138 [cs.CY], January 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.774550Z"},"links":{"cited_paper":"/paper/2401.13138","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3793e95c8e094aa703b5427573d01836e5f8c31d33f1a49e7b9598f91a2c6167","observation_id":"b1c14acb-291a-4f21-870f-6d2b5435512e","resolution":{"observed_at":"2026-08-06T14:57:06.774550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.301327Z","title":"Attention is all you need","venue":null,"work_id":"c79ae75f-3c04-41d9-a0da-9abb76ccdfd5","year":2017},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.780280Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:4dd1153e9f0cbb4600dd16b50afd73463c6d156c32375504c0d351a906359998","observation_id":"6946e8d5-3a53-4839-abbb-c76404867d5e","resolution":{"observed_at":"2026-08-06T14:57:08.306755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.14627","last_updated":"2022-07-29T11:53:22Z","snapshot_observed_at":"2026-08-03T19:38:24.369805Z","submitted_at":"2022-07-29T11:53:22Z","title":"\"Do you follow me?\": A Survey of Recent Approaches in Dialogue State Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.14627","snapshot_observed_at":"2026-08-06T14:57:06.785581Z","title":"do you follow me?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.785581Z"},"links":{"cited_paper":"/paper/2207.14627","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:d806d998a0b46cbffd62d4529c2b31bca1c3b3532adde9010f456166a469164d","observation_id":"e7c8b012-c9bf-4d9a-88c3-6474a32cc3c2","resolution":{"observed_at":"2026-08-06T14:57:06.785581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.281194Z","title":"Multi-domain dialogue state tracking with disentangled domain-slot attention","venue":null,"work_id":"0fc08aec-67f4-4df2-b7f4-fcdb69b7f2f7","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.791317Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:a29ee29ffb204db807fc7b46d292f70ad5dcd33eb8fa79daec16ad2be3d83c55","observation_id":"f3d31cfa-957b-495e-8293-0e4e54dccf72","resolution":{"observed_at":"2026-08-06T14:57:08.287517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14970","last_updated":"2023-10-23T14:15:28Z","snapshot_observed_at":"2026-08-03T15:27:30.824975Z","submitted_at":"2023-10-23T14:15:28Z","title":"Towards LLM-driven Dialogue State Tracking","version":1},"cited_work":{"arxiv_id":"2310.14970","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.14970","snapshot_observed_at":"2026-08-06T14:57:07.471336Z","title":"Towards LLM-driven Dialogue State Tracking","venue":"cs.CL","work_id":"42f9c17d-0673-4679-aada-b9ed64f33beb","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.796551Z"},"links":{"cited_paper":"/paper/2310.14970","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:238610e8133234be7bd9ca20bdd7fcd1e4b3890f3a8388556ce1fb173f220454","observation_id":"ec5e05ec-665d-4be0-a55b-700914390034","resolution":{"observed_at":"2026-08-06T14:57:07.477381Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.15055","last_updated":"2020-10-14T08:51:40Z","snapshot_observed_at":"2026-08-06T11:46:24.077844Z","submitted_at":"2020-06-26T15:31:57Z","title":"Object-Centric Learning with Slot Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.15055","snapshot_observed_at":"2026-08-06T14:57:06.801744Z","title":"Unsal, Sjoerd Behbahani, Dirk Weissenborn, Heiko Küttler, Daniel Zoran, Adrià Puigdomenech Badia, Bernhard Schölkopf, Raia Hadsell, and Olivier Bachem","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.801744Z"},"links":{"cited_paper":"/paper/2006.15055","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:10eb796d051c0b296f301512c160e2d1b4fac674555fc011cecdf4d1e339cd8c","observation_id":"8a17dc82-efc5-4e51-8b2c-2887ac3113ff","resolution":{"observed_at":"2026-08-06T14:57:06.801744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10305","last_updated":"2024-05-16T17:56:55Z","snapshot_observed_at":"2026-07-06T18:15:24.541427Z","submitted_at":"2024-05-16T17:56:55Z","title":"4D Panoptic Scene Graph Generation","version":1},"cited_work":{"arxiv_id":"2405.10305","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.10305","snapshot_observed_at":"2026-08-06T14:57:07.429098Z","title":"4D Panoptic Scene Graph Generation","venue":"cs.CV","work_id":"301739ac-f615-4843-90f3-e70c049c9fe0","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.806851Z"},"links":{"cited_paper":"/paper/2405.10305","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:2146f7d6ae4583169b55bd085b8a3553baff92275567dcd99089a8998f03deb9","observation_id":"db263df3-14bd-4d11-91be-81faad2405bc","resolution":{"observed_at":"2026-08-06T14:57:07.434467Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.00443","last_updated":"2022-06-22T09:19:40Z","snapshot_observed_at":"2026-08-03T21:52:10.039199Z","submitted_at":"2022-01-03T00:55:33Z","title":"Scene Graph Generation: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2201.00443","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.00443","snapshot_observed_at":"2026-08-06T14:57:07.405029Z","title":"Scene Graph Generation: A Comprehensive Survey","venue":"cs.CV","work_id":"a5874869-2c2f-43db-a92a-7081ed229c43","year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.811983Z"},"links":{"cited_paper":"/paper/2201.00443","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:af78b2e26aee02c48685c5da785cc90cdbd9051c1956f2297046a3b87c41cfee","observation_id":"43676c60-28f5-4613-8984-92cb44f28a37","resolution":{"observed_at":"2026-08-06T14:57:07.410678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00906","last_updated":"2024-04-24T07:15:16Z","snapshot_observed_at":"2026-07-06T17:53:51.988186Z","submitted_at":"2024-04-01T04:21:01Z","title":"From Pixels to Graphs: Open-Vocabulary Scene Graph Generation with Vision-Language Models","version":3},"cited_work":{"arxiv_id":"2404.00906","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.00906","snapshot_observed_at":"2026-08-06T14:57:07.377228Z","title":"From Pixels to Graphs: Open-Vocabulary Scene Graph Generation with Vision-Language Models","venue":"cs.CV","work_id":"29a43c63-4245-472a-956e-ee8a1b2bb6ee","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.817174Z"},"links":{"cited_paper":"/paper/2404.00906","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:8fba27458192731b3d026cb24dabd6c335d9385b8d0b4f9ccfae0a7050c39d8a","observation_id":"13c86a5d-bfd6-4355-ba66-b2356f171d86","resolution":{"observed_at":"2026-08-06T14:57:07.383206Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01929","last_updated":"2024-11-15T20:30:35Z","snapshot_observed_at":"2026-08-07T06:29:12.643126Z","submitted_at":"2024-01-03T19:00:01Z","title":"Dichroic cavity mode splitting and lifetimes from interactions with a ferromagnetic metal","version":4},"cited_work":{"arxiv_id":"2401.01929","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.01929","snapshot_observed_at":"2026-08-06T14:57:07.350494Z","title":"Dichroic cavity mode splitting and lifetimes from interactions with a ferromagnetic metal","venue":"cond-mat.mes-hall","work_id":"3a4d9e46-7e15-4861-a074-35999197c6ca","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.822275Z"},"links":{"cited_paper":"/paper/2401.01929","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:1dfb710ca963ab220b8f6e34842cffc9ed051c134bb0f5b56845bc727f60d1b4","observation_id":"cf69d3a4-dcf2-485f-a310-0cd7f694a459","resolution":{"observed_at":"2026-08-06T14:57:07.356457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10420","last_updated":"2025-02-04T08:14:18Z","snapshot_observed_at":"2026-07-06T20:36:50.081370Z","submitted_at":"2025-02-04T08:14:18Z","title":"Position: Stop Acting Like Language Model Agents Are Normal Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10420","snapshot_observed_at":"2026-08-06T14:57:06.827850Z","title":"Position: Stop acting like language model agents are normal agents.arXiv preprint arXiv:2502.10420, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.827850Z"},"links":{"cited_paper":"/paper/2502.10420","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:f95c94d77e7af989187bea338dfff070b416e7f041a49fa59d917ba823ac8c5c","observation_id":"da7ce7d5-1f88-400f-b71a-6ad4a2bc369a","resolution":{"observed_at":"2026-08-06T14:57:06.827850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08819","last_updated":"2025-03-05T23:00:57Z","snapshot_observed_at":"2026-07-06T17:59:38.202928Z","submitted_at":"2024-04-12T21:30:06Z","title":"The Illusion of State in State-Space Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08819","snapshot_observed_at":"2026-08-06T14:57:06.833193Z","title":"The illusion of state in state-space models.arXiv preprint arXiv:2404.08819, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.833193Z"},"links":{"cited_paper":"/paper/2404.08819","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b5ca6f74ae46086b92b95f715a601f1bf871bcce756d5a1196480b2fba64e3c7","observation_id":"88506cc3-0bc2-4c28-ad0e-e502e65a3106","resolution":{"observed_at":"2026-08-06T14:57:06.833193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-06T14:57:06.838393Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models, January 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.838393Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:6d07d9a7056b8fe039601a286f248b03c9e5265178dff54d64746d7587a41559","observation_id":"342b2bb9-3a86-4035-ba76-ff087d74e944","resolution":{"observed_at":"2026-08-06T14:57:06.838393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.843816Z","title":"Tree of thoughts: Deliberate problem solving with large language models.Ad- vances in neural information processing systems, 36:11809–11822, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.843816Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:97fc31cf8950d281ba05694de44b6790b3df2f911a898eb917b92c48acaf4f5d","observation_id":"d8f299ec-a635-494c-b359-b66aedde4a9d","resolution":{"observed_at":"2026-08-06T14:57:06.843816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T14:57:06.849365Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.849365Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:6f65cc7ae8b925b38bc78aa3253e626cd464c8c8c5ff4fed5c76b1b035da0294","observation_id":"92925f36-7b58-42f9-805f-1c5aec1f6bbc","resolution":{"observed_at":"2026-08-06T14:57:06.849365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.854681Z","title":"Bender, Timnit Gebru, Angelina McMillan-Major, and Shmargaret Shmitchell","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.854681Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:d595fba62df44f4688add162258fa20ea36868412656b556763c191360d2de1d","observation_id":"00196c89-0ca0-4602-9251-e23e8c0f2a11","resolution":{"observed_at":"2026-08-06T14:57:06.854681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-06T14:57:06.860316Z","title":"Transformers as stochastic optimizers.arXiv preprint arXiv:2305.14314, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.860316Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:02730ed97bce9a24b0f8c3dbaae98505001aa6b277a3a1e7ce4485a2735edda9","observation_id":"b5ac2ec1-4433-42c9-b7f8-85b93680d51f","resolution":{"observed_at":"2026-08-06T14:57:06.860316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.233236Z","title":"Do language models have bayesian brains? distinguishing stochastic and deterministic decision patterns within large language models","venue":null,"work_id":"c54ac4e0-2ec7-4da9-804e-7cb3e304ebd9","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.865678Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:20a17646029f014578262a7a3085cd9f61060f0d83e3871287665351ad43ee0c","observation_id":"e2f44cc2-f6ae-4848-8367-9cb6094efe55","resolution":{"observed_at":"2026-08-06T14:57:08.240504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14257","last_updated":"2025-02-08T12:50:42Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T16:05:58Z","title":"Do I Know This Entity? Knowledge Awareness and Hallucinations in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14257","snapshot_observed_at":"2026-08-06T14:57:06.871290Z","title":"Do i know this entity? knowledge awareness and hallucinations in language models.arXiv preprint arXiv:2411.14257, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.871290Z"},"links":{"cited_paper":"/paper/2411.14257","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:cc0a5990d70ec22e3c7753fbb32c93b6a6a583447ae72b14f9813d1c6519ac8d","observation_id":"0092c7d4-4ae0-402a-a1ba-e18115443018","resolution":{"observed_at":"2026-08-06T14:57:06.871290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04442","last_updated":"2024-04-05T22:59:02Z","snapshot_observed_at":"2026-08-06T02:47:20.498769Z","submitted_at":"2024-04-05T22:59:02Z","title":"Exploring Autonomous Agents through the Lens of Large Language Models: A Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04442","snapshot_observed_at":"2026-08-06T14:57:06.876711Z","title":"Exploring autonomous agents through the lens of large language models.arXiv preprint arXiv:2404.04442, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.876711Z"},"links":{"cited_paper":"/paper/2404.04442","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:f55b87c3778877d2d3c5a94cf8662db73a91dc1e7665c6edb34bdb43124ac919","observation_id":"a81a66a5-757a-4faa-8a14-ebda8925b122","resolution":{"observed_at":"2026-08-06T14:57:06.876711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04528","last_updated":"2024-07-16T07:29:49Z","snapshot_observed_at":"2026-07-06T15:39:49.273453Z","submitted_at":"2023-06-07T15:37:00Z","title":"PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04528","snapshot_observed_at":"2026-08-06T14:57:06.882060Z","title":"PromptBench: Towards evaluating the robustness of Large Language Models on adversarial prompts.arXiv: 2306.04528 [cs.CL], June 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.882060Z"},"links":{"cited_paper":"/paper/2306.04528","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:ad197adb354482d8b57ab5babc2939f8a506743df0f1ec4fd36482f4ea0ef337","observation_id":"15fb529e-3caf-4a08-bb0b-0efca3b5e99f","resolution":{"observed_at":"2026-08-06T14:57:06.882060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19177","last_updated":"2023-10-29T22:37:54Z","snapshot_observed_at":"2026-08-02T21:02:18.962145Z","submitted_at":"2023-10-29T22:37:54Z","title":"Robustifying Language Models with Test-Time Adaptation","version":1},"cited_work":{"arxiv_id":"2310.19177","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.19177","snapshot_observed_at":"2026-08-06T14:57:07.174741Z","title":"Robustifying Language Models with Test-Time Adaptation","venue":"cs.CL","work_id":"2b7a7792-6f6d-4ab4-bc1c-35740ac39ca3","year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.887492Z"},"links":{"cited_paper":"/paper/2310.19177","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:ed47687b2d296e2235bcdb20328430f13ce0c6b3e08280ac71bb899230527105","observation_id":"b5aa7e15-cdf3-4244-9f65-81628866973c","resolution":{"observed_at":"2026-08-06T14:57:07.180393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12237","last_updated":"2021-08-27T12:31:17Z","snapshot_observed_at":"2026-08-06T08:03:16.501331Z","submitted_at":"2021-08-27T12:31:17Z","title":"Evaluating the Robustness of Neural Language Models to Input Perturbations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12237","snapshot_observed_at":"2026-08-06T14:57:06.893117Z","title":"Evaluating the robustness of neural language models to input perturbations.arXiv preprint arXiv:2108.12237, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.893117Z"},"links":{"cited_paper":"/paper/2108.12237","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:0d8c9881d68806d52ab849b833b886924ab2a96871e5e889748278991acae5c3","observation_id":"5ac6a081-2131-489e-aab5-3c81dd804c36","resolution":{"observed_at":"2026-08-06T14:57:06.893117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10802","last_updated":"2024-06-16T04:48:43Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T04:48:43Z","title":"KGPA: Robustness Evaluation for Large Language Models via Cross-Domain Knowledge Graphs","version":1},"cited_work":{"arxiv_id":"2406.10802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.10802","snapshot_observed_at":"2026-08-06T14:57:07.129292Z","title":"KGPA: Robustness Evaluation for Large Language Models via Cross-Domain Knowledge Graphs","venue":"cs.CL","work_id":"21cc28b8-41f3-4797-9dbc-fbf139359527","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.898735Z"},"links":{"cited_paper":"/paper/2406.10802","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:005341ae328b66ca9b10b14df888b59823e2a41764ac11dffe89569794fc1e82","observation_id":"3f07845c-48b5-43dd-8869-ee4845427d18","resolution":{"observed_at":"2026-08-06T14:57:07.137196Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08851","last_updated":"2024-10-11T14:27:18Z","snapshot_observed_at":"2026-07-06T19:31:49.052556Z","submitted_at":"2024-10-11T14:27:18Z","title":"Measuring the Inconsistency of Large Language Models in Preferential Ranking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08851","snapshot_observed_at":"2026-08-06T14:57:06.905560Z","title":"Measuring the inconsistency of large language models in preferential ranking.arXiv preprint arXiv:2410.08851, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.905560Z"},"links":{"cited_paper":"/paper/2410.08851","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:84049cfbae49fa539d170229878b5d7c0ab5808581cbe9fc16ebd1b27969def4","observation_id":"069695b2-e419-4f83-b243-d8af4455dc52","resolution":{"observed_at":"2026-08-06T14:57:06.905560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09624","last_updated":"2023-11-11T05:30:34Z","snapshot_observed_at":"2026-07-06T16:33:04.032904Z","submitted_at":"2023-10-14T17:10:28Z","title":"ASSERT: Automated Safety Scenario Red Teaming for Evaluating the Robustness of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09624","snapshot_observed_at":"2026-08-06T14:57:06.911179Z","title":"Assert: Automated safety scenario red teaming for evaluating the robustness of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.911179Z"},"links":{"cited_paper":"/paper/2310.09624","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b2513b77f424f3174155e1b2b31e50ff1fc8fd798394d45d5247e0bad527ce19","observation_id":"33e30a3e-e233-4d4b-9455-e98db6691ece","resolution":{"observed_at":"2026-08-06T14:57:06.911179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.916840Z","title":"Large language models can be easily distracted by irrelevant context","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.916840Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:1ad56d6f316864c00be00fca3f58a7503373df48c4b1b9079e280bbfdc711721","observation_id":"53160d10-d113-4d5c-80ca-3e1483657778","resolution":{"observed_at":"2026-08-06T14:57:06.916840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03538","last_updated":"2024-11-05T22:37:43Z","snapshot_observed_at":"2026-08-04T19:06:13.807372Z","submitted_at":"2024-11-05T22:37:43Z","title":"Long Context RAG Performance of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03538","snapshot_observed_at":"2026-08-06T14:57:06.923301Z","title":"Long context rag performance of large language models.arXiv preprint arXiv:2411.03538, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.923301Z"},"links":{"cited_paper":"/paper/2411.03538","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:0c71d38ed533d0493a280559bf88c84cf6840848cf29b9b134e5dd819ae4844a","observation_id":"8d24e04b-5c05-4f81-8347-4c434e4ca36f","resolution":{"observed_at":"2026-08-06T14:57:06.923301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:06.928664Z","title":"Lost in the middle: How language models use long contexts.Transactions of the Association for Computational Linguistics, 12:157–173, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.928664Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:b6644740695d0b008a703ad214613dd53c4525f98e8fe4d495431e5834e54257","observation_id":"c0c529d7-a28a-4b70-b831-5a3e2e20eb1f","resolution":{"observed_at":"2026-08-06T14:57:06.928664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.188932Z","title":"Computational dualism and objective superintelligence","venue":null,"work_id":"e0524e7c-6f4a-4563-9880-ff974f47597d","year":2024},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.933739Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:8bf6d400c2b97ba38bb27d734ee9e874762bf17493104b3df1081de45206b5ce","observation_id":"ff543c29-3253-40c5-b5bd-e37b1f23c550","resolution":{"observed_at":"2026-08-06T14:57:08.195060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.171241Z","title":"Are biological systems more intelligent than artificial intelligence? 2025","venue":null,"work_id":"7cadc212-0c50-4d0c-934c-d43b5cd612a5","year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.939038Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:5664c4450c01c9e39f44354d9ba51b5a27800aa4c6adf4e8565ba771e3701c6c","observation_id":"aa3e6cd3-4a6d-47e7-ad1c-2760f91419a5","resolution":{"observed_at":"2026-08-06T14:57:08.176790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.152238Z","title":"Philosophical specification of empathetic ethical artificial intelligence.IEEE Transactions on Cognitive and Developmental Systems, 14(2):292–300, 2022","venue":null,"work_id":"d61d8d2b-d5ee-41b1-9f5e-4c4f6fd6a0c3","year":2022},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.943812Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:979dde1dd2f903a0b43a7f4afa2aad3ee588c17a035bcda9fcfd93509226fbd2","observation_id":"7a2d9398-0423-400d-86b8-19aefa192ab0","resolution":{"observed_at":"2026-08-06T14:57:08.158661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.132816Z","title":null,"venue":null,"work_id":"69bcfec8-5918-4bf5-b6ad-cb9ddacf67ce","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.949190Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:d5f95ed1b65a71e655bd5a465dabeb6f18189b294312eb17fae559e2fd52d9ba","observation_id":"507122a8-1b37-403a-b3f8-50df7bced55a","resolution":{"observed_at":"2026-08-06T14:57:08.139110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.114340Z","title":null,"venue":null,"work_id":"9150bc74-629b-4230-b8c4-676cf46c9983","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.954486Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:c3df56f1354461e9b7171ca0961da2a506a565786b3a96fde488814e054f2cfa","observation_id":"e17834ce-3c35-4e96-bf23-288aedb93d66","resolution":{"observed_at":"2026-08-06T14:57:08.120137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.094696Z","title":"De- velop a 3-stage marketing strategy for a new eco-friendly coffee brand,","venue":null,"work_id":"17bd8756-4f7e-44fb-9776-dec7225e5a92","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.960486Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3a150bdd3cf0eaacb5f9bf08ee1f06f4506c5359ded1fa27ab1ee6ab646aee03","observation_id":"e7b478e5-fa0e-4c70-9b2f-7e170ea32c92","resolution":{"observed_at":"2026-08-06T14:57:08.101068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.077274Z","title":"–Perform the standardised planning task","venue":null,"work_id":"02b031fb-f340-4355-8f6f-7799f6781fbf","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.966448Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:86b07d560bc59f99c5f7c5eec8fcb8743747ad6c731c7ac0522dd1357026c0a6","observation_id":"2a7d42a1-3a74-4474-8bc2-b42ea5b98c08","resolution":{"observed_at":"2026-08-06T14:57:08.082506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.058048Z","title":"Planning Performance Scores for Configi)","venue":null,"work_id":"6d2f05a9-e2d6-49fb-b8db-1b8943454319","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.972275Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:71e19e2cb1d8f036d578db42e9519e5c8d082b2084a3d22187e3c977abb0d1f1","observation_id":"a08a87dd-dda9-4de4-964f-62a6da37fcd8","resolution":{"observed_at":"2026-08-06T14:57:08.064659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.034539Z","title":null,"venue":null,"work_id":"9e5a4d1d-2e48-460d-b3f2-848088a946b2","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.978251Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:0d0fa4230ddcb238c98d21e7ff5fcd6660ebd6cb5724b3758784e9a4396d59fc","observation_id":"953d708c-93c4-4e7d-a751-82584a7b432c","resolution":{"observed_at":"2026-08-06T14:57:08.046352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:08.013777Z","title":null,"venue":null,"work_id":"614692a6-d9a8-4846-b283-7238ba33a617","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.984262Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:0512362136193adb3db20523b67a53ce052bae996c7a9d2de8141634c81f70d9","observation_id":"f1d46ca2-af28-4f1f-adf7-84060a0c1d79","resolution":{"observed_at":"2026-08-06T14:57:08.020161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.994959Z","title":"every k ticks","venue":null,"work_id":"8d6d9fd8-4fed-49be-8488-f6866b5da350","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.989789Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:8f63bf4f84f8b4ceb2b31c85ecaee05349ff98175cffb6992426175db7588288","observation_id":"ebe7b66b-9a3b-452b-bc7d-ca80c71b002f","resolution":{"observed_at":"2026-08-06T14:57:08.000276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.976177Z","title":"LLMs do not retain information across separate inference instances [ 68, 58]","venue":null,"work_id":"41c44d64-00fb-4638-ba93-0181f233686a","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.996541Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:3fcb08ec3faad3d9ab7d1821dd04e46635cd89185808e13974742731641290c6","observation_id":"d4870296-af78-41d6-b209-2a9057d762d0","resolution":{"observed_at":"2026-08-06T14:57:07.983099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.956788Z","title":"LLM outputs are typically probabilistic [72, 73, 74], meaning the same query can yield varying or even incorrect results on different runs [ 75]","venue":null,"work_id":"65e4f322-f722-4866-9862-b6c33451deae","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:07.002510Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:f4eab112f16942aeb580c81323e16b998165d88f99257f512abfc85b5ce7e25f","observation_id":"53e6b534-a56c-4092-b748-3d901feaa208","resolution":{"observed_at":"2026-08-06T14:57:07.963009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.939268Z","title":null,"venue":null,"work_id":"3fbf4f81-f334-410a-b961-33faad037109","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:07.008612Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:0d44e36d162585cc392b111788a72a7eb7813cf354d4cab5a21d68a1b315e995","observation_id":"1483fa5c-bb67-46e7-84ba-be185531ebd6","resolution":{"observed_at":"2026-08-06T14:57:07.944459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:57:07.920487Z","title":"All interaction with an LLM is text-based: agent definitions, environmental factors, and actions are translated into tokens, which the LLM interprets to produce responses in kind","venue":null,"work_id":"65275893-c2fb-421d-a4a5-b9d0ad6f5828","year":null},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:07.014317Z"},"links":{"citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:c2046f72a483e3433e686e07def427aabb1481da3c02dc30bb3c7b9e7c0c5e13","observation_id":"509b5f59-6a6a-4195-9454-48d853ad1cdb","resolution":{"observed_at":"2026-08-06T14:57:07.926581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity"},"reference_resolution":{"displayed":99,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":65,"verified_exact":5,"verified_fuzzy":27},"total_outbound_references":99},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 99 of 99 outbound references and 1 inbound Pith citation observation for arXiv:2507.17257."}