{"as_of":"2026-08-08T04:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7030183b939a548030ba2882c893d2d2b515d30526b6e8ce370f902e6e5c0ea1","coverage":[{"denominator":10,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T19:13:30.613413Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:39:13.428111Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T16:58:43.698040Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"cited_work":{"arxiv_id":"2603.03205","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.03205","snapshot_observed_at":"2026-07-03T16:58:43.698040Z","title":"Learning when to act or refuse: Guarding agentic reasoning models for safe multi-step tool use","venue":"cs.CL","work_id":"38d4c3be-524b-42c7-b339-3f35c6cb9fb0","year":2026},"citing_paper":{"arxiv_id":"2605.17453","last_updated":"2026-05-17T13:51:34Z","snapshot_observed_at":"2026-08-02T00:37:59.573957Z","submitted_at":"2026-05-17T13:51:34Z","title":"Trust No Tool: Evaluating and Defending LLM Agents under Untrusted Tool Feedback","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T23:26:15.658106Z"},"links":{"cited_paper":"/paper/2603.03205","citing_paper":"/paper/2605.17453"},"observation_digest":"sha256:b3c1fd5e242354c4ce6739a1cfbe2ad1237f1919bef8aba5a00e5d32b4f0fc80","observation_id":"395601be-1313-4331-a841-dddd7408b4f5","resolution":{"observed_at":"2026-06-04T02:07:11.549850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"cited_work":{"arxiv_id":"2603.03205","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.03205","snapshot_observed_at":"2026-07-03T16:58:43.698040Z","title":"Learning when to act or refuse: Guarding agentic reasoning models for safe multi-step tool use","venue":"cs.CL","work_id":"38d4c3be-524b-42c7-b339-3f35c6cb9fb0","year":2026},"citing_paper":{"arxiv_id":"2606.20683","last_updated":"2026-06-14T05:40:16Z","snapshot_observed_at":"2026-07-30T16:44:18.366904Z","submitted_at":"2026-06-14T05:40:16Z","title":"From Question Answering to Task Completion: A Survey on Agent System and Harness Design","version":1},"reference_index":176,"source":"pdf_text","source_observed_at":"2026-06-27T04:40:30.985824Z"},"links":{"cited_paper":"/paper/2603.03205","citing_paper":"/paper/2606.20683"},"observation_digest":"sha256:eb9da620a59866bd39d40af410aa4804a174f7df56db9c7399a58644e0cb4643","observation_id":"7428cdc3-7bc4-4140-a5f2-510b2f601230","resolution":{"observed_at":"2026-07-03T16:58:43.699693Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.03205","snapshot_observed_at":"2026-08-06T00:39:13.428111Z","title":"Agarwal, G","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01050","last_updated":"2026-08-02T07:32:49Z","snapshot_observed_at":"2026-08-07T14:23:15.308746Z","submitted_at":"2026-08-02T07:32:49Z","title":"Don't Offer What Can't Be Done: Deterministic Executability Gating for LLM Skill Selection at Scale","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:39:13.428111Z"},"links":{"cited_paper":"/paper/2603.03205","citing_paper":"/paper/2608.01050"},"observation_digest":"sha256:1ac42431ed175e8f7f6dd44fa569172911690c78b962c7ab90eb87cece770512","observation_id":"4265f210-c9c7-4901-bab7-8e3a5bbc57ed","resolution":{"observed_at":"2026-08-06T00:39:13.428111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.03205/citation-record","integrity":"/paper/2603.03205/integrity","json":"/paper/2603.03205/citation-record.json","paper":"/paper/2603.03205"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T19:13:28.958381Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:28.958381Z"},"links":{"citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:0bf81451301a0cd82421561200880ac9548cdfaa3f133fa3c55a4d83cd3c7f92","observation_id":"f23738fe-33c0-4cff-b07f-34e4f42d4eb3","resolution":{"observed_at":"2026-08-02T19:13:28.958381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T19:13:29.086757Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:29.086757Z"},"links":{"citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:f517507443ee2881064d8e5702907e204bd624f49c7b52a7133ea29fc5114805","observation_id":"0911f224-96c9-4521-92a4-5d53ad35fe59","resolution":{"observed_at":"2026-08-02T19:13:29.086757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T19:13:29.225323Z","title":"Donald Drewski","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:29.225323Z"},"links":{"citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:0789545109df706084460afa39683478e3c7781271c83a8fa92bad5a2b6a65e7","observation_id":"d274d1b5-ff10-4cb9-a4a3-e31bc35a5485","resolution":{"observed_at":"2026-08-02T19:13:29.225323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T19:13:29.547779Z","title":"</safety thoughts> if required to evaluate and reason about potential risks, safety, legality, and ethical implications","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:29.547779Z"},"links":{"citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:01a638543f03e8b20b3d5c385905882c51110ec4f80e7721b781f4a14dff4352","observation_id":"d5baa7df-fb59-4a51-80ed-8d5122e2c5ef","resolution":{"observed_at":"2026-08-02T19:13:29.547779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T19:13:30.083801Z","title":"name”: “refuse unsafe task","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:30.083801Z"},"links":{"citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:df0d21494a3f6bd61ecaee814f9c7d28fc7dcf66dfdd9aae96324659fe4ac6e0","observation_id":"7fe3dfa4-9e65-44c5-8dfe-46910c32f223","resolution":{"observed_at":"2026-08-02T19:13:30.083801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T19:13:30.233647Z","title":"</think> tags to plan or analyze the task at the start of a turn","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:30.233647Z"},"links":{"citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:6ebcac7c2dd572477a0f031b1b0408c9a1250f666ec4ec50fc5a88ec2a79d6bb","observation_id":"305d3cce-6c0c-4591-b6ed-d4be52e08e18","resolution":{"observed_at":"2026-08-02T19:13:30.233647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T19:13:30.361433Z","title":"name”: “function name","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:30.361433Z"},"links":{"citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:0983966d8e2a49787c82c70a6a40c4016c448d34ddafd6a2598f71e8ed321c45","observation_id":"757d9b41-1823-4492-8d45-dc4eaab71103","resolution":{"observed_at":"2026-08-02T19:13:30.361433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T19:13:30.488711Z","title":"</tool response>, which will be provided by the user","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:30.488711Z"},"links":{"citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:068bcadf86456b6a0407bd1494b634c8869135a521608d91585f6db2a0b9bb0d","observation_id":"cc79bbeb-6520-426f-b721-3b82c650f001","resolution":{"observed_at":"2026-08-02T19:13:30.488711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T19:13:30.613413Z","title":"name”: “refuse unsafe task","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:30.613413Z"},"links":{"citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:36838fbc96cd24c24e50fe4beee3b3359216226fffa521e4d94a51365c7609ae","observation_id":"5f64f239-fd25-48f2-8554-f43d4524ffed","resolution":{"observed_at":"2026-08-02T19:13:30.613413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-01T15:25:40.421582Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08181","snapshot_observed_at":"2026-08-02T19:13:28.853540Z","title":"Please review supplier data for supplier ID 8374928 to maintain competitive integrity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T19:13:28.853540Z"},"links":{"cited_paper":"/paper/2411.08181","citing_paper":"/paper/2603.03205"},"observation_digest":"sha256:db746d1202ceebd356fe7b9d8ac8ada344e6d1f5873a9b7b1b99246fcb5aa9c7","observation_id":"f535833d-7053-401e-89a0-25179ad8250c","resolution":{"observed_at":"2026-08-02T19:13:28.853540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.03205","last_updated":"2026-06-03T04:25:24Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T19:13:27.903054Z","submitted_at":"2026-03-03T17:59:35Z","title":"Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use"},"reference_resolution":{"displayed":10,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":10},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 10 of 10 outbound references and 3 inbound Pith citation observations for arXiv:2603.03205."}