{"as_of":"2026-08-16T07:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26e4fed2e4f33323d5fba20975393b11eba1a9dd1de0547c573ba66ac248294d","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:18:07.485591Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10042/citation-record","integrity":"/paper/2608.10042/integrity","json":"/paper/2608.10042/citation-record.json","paper":"/paper/2608.10042"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"p/2847291","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:07.874399Z","title":"Tuesday Retail Notes","venue":null,"work_id":"dc6a062b-4604-4a50-91f3-0ad60c55dae3","year":2024},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.440337Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:9773bc1347cafcc8f6c24797dff8993dfa1bc5404d75691c62a80a7c6b37dc1f","observation_id":"a0f803dc-53ec-4aa4-86b0-bd2376cd6061","resolution":{"observed_at":"2026-08-14T04:18:07.934741Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05133","last_updated":"2024-12-09T04:21:08Z","snapshot_observed_at":"2026-08-13T04:25:30.919897Z","submitted_at":"2024-02-06T04:18:58Z","title":"Personalized Language Modeling from Personalized Human Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05133","snapshot_observed_at":"2026-08-14T04:18:06.672677Z","title":"Personalized language modeling from personalized human feedback.arXiv preprint arXiv:2402.05133,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.672677Z"},"links":{"cited_paper":"/paper/2402.05133","citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:dc39b9be0644df01762b95c525d62434147a15908d94668863c04d287d5830e8","observation_id":"db2e51a4-4383-45c8-bf7e-ea8884e0005d","resolution":{"observed_at":"2026-08-14T04:18:06.672677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23815","last_updated":"2025-05-27T20:20:20Z","snapshot_observed_at":"2026-08-11T21:45:27.736328Z","submitted_at":"2025-05-27T20:20:20Z","title":"Aligning LLMs by Predicting Preferences from User Writing Samples","version":1},"cited_work":{"arxiv_id":"2505.23815","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23815","snapshot_observed_at":"2026-08-14T04:18:08.604862Z","title":"Aligning LLMs by Predicting Preferences from User Writing Samples","venue":"cs.CL","work_id":"21ba8358-fc09-4e6c-bd55-724363dbc4cc","year":2025},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.724740Z"},"links":{"cited_paper":"/paper/2505.23815","citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:5bd349866ce6fe642d61d1c510d3342bfebf1737d2c1d6575c36cf230b41e4f9","observation_id":"517e448d-53ec-4278-a7ac-fb773b0f178b","resolution":{"observed_at":"2026-08-14T04:18:08.623168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.855690Z","title":"API-bank: A comprehensive benchmark for tool-augmented LLMs","venue":null,"work_id":"6392d98f-843a-4bde-ab9c-860c8d6adb3b","year":2023},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.774765Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:a17010afcb3ba1eb32adc6a7ccc01901870f0b0d798c30e2baf9bf1549d97eda","observation_id":"a7b0ef19-e581-4183-987f-e346d5b353c1","resolution":{"observed_at":"2026-08-14T04:18:09.874925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06185","last_updated":"2026-02-13T08:55:46Z","snapshot_observed_at":"2026-08-16T04:19:11.855217Z","submitted_at":"2026-02-13T08:55:46Z","title":"Benchmarking LLM Tool-Use in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.06185","snapshot_observed_at":"2026-08-14T04:18:06.864763Z","title":"Benchmarking llm tool-use in the wild.arXiv preprint arXiv:2604.06185,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.864763Z"},"links":{"cited_paper":"/paper/2604.06185","citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:3b536ca92eb598cbcdaf38c5569557c3e875e1a440127dd5796835f343f67350","observation_id":"ad1d714d-76d2-469d-b3a6-25bc860e3ea8","resolution":{"observed_at":"2026-08-14T04:18:06.864763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-14T14:24:18.501413Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-14T04:18:06.914755Z","title":"10 UserToolBench Zidi Xiu, David Q Sun, Kevin Cheng, Maitrik Patel, Yizhe Zhang, Jiarui Lu, Omar Attia, Raviteja Vemulapalli, Oncel Tuzel, Meng Cao, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.914755Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:757c334c06c4cc76cfb9ff888c2469bffbf2971fd356e12d79520e64fa0f840f","observation_id":"1dd23d7c-8bac-4165-8e68-e4205f2b0193","resolution":{"observed_at":"2026-08-14T04:18:06.914755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04072","last_updated":"2025-05-07T02:25:20Z","snapshot_observed_at":"2026-08-15T23:36:15.721619Z","submitted_at":"2025-05-07T02:25:20Z","title":"Advancing and Benchmarking Personalized Tool Invocation for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04072","snapshot_observed_at":"2026-08-14T04:18:06.995679Z","title":"Advancing and benchmarking personalized tool invocation for llms.arXiv preprint arXiv:2505.04072,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.995679Z"},"links":{"cited_paper":"/paper/2505.04072","citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:c75fc94339b0d1f21a41afc351cb4f8b0b710901a75ae312479ec0f8908015aa","observation_id":"c6b40833-3471-441e-8ff9-c6fa643a70ea","resolution":{"observed_at":"2026-08-14T04:18:06.995679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.628017Z","title":"Tool- spectrum: Towards personalized tool utilization for large language models","venue":null,"work_id":"f86274bd-1adb-4fc7-a83f-53ee7f8a14d2","year":2025},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.054748Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:5cafe07aaca8ccbaef84bb253abbb1ed48c344efc44b9241e79d94bf6385f2b4","observation_id":"a72393e1-6011-4523-b149-226db075730a","resolution":{"observed_at":"2026-08-14T04:18:09.655761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.acl-long.370","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:07.754323Z","title":"doi:10.18653/v1/2026.acl-long.370","venue":null,"work_id":"5bfbdcca-9ad6-456c-a09a-b80fc059dbf7","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.084830Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:3b4e543bd8308207854a8856d727b20c360ac0a108c30f5d44823d84f354923c","observation_id":"c3dbc6e2-2c05-4cd2-b0fd-6ffb7a7af9b1","resolution":{"observed_at":"2026-08-14T04:18:07.767881Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:07.135485Z","title":"Fingertip 20k: A benchmark for proactive and personalized mobile llm agents.arXiv preprint arXiv:2507.21071,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.135485Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:e736c9f3d3d725c6e7bfb16795ee83c787bdbdeca8bba7459a940857606796d0","observation_id":"7ee59956-cf73-4f46-b6a2-0b4c852d1d37","resolution":{"observed_at":"2026-08-14T04:18:07.135485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.17003","last_updated":"2026-05-27T12:15:49Z","snapshot_observed_at":"2026-08-14T08:20:02.537376Z","submitted_at":"2026-02-19T01:54:26Z","title":"Persona2Web: Benchmarking Personalized Web Agents for Contextual Reasoning with User History","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.17003","snapshot_observed_at":"2026-08-14T04:18:07.145058Z","title":"Persona2web: Benchmarking personalized web agents for contextual reasoning with user history.arXiv preprint arXiv:2602.17003, 2026a","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.145058Z"},"links":{"cited_paper":"/paper/2602.17003","citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:596484068ffd68c48899f292c45374c979784d7010aa9e3bba8ba80b45aa4341","observation_id":"979fbe54-b07c-42de-b2c6-13e77d830895","resolution":{"observed_at":"2026-08-14T04:18:07.145058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.20162","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:08.390844Z","title":"Me-agent: A personalized mobile agent with two-level user habit learning for enhanced interaction.arXiv preprint arXiv:2601.20162, 2026a","venue":null,"work_id":"79676c36-3926-421c-a530-805776a4ead9","year":2024},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.150631Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:05be9e0d9fda7249542ce2ec517b433e658560a54706524a1a58a4e3601ca755","observation_id":"3d496b7a-8c64-40ac-b6e0-1805b5055a90","resolution":{"observed_at":"2026-08-14T04:18:08.401262Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04569","last_updated":"2025-03-06T16:02:53Z","snapshot_observed_at":"2026-08-07T17:24:19.250461Z","submitted_at":"2025-03-06T16:02:53Z","title":"ValuePilot: A Two-Phase Framework for Value-Driven Decision-Making","version":1},"cited_work":{"arxiv_id":"2503.04569","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.04569","snapshot_observed_at":"2026-08-14T04:18:08.265857Z","title":"ValuePilot: A Two-Phase Framework for Value-Driven Decision-Making","venue":"cs.AI","work_id":"48c4767c-ce25-43c3-88d3-bbca1883a06c","year":2025},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.165600Z"},"links":{"cited_paper":"/paper/2503.04569","citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:5dfc1a3c619f0656417f292e1c84b7e18349ed9f278e7f5ce3d1f8a7ed63d468","observation_id":"f8c2895f-6e01-46f0-a2c0-07fe6acf8e51","resolution":{"observed_at":"2026-08-14T04:18:08.286973Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:07.173493Z","title":"Shopsimulator: Evaluating and exploring rl-driven llm agent for shopping assistants.arXiv preprint arXiv:2601.18225, 2026b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.173493Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:bac329106df34cce17083be49d546b97e3411ca55383211c1d47c908527464ec","observation_id":"68011b94-2c97-44dd-8284-0a887c959a75","resolution":{"observed_at":"2026-08-14T04:18:07.173493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.561654Z","title":"PersonaLLM: Investigating the abil- ity of large language models to express personality traits","venue":null,"work_id":"695820f1-ee6c-4b93-b10c-e556430ca6a2","year":2024},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.186039Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:e8c2ed02e68e7c90d8ab7003ce085c7b4ebe4c71bd32f29304bca7588b136bc6","observation_id":"6932b77f-8bd6-4fed-9041-7eb330819605","resolution":{"observed_at":"2026-08-14T04:18:09.587460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:07.214750Z","title":"URLhttps://aclanthology.org/2024.findings-naacl.229/","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.214750Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:6f3f6168bdc8a92a4a7a983f0eac16a3162c93fd0fa9e2566737a6ced86c1811","observation_id":"5f065543-cae1-4658-a75d-66bf879e6adf","resolution":{"observed_at":"2026-08-14T04:18:07.214750Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.451420Z","title":null,"venue":null,"work_id":"eaf6bd61-0c93-461a-b080-1fef59c7cae1","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.223364Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:80a6037e77c5fd1c98e866bd29a43ae83a67d7086f9fc6d9c92b34ce21fb34bd","observation_id":"368143bb-c301-43a6-96f4-1519c277ccdc","resolution":{"observed_at":"2026-08-14T04:18:09.469404Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.380378Z","title":"Qwen Team","venue":null,"work_id":"50328207-9cbb-4476-a27b-14bcb1177a78","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.231328Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:a7614b5050aaac05d413fc3862f730061f5c96b00bca9133a16c08407978fd1f","observation_id":"8aa8e873-aeb4-409c-8cd7-21377d555d8b","resolution":{"observed_at":"2026-08-14T04:18:09.406526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.307527Z","title":"DeepSeek-AI","venue":null,"work_id":"e7a0ec22-2ec1-468b-8284-76c60a48e051","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.249330Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:0b73911171d0e906d058f4c5ba6779d5398f72c292ab0a566c0670cfd0c3ceb7","observation_id":"3d6bb34a-2c46-4c8a-8d39-3e5595bf4294","resolution":{"observed_at":"2026-08-14T04:18:09.341136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.210651Z","title":"Google DeepMind","venue":null,"work_id":"44864d7b-fdf8-4d6e-91f1-96873e60a53f","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.255437Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:ea4efe31ce19cb4260accb1692edbda49bbd9b5b7b5e0ffaff1dee00500d8886","observation_id":"f026ab4a-d16c-4f84-9b91-b675ac11f5f2","resolution":{"observed_at":"2026-08-14T04:18:09.236384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.077378Z","title":null,"venue":null,"work_id":"cb392fd3-1e25-4836-a5a7-bf3728ea2689","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.261202Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:b47073b49e40c31545a9182d9e923461d38da3ab364455aad11c891b88299eed","observation_id":"a8f7a612-f0fd-4e71-a953-bb34be7ba50a","resolution":{"observed_at":"2026-08-14T04:18:09.104749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:07.268543Z","title":"Qiqiang Lin, Muning Wen, Qiuying Peng, Guanyu Nie, Junwei Liao, Jun Wang, Xiaoyun Mo, Jiamu Zhou, Cheng Cheng, Yin Zhao, et al","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.268543Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:7a87020d609916291db977d523f6dee03425de5bad766ee89e4e1bc3031842ed","observation_id":"f26e52b9-39c8-4f0e-8d05-9a286aaab7e4","resolution":{"observed_at":"2026-08-14T04:18:07.268543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.005638Z","title":"Accessed: 2026-05-25","venue":null,"work_id":"7c19a4be-1c22-4fcc-8dd2-9d202adcbe06","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.287222Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:3ed7c744e9aef9baaa57b524efbb52a38d89260d9416357013401f1ab6c7844f","observation_id":"14769fae-8a0c-44f1-8d5c-1eb8751057c8","resolution":{"observed_at":"2026-08-14T04:18:09.026654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:08.922652Z","title":"co/Team-ACE/ToolACE-2.5-Llama-3.1-8B","venue":null,"work_id":"d9478df2-1375-49d0-8d0d-52c5448283c8","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.296085Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:a8876db63b4f0ca30a86dc4118df98d3bce61d90e9ff3246fd31d06b0ee6ddb6","observation_id":"c47f70df-02f7-498f-823e-b26079cea3a4","resolution":{"observed_at":"2026-08-14T04:18:08.944279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:08.853827Z","title":"Accessed: 2026-05-25","venue":null,"work_id":"240caf89-d823-4521-9894-729748b86802","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.319485Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:43c5670a071e4bfd73d719d2a885f184b05702cf1653b3d905038c224314e56a","observation_id":"105f1510-6014-43e5-a1a1-c0022f71cd55","resolution":{"observed_at":"2026-08-14T04:18:08.869221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14868","last_updated":"2025-02-23T20:00:36Z","snapshot_observed_at":"2026-08-13T14:20:50.241147Z","submitted_at":"2024-06-21T05:13:20Z","title":"Direct Multi-Turn Preference Optimization for Language Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14868","snapshot_observed_at":"2026-08-14T04:18:07.327158Z","title":"Han Luo and Guy Laban","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.327158Z"},"links":{"cited_paper":"/paper/2406.14868","citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:976ee950db1a9dffbe0d879313b19ed191ea86c35db1e07d312b018f0bc93e35","observation_id":"99a4a60f-b52c-4512-8e2c-3f3a6665f622","resolution":{"observed_at":"2026-08-14T04:18:07.327158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.findings-acl.412","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:07.708778Z","title":"URL https://aclanthology.org/2026","venue":null,"work_id":"17571b1b-3d59-4650-9d74-e204b6575cd9","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.359764Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:a05ae605aba493373e565a1133893a8e19e936b58b32f83551a1e8f3fbe538be","observation_id":"06c927ac-55a2-43a5-84b3-8487cd956336","resolution":{"observed_at":"2026-08-14T04:18:07.720918Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.findings-acl.1080","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:07.673707Z","title":"URL https://aclanthology.org/2026.findings-acl.1080/","venue":null,"work_id":"65203551-b100-458a-9d1b-486bc696c570","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.395956Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:394bfbf45e7418a2497b0470a2f9cbf8683215699bf0c5f9d4a6ea1d01e18d9e","observation_id":"32b744bc-020d-46c1-8c25-765f86d01d3a","resolution":{"observed_at":"2026-08-14T04:18:07.689459Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.1146","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:07.539237Z","title":"36Kr GreenLeaf retail rising star","venue":null,"work_id":"8e429493-168a-4022-bba1-e570c625d393","year":2025},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.427066Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:8851aeae66b103cb07b2572c829c61e05ef8c863de13ca67fd2adbadd7b1cfdd","observation_id":"51e3e151-5882-4d0f-bbe5-9ab7da35cd4c","resolution":{"observed_at":"2026-08-14T04:18:07.595153Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:08.802312Z","title":"B.3 Quantitative Persona Diversity Audit We complement the field-coverage analysis with a quantitative audit of the ten selected profiles","venue":null,"work_id":"d766474d-e6a8-46a8-884e-7e12f2b60f72","year":2026},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.458135Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:7dc37b8f06b8ad0b09385f51ef9a6a3abc8112bf4d9ed4e539615e05778b46a8","observation_id":"72c0a1b2-46ad-4482-844b-ef89a96ff2d5","resolution":{"observed_at":"2026-08-14T04:18:08.832172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:08.758772Z","title":"Left: token Jaccard similarity","venue":null,"work_id":"98e28360-9e66-4189-b110-b8cab61ea127","year":2025},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:07.485591Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:d566160dfd93aa611cf6e8514044210eac28f236e93832dff58f4fd95a3af48c","observation_id":"07fe565e-04c8-4585-a2c9-2d88c98ca057","resolution":{"observed_at":"2026-08-14T04:18:08.777001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:06.818994Z","title":"doi:10.18653/v1/2023.emnlp-main.187","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.818994Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:76fb5a214a5b4712c60be00050bea8394733d027d97e9740a4b1ef695ddc2f6e","observation_id":"0f9fa615-9808-413b-88f4-21cf915a913d","resolution":{"observed_at":"2026-08-14T04:18:06.818994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:06.605781Z","title":"Know me, respond to me: Benchmarking llms for dynamic user profiling and personalized responses at scale.arXiv preprint arXiv:2504.14225,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.605781Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:f2cce70ec204f954985bc1225affebb1e014cac9de7a416156208ce1d0931ca8","observation_id":"2f9c32b5-d519-4eb7-9de1-e782eedbb5e4","resolution":{"observed_at":"2026-08-14T04:18:06.605781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.994105Z","title":"Personalens: A benchmark for personalization evaluation in conversational ai assistants","venue":null,"work_id":"7d85ae4b-baa4-404b-a35f-798659b674e8","year":2025},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.644752Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:b5198cb3b8786ac3f11d8f012eed99a56b29c54f08570ba2e128aeeaa9457331","observation_id":"27ae0a1f-ea3c-470c-9f0b-b490c0c9ee14","resolution":{"observed_at":"2026-08-14T04:18:10.014822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:18:09.762352Z","title":"Petoolllm: Towards personalized tool learning in large language models","venue":null,"work_id":"f7dd49bb-3149-42d1-8301-81621b0159d0","year":2025},"citing_paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-14T04:18:06.948152Z"},"links":{"citing_paper":"/paper/2608.10042"},"observation_digest":"sha256:1357dc3a2ed7f86317b89164e7914995664ed6dfd2663f188d4f75c5bce869bd","observation_id":"1ef11c0d-b1c0-41ea-bc04-2227aea61bed","resolution":{"observed_at":"2026-08-14T04:18:09.802674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.10042","last_updated":"2026-08-10T09:32:38Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T23:09:58.468894Z","submitted_at":"2026-08-10T09:32:38Z","title":"UserToolBench: A User-Profile-Hidden Benchmark for Personalized Decision Making in Tool-Use LLMs"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":8,"verified_fuzzy":13},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2608.10042."}