{"as_of":"2026-08-13T10:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5874bf0e6a236d543e0e369a6a01d0df431043a81829962b9b354bc368eae3bd","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:38:20.918941Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.14054/citation-record","integrity":"/paper/2411.14054/integrity","json":"/paper/2411.14054/citation-record.json","paper":"/paper/2411.14054"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.10775","last_updated":"2023-11-15T23:50:31Z","snapshot_observed_at":"2026-08-13T05:24:19.067401Z","submitted_at":"2023-11-15T23:50:31Z","title":"ToolTalk: Evaluating Tool-Usage in a Conversational Setting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10775","snapshot_observed_at":"2026-08-12T15:38:20.871041Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.871041Z"},"links":{"cited_paper":"/paper/2311.10775","citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:1a0be4b0f25fac23dcb0a2899e3143e138e4da70e3f16c03b102c005b0f1c648","observation_id":"8b88f02a-28d4-4705-bb03-43a13809711d","resolution":{"observed_at":"2026-08-12T15:38:20.871041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03128","last_updated":"2024-12-04T19:49:02Z","snapshot_observed_at":"2026-08-13T05:57:17.646090Z","submitted_at":"2023-10-04T19:39:26Z","title":"MetaTool Benchmark for Large Language Models: Deciding Whether to Use Tools and Which to Use","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03128","snapshot_observed_at":"2026-08-12T15:38:20.876271Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.876271Z"},"links":{"cited_paper":"/paper/2310.03128","citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:535ab6fd3f5346001e4197cb0da308a7370cee2b587f6cbc09ee8f4f3ef070db","observation_id":"3e0fd3d7-5ddd-4c39-9843-d7f7858f7ca4","resolution":{"observed_at":"2026-08-12T15:38:20.876271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15334","last_updated":"2023-05-24T16:48:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-24T16:48:11Z","title":"Gorilla: Large Language Model Connected with Massive APIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15334","snapshot_observed_at":"2026-08-12T15:38:20.881031Z","title":"Patil, Tianjun Zhang, Xin Wang, and Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.881031Z"},"links":{"cited_paper":"/paper/2305.15334","citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:338ca0b8d77e539c1c82d95d2ed35ccc4ba5fddd41f5fe597d9a0a90fab96fb7","observation_id":"bfcaea9a-be64-4bdf-9bc6-d15ee9e85ac5","resolution":{"observed_at":"2026-08-12T15:38:20.881031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16789","last_updated":"2023-10-03T14:45:48Z","snapshot_observed_at":"2026-07-06T16:00:46.542753Z","submitted_at":"2023-07-31T15:56:53Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16789","snapshot_observed_at":"2026-08-12T15:38:20.885955Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.885955Z"},"links":{"cited_paper":"/paper/2307.16789","citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:9c3be319ca3bcae5709592c5062107a581c19f3eb6e435ffa0fe489a7b68ea12","observation_id":"7b4d8c60-5ebb-483a-9945-61a445da55ca","resolution":{"observed_at":"2026-08-12T15:38:20.885955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06624","last_updated":"2023-08-27T02:55:36Z","snapshot_observed_at":"2026-08-08T23:18:33.099540Z","submitted_at":"2023-06-11T08:53:12Z","title":"RestGPT: Connecting Large Language Models with Real-World RESTful APIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06624","snapshot_observed_at":"2026-08-12T15:38:20.891029Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.891029Z"},"links":{"cited_paper":"/paper/2306.06624","citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:6863b233011d225cf3e996381b3134049888a5000cf288872f055214e9f0ec39","observation_id":"ab4dce9d-bbf1-4d8b-b56f-de148f173fbd","resolution":{"observed_at":"2026-08-12T15:38:20.891029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:38:20.895903Z","title":"Patil, Ion Stoica, and Joseph E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.895903Z"},"links":{"citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:4b0e80e5d865bbee439f515fccc71b5243eaa6010fd4a00b643ead45e423b164","observation_id":"296309d4-4d6d-424d-b208-bc84d7bbe094","resolution":{"observed_at":"2026-08-12T15:38:20.895903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18752","last_updated":"2023-05-30T05:27:21Z","snapshot_observed_at":"2026-08-06T18:37:20.517203Z","submitted_at":"2023-05-30T05:27:21Z","title":"GPT4Tools: Teaching Large Language Model to Use Tools via Self-instruction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18752","snapshot_observed_at":"2026-08-12T15:38:20.901016Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.901016Z"},"links":{"cited_paper":"/paper/2305.18752","citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:699f0ba9631fe684e06e17665a18d1097dc28a45f5bbfa289607a4f788d3d431","observation_id":"46fb4a9d-0764-42a0-aeaa-32e57d57cd71","resolution":{"observed_at":"2026-08-12T15:38:20.901016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:38:20.905764Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.905764Z"},"links":{"citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:75872806594907aee4a8803a04f0b0397e822937bac58a1890a264e8b97a5818","observation_id":"4c1376c0-8282-488b-816c-c5dcc4622be4","resolution":{"observed_at":"2026-08-12T15:38:20.905764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11206","last_updated":"2023-05-18T17:45:22Z","snapshot_observed_at":"2026-08-08T19:18:06.171048Z","submitted_at":"2023-05-18T17:45:22Z","title":"LIMA: Less Is More for Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11206","snapshot_observed_at":"2026-08-12T15:38:20.909897Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.909897Z"},"links":{"cited_paper":"/paper/2305.11206","citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:0f32395faf0229ac8bdc07ca7891b1efe5d72f49eb5439869c052c4bd25e170e","observation_id":"c294fc4b-e803-4489-9db9-4c65fa238405","resolution":{"observed_at":"2026-08-12T15:38:20.909897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:38:20.914409Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.914409Z"},"links":{"citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:80c29222b93e49f7a25d9ba3517bf0c2c1fed3f137b03ad5153d3b0ffdc28d15","observation_id":"2b310904-5cbe-43c0-a76b-26303395d660","resolution":{"observed_at":"2026-08-12T15:38:20.914409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:38:20.918941Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T15:38:20.918941Z"},"links":{"citing_paper":"/paper/2411.14054"},"observation_digest":"sha256:7ce65102616fd2a53726c8e319fc6efa555af35b95e333d5c3647be9d61c4277","observation_id":"8faea449-b307-4d72-a17c-6e0c95b26e5f","resolution":{"observed_at":"2026-08-12T15:38:20.918941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.14054","last_updated":"2024-11-21T11:59:13Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T15:33:07.016659Z","submitted_at":"2024-11-21T11:59:13Z","title":"FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 0 inbound Pith citation observations for arXiv:2411.14054."}