{"as_of":"2026-08-13T06:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:704325b2adf5cd0bca941b4b348744b719d9be7979d61dfa6b04f505aabdef81","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:21:28.151808Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:12:14.146302Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:12:24.245674Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"cited_work":{"arxiv_id":"2411.16797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16797","snapshot_observed_at":"2026-06-28T17:12:24.245674Z","title":"Amiri-Margavi, I","venue":null,"work_id":"b48ed615-e400-4ed5-b713-4ecd57b74d90","year":2025},"citing_paper":{"arxiv_id":"2506.05425","last_updated":"2026-04-28T02:01:09Z","snapshot_observed_at":"2026-08-11T19:02:35.603239Z","submitted_at":"2025-06-05T05:51:35Z","title":"SIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T11:36:36.687324Z"},"links":{"cited_paper":"/paper/2411.16797","citing_paper":"/paper/2506.05425"},"observation_digest":"sha256:0672b299ffca81449e7e6240da6eb46b16a36af4f42de56f27869c4ddbd1b303","observation_id":"b6c747e7-9df5-4b07-b6d4-2880cad55f2f","resolution":{"observed_at":"2026-05-19T11:37:15.735769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"cited_work":{"arxiv_id":"2411.16797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16797","snapshot_observed_at":"2026-06-28T17:12:24.245674Z","title":"Amiri-Margavi, I","venue":null,"work_id":"b48ed615-e400-4ed5-b713-4ecd57b74d90","year":2025},"citing_paper":{"arxiv_id":"2606.01456","last_updated":"2026-05-31T21:30:43Z","snapshot_observed_at":"2026-08-13T02:21:53.174988Z","submitted_at":"2026-05-31T21:30:43Z","title":"Truthful AI Advisors: A Pre-Specified Benchmark for Large Language Model Honesty Under Preference Misalignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T17:12:14.146302Z"},"links":{"cited_paper":"/paper/2411.16797","citing_paper":"/paper/2606.01456"},"observation_digest":"sha256:8d2b5103b4d76d8d7e4d452e432672cfc88022cd333a76e005777aeeab5d5490","observation_id":"aed2077d-01a0-4a6c-ae0b-56bd1a8115af","resolution":{"observed_at":"2026-06-28T17:12:24.247068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.16797/citation-record","integrity":"/paper/2411.16797/integrity","json":"/paper/2411.16797/citation-record.json","paper":"/paper/2411.16797"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T13:21:28.011334Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.011334Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:1c2d42bf49436bf68f4fe983f15de132fad51e6e89156c84de0c1024efc5f870","observation_id":"95bc0cae-529f-4883-8a40-ca69200b221a","resolution":{"observed_at":"2026-08-12T13:21:28.011334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05194","last_updated":"2025-03-29T17:29:24Z","snapshot_observed_at":"2026-08-12T23:47:38.128180Z","submitted_at":"2024-06-07T18:21:26Z","title":"LLMs Are Not Intelligent Thinkers: Introducing Mathematical Topic Tree Benchmark for Comprehensive Evaluation of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05194","snapshot_observed_at":"2026-08-12T13:21:28.045862Z","title":"Llms are not intelli- gent thinkers: Introducing mathematical topic tree benchmark for comprehensive evaluation of llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.045862Z"},"links":{"cited_paper":"/paper/2406.05194","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:2f004a94188eaa1c289c3af418b4d6d403783fabbe63ae2d1bbac47adea8b10a","observation_id":"a87d9bb1-b8f4-412e-a86e-1c7728b940ef","resolution":{"observed_at":"2026-08-12T13:21:28.045862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-12T13:21:28.057753Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.057753Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:c9fcea60037d59eec1081be808bc6c60a1a7e8b5343395810f2c9cb9fccfa26f","observation_id":"19300bb6-215f-4525-8c1b-dfba43ff98a7","resolution":{"observed_at":"2026-08-12T13:21:28.057753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-12T13:21:28.069139Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.069139Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:43b10de18a88d2bdadf3cd771b7ddba2a446499f0fa7b0ce9cb5b045ec55d514","observation_id":"61f6a845-ddc3-4742-a7ea-4ee0279e2fe5","resolution":{"observed_at":"2026-08-12T13:21:28.069139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.577531Z","title":"Improving fairness in machine learning systems: What do industry practitioners need? In Proceedings of the 2019 CHI conference on human factors in computing systems, pages 1–16,","venue":null,"work_id":"a78a8094-0329-4907-8bba-79e17d9e7096","year":2019},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.074657Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:cb44b7438b4312e72384e4029dc3ad67725aaf6362c6513b551674b2c9ba6938","observation_id":"cae75261-3045-4195-a7a9-874e2055e0ce","resolution":{"observed_at":"2026-08-12T13:21:28.583008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.559057Z","title":"Harnessing the wisdom of crowds in wikipedia: quality through coordination","venue":null,"work_id":"dbca3906-590b-4e06-95b1-12eb57a05ab1","year":2008},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.086707Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:5c628bcfe5c5db0c72435e05032e8df0871694fe16f2860d732153e0e7b1bae9","observation_id":"53caf2f2-4260-4faa-9023-f7f2b949041c","resolution":{"observed_at":"2026-08-12T13:21:28.565545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06089","last_updated":"2024-07-08T16:29:08Z","snapshot_observed_at":"2026-08-12T23:26:36.494761Z","submitted_at":"2024-07-08T16:29:08Z","title":"Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06089","snapshot_observed_at":"2026-08-12T13:21:28.096521Z","title":"Merge, ensemble, and cooperate! a survey on collaborative strategies in the era of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.096521Z"},"links":{"cited_paper":"/paper/2407.06089","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:633582b52a917659e93e04342e208412d68b38f10bf59e300d5f5d9a8c34448a","observation_id":"4e4c0ce4-9ec1-4d48-8447-56aa6fd17594","resolution":{"observed_at":"2026-08-12T13:21:28.096521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T13:21:28.101763Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.101763Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:33f253584d860ac2071327f9687c79ed7d304cf8044011fdc3b50fc71427f9a1","observation_id":"ba4b6d1c-96ff-45b9-b14a-67e25f3d780f","resolution":{"observed_at":"2026-08-12T13:21:28.101763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.542576Z","title":"Brent Mittelstadt","venue":null,"work_id":"bc2336ff-6a2a-4323-ae5b-b1505f77d343","year":2023},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.107527Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:709b550ae00d0f9b0837c48c034de443f9efbe23521aa55f2e7278b9e767e734","observation_id":"27e43cd9-f0eb-4806-acb8-f83fa111fd6c","resolution":{"observed_at":"2026-08-12T13:21:28.547773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.525114Z","title":"Mitigating bias in algorithmic hiring: Evaluating claims and practices","venue":null,"work_id":"03f15a02-4f97-4daa-90b6-59a9be7e66ed","year":2020},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.117355Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:4d12e02c3f5698ff4f1b82f7cb0b38e953c34d8c4a4aa8183c15323aedd7b4fa","observation_id":"34c92536-b659-430a-97b9-ef7c8ab81621","resolution":{"observed_at":"2026-08-12T13:21:28.530508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00280","last_updated":"2024-08-21T05:11:10Z","snapshot_observed_at":"2026-08-11T08:55:36.453514Z","submitted_at":"2023-09-30T07:11:39Z","title":"Corex: Pushing the Boundaries of Complex Reasoning through Multi-Model Collaboration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00280","snapshot_observed_at":"2026-08-12T13:21:28.122091Z","title":"Corex: Pushing the boundaries of complex reasoning through multi-model collaboration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.122091Z"},"links":{"cited_paper":"/paper/2310.00280","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:1fc936e3d9e606e49aeb41a02ddff4b1baff3260c0ea65ab2bdc6b1db35df1cb","observation_id":"503f515d-7c8f-469f-9462-2aea3a1d1f8f","resolution":{"observed_at":"2026-08-12T13:21:28.122091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09085","last_updated":"2022-11-16T18:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-16T18:06:33Z","title":"Galactica: A Large Language Model for Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09085","snapshot_observed_at":"2026-08-12T13:21:28.127021Z","title":"Galactica: A large language model for science","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.127021Z"},"links":{"cited_paper":"/paper/2211.09085","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:6478b4e231f252825c73733e1017d7f99511a6abc2ec80e903f6ae67b26be505","observation_id":"2601fffa-15fa-4834-b521-b3049b48088b","resolution":{"observed_at":"2026-08-12T13:21:28.127021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T13:21:28.131826Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.131826Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:7c437a4c7180fa2ef06cf2d60b03984450a4d32f9119d0c0f5a12d15d70d494c","observation_id":"e6b5a435-7c4b-4712-a09f-a082c53473a9","resolution":{"observed_at":"2026-08-12T13:21:28.131826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T13:21:28.136780Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.136780Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:7158453f2e29f5700f452213c61a2cd214189db979af4923542df63324dd9142","observation_id":"eb19abfe-7bb2-4ca8-933e-5ed0ada9733e","resolution":{"observed_at":"2026-08-12T13:21:28.136780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.508037Z","title":"The collective intelligence of random small crowds: A partial replication of kosinski et al.(2012)","venue":null,"work_id":"2936cba5-692f-4ebb-bc5e-4be7beb3c9c2","year":2012},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.142188Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:193ca7780a6a6c714081719676bf03779f6ea0928752201e2efed4dd3075d58b","observation_id":"54595ea8-8143-4981-a0fb-8dd4dd0d188d","resolution":{"observed_at":"2026-08-12T13:21:28.513679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.488262Z","title":"Deep learn- ing for computer vision: A brief review","venue":null,"work_id":"378928fd-3715-41e0-ac5a-bfd752849d39","year":2018},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.146899Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:4a146c36fb73eff923b3a67094b9d77df48339323422e072df37a5efd3f1bb03","observation_id":"6fe34682-5c77-4a20-96ab-403d2b2a1928","resolution":{"observed_at":"2026-08-12T13:21:28.495559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09606","last_updated":"2025-03-21T04:57:45Z","snapshot_observed_at":"2026-08-13T00:54:04.016167Z","submitted_at":"2024-03-14T17:47:20Z","title":"Large Language Models and Causal Inference in Collaboration: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09606","snapshot_observed_at":"2026-08-12T13:21:28.091534Z","title":"Large language models and causal inference in collaboration: A comprehensive survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.091534Z"},"links":{"cited_paper":"/paper/2403.09606","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:cf9bc721a972362ea3050a8bc19e243f567655ac9f296583012f7795a5c91e8c","observation_id":"12b2009c-b670-415f-9e3a-f3a2d16cb20f","resolution":{"observed_at":"2026-08-12T13:21:28.091534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.01134","last_updated":"2019-12-20T20:03:56Z","snapshot_observed_at":"2026-08-11T13:21:21.534971Z","submitted_at":"2017-11-03T12:54:51Z","title":"Accountability of AI Under the Law: The Role of Explanation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.01134","snapshot_observed_at":"2026-08-12T13:21:28.051711Z","title":"Accountability of ai under the law: The role of explanation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.051711Z"},"links":{"cited_paper":"/paper/1711.01134","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:1fd1462a8f826f665f3562a7c5fa570444ef38d451d927f0f0e9b312fdc9a501","observation_id":"d569f57f-47d3-42e4-8597-0465ff4f3ff7","resolution":{"observed_at":"2026-08-12T13:21:28.051711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12715","last_updated":"2024-05-30T16:59:56Z","snapshot_observed_at":"2026-08-13T00:26:12.431117Z","submitted_at":"2024-04-19T08:52:22Z","title":"Ensemble Learning for Heterogeneous Large Language Models with Deep Parallel Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12715","snapshot_observed_at":"2026-08-12T13:21:28.081674Z","title":"Enabling ensemble learning for heterogeneous large language models with deep parallel collaboration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.081674Z"},"links":{"cited_paper":"/paper/2404.12715","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:e66935540704af91fe35aec9d45c017eea772e6fe948e8326fc521e66a6a4910","observation_id":"0854f7bf-941b-457e-9c80-7013be8bdfc7","resolution":{"observed_at":"2026-08-12T13:21:28.081674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01823","last_updated":"2023-12-04T11:53:56Z","snapshot_observed_at":"2026-08-13T05:10:30.457431Z","submitted_at":"2023-12-04T11:53:56Z","title":"Exchange-of-Thought: Enhancing Large Language Model Capabilities through Cross-Model Communication","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01823","snapshot_observed_at":"2026-08-12T13:21:28.151808Z","title":"Exchange-of-thought: Enhancing large language model capabilities through cross-model communication","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.151808Z"},"links":{"cited_paper":"/paper/2312.01823","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:eaba60fb79409fe2350947be1a236e6816dfc54f59d40a4774b548b64911651d","observation_id":"3c86ee35-6580-4e3e-a5d9-06b33a76a49f","resolution":{"observed_at":"2026-08-12T13:21:28.151808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.028565Z","title":"On the dangers of stochastic parrots: Can language models be too big? In Proceedings of the 2021 ACM conference on fairness, accountability, and transparency, pages 610–623,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.028565Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:9ff3a355f7a0d0e81f0c28bcbc7c1922ab18ff4a2908f2902781105a8f8d4cc4","observation_id":"9d7ca5ef-e005-41ae-b3dc-9c4b0dc066d4","resolution":{"observed_at":"2026-08-12T13:21:28.028565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06535","last_updated":"2024-11-10T17:32:16Z","snapshot_observed_at":"2026-08-12T22:03:53.125213Z","submitted_at":"2024-11-10T17:32:16Z","title":"Probabilistic Consensus through Ensemble Validation: A Framework for LLM Reliability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06535","snapshot_observed_at":"2026-08-12T13:21:28.112281Z","title":"Probabilistic consensus through ensemble validation: A framework for llm reliability","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.112281Z"},"links":{"cited_paper":"/paper/2411.06535","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:522db6534d5b3347e084d2b8c27cface1992261e4e19051353d7b747a3a6071c","observation_id":"f8771898-a9fa-4b81-966d-fd942435a37a","resolution":{"observed_at":"2026-08-12T13:21:28.112281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.08630","last_updated":"2020-12-15T21:39:50Z","snapshot_observed_at":"2026-08-12T15:55:33.437150Z","submitted_at":"2020-12-15T21:39:50Z","title":"Open Problems in Cooperative AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.08630","snapshot_observed_at":"2026-08-12T13:21:28.040010Z","title":"Open problems in cooperative ai","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.040010Z"},"links":{"cited_paper":"/paper/2012.08630","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:ccb1ac05cb987b32e375ee71243bf59cbe0f96a978f5261181ff05ddd72336cf","observation_id":"48530819-7c65-4fbe-ab5d-a983f3184455","resolution":{"observed_at":"2026-08-12T13:21:28.040010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-12T13:21:28.034743Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.034743Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:ec410ac9b69666e89f564915ed5a4668a04769c81c45c94ae42525df3c73b9f4","observation_id":"05d23a2e-e037-42cb-94c6-a462d9c0d66b","resolution":{"observed_at":"2026-08-12T13:21:28.034743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.594491Z","title":"Fairness without demograph- ics in repeated loss minimization","venue":null,"work_id":"a2741d51-e58d-4538-b4bb-330c9ec3340e","year":1929},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.063661Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:f11c2039261f67efa6e96a0ca0e17c39df3525cbb90638ccc7a7dbed0f2ace5a","observation_id":"09915226-6215-4d05-90b2-57f47b6f486b","resolution":{"observed_at":"2026-08-12T13:21:28.599437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00157","last_updated":"2024-09-16T19:20:59Z","snapshot_observed_at":"2026-08-13T04:29:45.408362Z","submitted_at":"2024-01-31T20:26:32Z","title":"Large Language Models for Mathematical Reasoning: Progresses and Challenges","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00157","snapshot_observed_at":"2026-08-12T13:21:28.017481Z","title":"Large language models for mathematical reasoning: Progresses and challenges","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.017481Z"},"links":{"cited_paper":"/paper/2402.00157","citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:1f3375688b37614fb88cb5cd4d8e7f12955509e88c39be4f20ac07f05ebbde0a","observation_id":"6d595faf-8b1c-4b46-bc1c-6a69ebc3f796","resolution":{"observed_at":"2026-08-12T13:21:28.017481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:21:28.621126Z","title":"Anthropic","venue":null,"work_id":"9e2687c8-ccf3-4324-ac4c-f479a8c2f7ba","year":2024},"citing_paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:28.022885Z"},"links":{"citing_paper":"/paper/2411.16797"},"observation_digest":"sha256:d8e0b17d45974b80f49575c7517b1dba635d6321fd9758e2369ebc7b55e74ce3","observation_id":"42229a8a-2355-4e89-9290-239f8a47b5af","resolution":{"observed_at":"2026-08-12T13:21:28.626772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.16797","last_updated":"2025-02-24T00:26:55Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T13:17:34.560189Z","submitted_at":"2024-11-25T10:18:17Z","title":"Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 2 inbound Pith citation observations for arXiv:2411.16797."}