{"as_of":"2026-08-08T18:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:366ccff84dc3fd42ada9b88f634af1fecd6bf25af9072164856c7c70e583ecb8","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:02:47.526084Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:20:33.617934Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00777","snapshot_observed_at":"2026-07-14T11:49:31.595873Z","title":"arXiv preprint arXiv:2506.00777 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10428","last_updated":"2026-07-24T14:32:58Z","snapshot_observed_at":"2026-08-06T10:45:46.606756Z","submitted_at":"2026-07-11T18:22:49Z","title":"Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-14T11:49:31.595873Z"},"links":{"cited_paper":"/paper/2506.00777","citing_paper":"/paper/2607.10428"},"observation_digest":"sha256:3d68ae22dc3e09f5eaada312b884c80dada66eed9bf5395643e72f75946de3c0","observation_id":"b2697847-5dea-482a-82da-5a066fb655a6","resolution":{"observed_at":"2026-07-14T11:49:31.595873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00777","snapshot_observed_at":"2026-08-02T07:20:33.617934Z","title":"arXiv preprint arXiv:2506.00777 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10428","last_updated":"2026-07-24T14:32:58Z","snapshot_observed_at":"2026-08-06T10:45:46.606756Z","submitted_at":"2026-07-11T18:22:49Z","title":"Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T07:20:33.617934Z"},"links":{"cited_paper":"/paper/2506.00777","citing_paper":"/paper/2607.10428"},"observation_digest":"sha256:e91792461f8ff8b4b33b7cff5d5a28e73fddaf8f3d69e4cfc1bbd76274aef789","observation_id":"3d01d9e4-23ce-496d-8e1e-f52f7e92bc81","resolution":{"observed_at":"2026-08-02T07:20:33.617934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00777/citation-record","integrity":"/paper/2506.00777/integrity","json":"/paper/2506.00777/citation-record.json","paper":"/paper/2506.00777"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T12:02:43.279759Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.279759Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:f22738d07224ec2f338807a3794b1d38bb375a8e3953a7685d85543c6254fbe8","observation_id":"cbc6415e-83f8-4705-a460-ea733bb3876e","resolution":{"observed_at":"2026-08-07T12:02:43.279759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:02:43.374841Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.374841Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:e4da540f8814bf81f7421478b0db2a000151c6553a94b06d50abc7299b0771ef","observation_id":"7106c982-2c18-40da-b7fc-c50c17e8645b","resolution":{"observed_at":"2026-08-07T12:02:43.374841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-07T12:02:43.455923Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.455923Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:6cf085a71502aa41904215ace455fcd9bf16d08fadfe255a16d8fdc71289ac92","observation_id":"77d10d3b-a33b-47cb-84f2-7a33f045acd9","resolution":{"observed_at":"2026-08-07T12:02:43.455923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.942654Z","title":null,"venue":null,"work_id":"ed5fb929-37e0-4753-8334-10623c355e51","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.506723Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:6deb236fdbf49b00e4a5c4143cd5f92819887f2cb2bc651b36164f89223cdcd6","observation_id":"c8b80b04-3649-4f7b-a8e1-866fb883057d","resolution":{"observed_at":"2026-08-07T12:02:52.076468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.570013Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.570013Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:033ca853885caa7e7b5ccbe5c447eed194581ae78ccdccb89602d4a32c68a17d","observation_id":"2b483b88-b595-4566-a055-62d9d73d343a","resolution":{"observed_at":"2026-08-07T12:02:43.570013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.667380Z","title":"Do, Yan Xu, and Pascale Fung","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.667380Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:25cb902923f615c3a64b92c98d800b8aa8b1f5015238d5291dd3c0099d5a7cae","observation_id":"ae6a5b49-c271-4d04-bbc5-f107955debdb","resolution":{"observed_at":"2026-08-07T12:02:43.667380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.774395Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.774395Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:12bb72d5b6d1c1179a8fbad4647f73392a9c7c9f1fcc82ee2cb6cfe4ae4f854f","observation_id":"14591c23-b534-4fe1-a311-27e02139c2e3","resolution":{"observed_at":"2026-08-07T12:02:43.774395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14782","last_updated":"2026-05-31T00:04:33Z","snapshot_observed_at":"2026-08-07T18:21:12.072228Z","submitted_at":"2024-05-23T16:50:49Z","title":"Lessons from the Trenches on Reproducible Evaluation of Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14782","snapshot_observed_at":"2026-08-07T12:02:43.811421Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.811421Z"},"links":{"cited_paper":"/paper/2405.14782","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:8d17922563c2a16518413482c08e25ef8f026e371a3c3ade90d987465e8ef8b1","observation_id":"dbe47d2d-c4e9-4e09-94f4-5926e32a1963","resolution":{"observed_at":"2026-08-07T12:02:43.811421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.675784Z","title":null,"venue":null,"work_id":"7dacbd9d-67c5-4fdd-b1ad-acf5fc09bbb2","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.908302Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:31b277f654780c6d80e5b95c3225615eb43308b31eeabf0b73b9ded4bb0197cc","observation_id":"fdc7ff7e-8cd7-4932-bb5f-d44032f25b2e","resolution":{"observed_at":"2026-08-07T12:02:51.799121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00841","last_updated":"2024-04-15T17:56:58Z","snapshot_observed_at":"2026-08-05T06:56:29.086053Z","submitted_at":"2024-02-01T18:31:34Z","title":"Tiny Titans: Can Smaller Large Language Models Punch Above Their Weight in the Real World for Meeting Summarization?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00841","snapshot_observed_at":"2026-08-07T12:02:43.971142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.971142Z"},"links":{"cited_paper":"/paper/2402.00841","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:a63ab11e020f83adbe8a39f2c0898ef86b5c8380b9441fd4454cfa1e76eaa59e","observation_id":"e46f93ed-c5e8-4406-8463-fbfd8a3d8f3f","resolution":{"observed_at":"2026-08-07T12:02:43.971142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.456596Z","title":null,"venue":null,"work_id":"5a17a71b-d6c4-498c-89af-0ba36c7be8ff","year":2020},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.045874Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:d86af22298ebdcd2b733a8c512aa21d629402b290e946c3cf3f2917e11cd9609","observation_id":"6ec81de2-7bac-4235-9bde-7f605eb4f692","resolution":{"observed_at":"2026-08-07T12:02:51.515495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:02:44.092977Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.092977Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:c7802b724b6215f80f92beaba6fe8bc7026f3b9bfbd0a161267e250006d96e41","observation_id":"c16909de-1bcd-45b2-a1ba-703ef69ca796","resolution":{"observed_at":"2026-08-07T12:02:44.092977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T12:02:44.191039Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.191039Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:cf7155f062608a73266c81796ce6c140b38e2fa970f4d1ca77ac1d57e5948bf0","observation_id":"50cf506a-f7c1-4a37-a1bf-2367ccb2b5fb","resolution":{"observed_at":"2026-08-07T12:02:44.191039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-07T12:02:44.278334Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.278334Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:6a52507aaabfbcb67a6c5ec520e0198afba168690f5d7249c213e2e763bf3891","observation_id":"5c4fc371-c7ee-459a-a98d-c2389ef9501d","resolution":{"observed_at":"2026-08-07T12:02:44.278334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.222809Z","title":null,"venue":null,"work_id":"ebeff5ef-0ba4-4c21-b7b1-b97f5e92e620","year":2025},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.343234Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:5830661e2b9fad655afb18a3b18d566201a099dc05cb2690fe162802ffcbe5d4","observation_id":"273682e8-0e02-4749-83a5-286b9146a2da","resolution":{"observed_at":"2026-08-07T12:02:51.337098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.098056Z","title":null,"venue":null,"work_id":"bcad7610-1668-4995-b0d0-6cc0ff897877","year":2013},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.450715Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:aef61a24933e1762c7fde83367b458231260a2e1a0ad1557dfcba63b5194ea51","observation_id":"cbae3a98-ca16-4dd6-bbdd-44dca82ce701","resolution":{"observed_at":"2026-08-07T12:02:51.158245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.886121Z","title":null,"venue":null,"work_id":"ae9e17d4-e18d-4815-a395-d8227a17a47b","year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.579781Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:7aed8850b40d947374d22c8fc6b26a84ba6ed1f2f423c11d5b5ad7439f50f957","observation_id":"318fbf0a-8b9e-46ba-b30e-1bc1ba27c0f1","resolution":{"observed_at":"2026-08-07T12:02:50.973844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.751248Z","title":null,"venue":null,"work_id":"a35ab409-11b6-4b52-b6a0-a6dda599e5e3","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.624950Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:baf0b7c2c6147f0b6f252e1c667e0e643e9a746e3f44b6821b636f532913fe72","observation_id":"0acd8fa1-ae60-42a3-a3ab-4e4fcb1837a8","resolution":{"observed_at":"2026-08-07T12:02:50.819956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.614562Z","title":null,"venue":null,"work_id":"40cf4c26-fc07-49ad-b03b-b614a2f01b34","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.680467Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:382f7f30c6de7535438f60eebe82c177d5bf75b99ede0c8429c74048e80b155d","observation_id":"750697ef-7b14-416b-8c6e-a9e46d38f0a4","resolution":{"observed_at":"2026-08-07T12:02:50.701200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T12:02:44.774585Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.774585Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:0cd96c9eb265494db8d52d3e4b65864e80c9ed4cd1badbbfa0fd8ab2fd652c2a","observation_id":"a37e638d-10f7-4dbd-a7d6-7fc50ad630ae","resolution":{"observed_at":"2026-08-07T12:02:44.774585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:44.846828Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.846828Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:708c761b5f908fa7eb2fcb75705183fcde0802eb8b889dddf6dbd458d3b7fde6","observation_id":"a5c456ea-1544-4d02-b8f0-e6aad9adf624","resolution":{"observed_at":"2026-08-07T12:02:44.846828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.484861Z","title":null,"venue":null,"work_id":"17da4f82-8cd1-4a5e-9b0b-d6bd6eca7bca","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.901982Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:a6da006e8ba289d8c17e122fee433ff5061b0e87b31838ce1cab92cb3a01e89e","observation_id":"9435f877-6007-4322-a81e-c5810a4c9458","resolution":{"observed_at":"2026-08-07T12:02:50.551364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.301306Z","title":null,"venue":null,"work_id":"e7aab3f1-e553-49b8-81fe-ca351d69c447","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.985167Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:78cd26ecaef3f0eb69460e7c588d6154283d73c4210e25e2aaea84515bcd427b","observation_id":"81544950-e252-4a74-9359-af0383cc8fb3","resolution":{"observed_at":"2026-08-07T12:02:50.386188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.171147Z","title":null,"venue":null,"work_id":"66a19d44-3ef5-475f-8bd0-e505a10cfb49","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.060211Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:feb3bb68e5cfcbc044db149e4d2fc1b92d3a929ec04b0a1bfd76f5c2dd093389","observation_id":"26eb1209-bb7b-4000-a877-b69af6dcc843","resolution":{"observed_at":"2026-08-07T12:02:50.234920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.938680Z","title":null,"venue":null,"work_id":"9a1d76c9-09be-49f1-8edf-13e43d3fdf5b","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.123893Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:b55d6146702546cf9a10ccfe5e3b1c53b2b74cde9096e4e65fd3fbb4a20c5979","observation_id":"2560fe2a-3da9-4493-8ab7-659330931aed","resolution":{"observed_at":"2026-08-07T12:02:50.062140Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:45.164069Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.164069Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:e69b444ae3e2085df29f8d905a4a41fb3670f22e6159d9d6dc63a475b55b4f41","observation_id":"298d0589-20bc-4e25-85c1-96296dd9b862","resolution":{"observed_at":"2026-08-07T12:02:45.164069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.775694Z","title":null,"venue":null,"work_id":"8739661b-c4ac-4c17-989e-b2d3b388f961","year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.199548Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:943f2af2cf5d34e298fcd5889c763841067a9295b9ff68f87f27f5fa28a32efa","observation_id":"06bf94d4-9c2f-48d7-9bff-76396c9df471","resolution":{"observed_at":"2026-08-07T12:02:49.844122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08468","last_updated":"2025-07-07T17:58:15Z","snapshot_observed_at":"2026-08-07T15:45:47.147744Z","submitted_at":"2025-05-13T11:50:08Z","title":"Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?","version":2},"cited_work":{"arxiv_id":"2505.08468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.08468","snapshot_observed_at":"2026-08-07T12:02:48.057736Z","title":"Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?","venue":"cs.CL","work_id":"6437a691-7f8a-42f7-bb8d-f85eb7f3d273","year":2025},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.290988Z"},"links":{"cited_paper":"/paper/2505.08468","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:ce38f7c7b14fdc4cf65de39ce4e2f3dd4956eca8cad6cb80ed32d9530f0f8df9","observation_id":"4a2ef83a-53bf-4b90-80a8-e7d056c11299","resolution":{"observed_at":"2026-08-07T12:02:48.093541Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.587652Z","title":null,"venue":null,"work_id":"f6f98c47-005c-43bd-9aa8-2532ab470360","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.386523Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:b37d1b42b0405d5be0ba46957e309cc3c085e6c0459eaa7ddc852f1ac969e4ff","observation_id":"5cadf5ed-49d7-46e9-bd80-4030446042c0","resolution":{"observed_at":"2026-08-07T12:02:49.699229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-08-07T12:02:45.447467Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.447467Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:377e89a881a9b804ba495d823995096d2e5e057ff8b299a3307dc7020aa6b331","observation_id":"aff110c5-0e2c-4e02-a339-daba80ea5fbf","resolution":{"observed_at":"2026-08-07T12:02:45.447467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.404193Z","title":null,"venue":null,"work_id":"792b8986-2039-4618-b573-61539008bbb7","year":2016},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.522250Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:a1232c465c44ebcfa8e1538c5c4253884d1049167642cd993055ccda678e5ab7","observation_id":"83333015-ee06-4a8d-b60c-dfcf78e74003","resolution":{"observed_at":"2026-08-07T12:02:49.488172Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:45.662507Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.662507Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:1e1dbec8cbfd2a5033046b37eb4e8b5735a3346f7b9935825ac322329939b17c","observation_id":"42e80012-10ba-4cc7-8113-db1af6a125ff","resolution":{"observed_at":"2026-08-07T12:02:45.662507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.176279Z","title":null,"venue":null,"work_id":"425f18b5-6028-4648-82df-0bc134930426","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.735422Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:528adecfa373cae7e22d3c5962a8a66927602a797b00149d54324ff299007377","observation_id":"2095bc52-8ce1-4095-8456-d2006553892e","resolution":{"observed_at":"2026-08-07T12:02:49.258384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.976735Z","title":null,"venue":null,"work_id":"422e3983-2df7-444d-832b-792193830465","year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.811541Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:46e6558ed8f931a9af21c453700910351a370591985311e2d8eac6246ba3c43b","observation_id":"92117b81-12ff-469f-8f40-7013e7db6479","resolution":{"observed_at":"2026-08-07T12:02:49.070708Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-07T12:02:45.923985Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.923985Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:383d66eed7f2ddb97ecf57a69180b6098ed00788131fca381a0640d006449b85","observation_id":"ce3edb10-ee22-421e-b374-a70e25b9e77d","resolution":{"observed_at":"2026-08-07T12:02:45.923985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.028316Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.028316Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:be9c8681b29abde7d6c7401ca1946cbc85ab5dd90c097936ab07912dcb0da851","observation_id":"97fa6cba-6fe9-4112-b633-bd51a6587bc9","resolution":{"observed_at":"2026-08-07T12:02:46.028316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.811998Z","title":null,"venue":null,"work_id":"24ee5036-c6d7-4a64-9100-08dbc66c0002","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.066169Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:132c3a386056496bd817d14cc542a7533c561ece235c8d2c4aa2fff575bfe3b0","observation_id":"833e2177-030b-4af2-bc95-7632073d094d","resolution":{"observed_at":"2026-08-07T12:02:48.903055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18416","last_updated":"2024-05-01T17:12:10Z","snapshot_observed_at":"2026-07-06T18:06:49.190172Z","submitted_at":"2024-04-29T04:11:28Z","title":"Capabilities of Gemini Models in Medicine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18416","snapshot_observed_at":"2026-08-07T12:02:46.105692Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.105692Z"},"links":{"cited_paper":"/paper/2404.18416","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:5dde64b6605529f5730d21851b61fcc0bee18d9f1a9cf50ebd050f893d5629d7","observation_id":"26328e55-814b-46e0-b17c-7f2f17807602","resolution":{"observed_at":"2026-08-07T12:02:46.105692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.631033Z","title":null,"venue":null,"work_id":"8745b42a-5d5a-447b-b140-6cca8f4a3797","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.175013Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:b433bfe06651db0db289e31825b919c025e0b01ec8582cbdfac6a4269f16dc3b","observation_id":"e1eb2724-5824-4238-ae81-2151f47b44b0","resolution":{"observed_at":"2026-08-07T12:02:48.696990Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T12:02:46.272794Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.272794Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:e517d01f263c8af08fa5e1f4726b22fc1c81e37c1b00944bd230592152b9e3a5","observation_id":"a1c00059-8291-4ba1-8775-412fa7dbda72","resolution":{"observed_at":"2026-08-07T12:02:46.272794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.473916Z","title":null,"venue":null,"work_id":"3e65b9c5-d014-4aa8-8463-8537543d487b","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.351173Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:ca5ccd01470c3707284b391aaef2f7150c51772b06cb87e9a1d447e9890f6ff2","observation_id":"ae4979be-f501-4ceb-9281-b6eb49557a47","resolution":{"observed_at":"2026-08-07T12:02:48.559413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T12:02:46.447687Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.447687Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:44154845fe7ebd47c26fc6c1f4ca53c7cb4bbf22c5e4709ae24a86ddcecc8d92","observation_id":"314fb2e5-19f0-4af3-9c87-50d91fa7f7fd","resolution":{"observed_at":"2026-08-07T12:02:46.447687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:02:46.559562Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.559562Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:a4d0aa37ae8c9dd750d2ba58b29dd9489ea8080efe7a372781c1030dfb2aeeed","observation_id":"e742cba8-03c6-46fa-b04f-7a509c554f3c","resolution":{"observed_at":"2026-08-07T12:02:46.559562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.635872Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.635872Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:b3da3bbc20a1fa302116d332602294e14ba89a5c91f921aa80d87bf4fe44cb6f","observation_id":"68bca6ec-97b6-4e23-84de-f71a635099d1","resolution":{"observed_at":"2026-08-07T12:02:46.635872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.689377Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.689377Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:94a55ca6065a98ce57e3b7f6175608511fe65b5f09fe8f3f7bacfd86436abb8b","observation_id":"a894cab8-c0f5-4d16-a157-c7161b72cab6","resolution":{"observed_at":"2026-08-07T12:02:46.689377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.40","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.691068Z","title":null,"venue":null,"work_id":"0ad8ee83-3650-4be2-81a9-465f296158bb","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.767706Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:9344c8025127779d29ca8879c363779aaf1150d4a8b838a17485e5c6151975b2","observation_id":"4663eb2b-2686-445f-a5d7-a8a7b0df7032","resolution":{"observed_at":"2026-08-07T12:02:47.762727Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T12:02:46.842724Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.842724Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:3e2d6b9c4e5c5863e80e7a196b8be82da7726960872da5c88684835209129e5c","observation_id":"30c32547-5fa8-4a28-bec9-fa48dd432be1","resolution":{"observed_at":"2026-08-07T12:02:46.842724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:02:46.912360Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.912360Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:bd2e77f4c28b4d9b0ab76d26de9838bd0721cf63647c7567c9524d3611edd97a","observation_id":"95adc132-2783-4092-a826-74124f853fc3","resolution":{"observed_at":"2026-08-07T12:02:46.912360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T12:02:47.010722Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.010722Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:889c1ee52e533c0d641f2ef6755821ddf2526fc254aa7baa5b9061565cadd862","observation_id":"58ebfe33-87a9-4cf2-acb7-27659c5495b8","resolution":{"observed_at":"2026-08-07T12:02:47.010722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.084587Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.084587Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:f5af7b44abd2398b7d0d76c9468d058533d963c99ddf3cd12361d10e1a5e2790","observation_id":"04287b94-8cbe-4d13-a478-4cbb1f7b122d","resolution":{"observed_at":"2026-08-07T12:02:47.084587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T12:02:47.192473Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.192473Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:b126a3401aa5fe19db82a50e79ba0a919191633ec907b1e0adef48ea92a2b6ca","observation_id":"82a3b566-caff-4747-837c-9698baec91c2","resolution":{"observed_at":"2026-08-07T12:02:47.192473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.241849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.241849Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:95104450eb254fe29b2c049044c14c0b016a289767db9ec91a68b66d3bb0e380","observation_id":"b3160186-47ab-43f5-aa75-3981d65cb121","resolution":{"observed_at":"2026-08-07T12:02:47.241849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.284617Z","title":null,"venue":null,"work_id":"f0715aff-d948-4d2a-a6e4-606f697cf018","year":2021},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.356554Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:316f4681606efe7309780503d2cbc73e199f13e6e3d6c584c2e181053d5b448e","observation_id":"29b03e43-fffa-4182-a8a2-54e8643a8ea0","resolution":{"observed_at":"2026-08-07T12:02:48.359311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.459081Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.459081Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:0e317004038567c310e7e9a4bc9d3f0563a5b42ae319726f60a21c670a1f83f7","observation_id":"fa99093f-eff0-48e5-8bd8-ad20e2821bd3","resolution":{"observed_at":"2026-08-07T12:02:47.459081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.526084Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.526084Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:6204edd5cb7316191ee409be48ca8e675938263ea64d5b62710c5c79cfa26f60","observation_id":"65b484b4-22af-470f-9f3e-ec5db528a1a3","resolution":{"observed_at":"2026-08-07T12:02:47.526084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:55:52.371442Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 2 inbound Pith citation observations for arXiv:2506.00777."}