{"as_of":"2026-08-08T09:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bcc0e03909d076adf8564429a2644edce1c4644d50bce2c2147df555abc328a7","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:39:49.370355Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T18:50:22.827472Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T18:57:31.620329Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"cited_work":{"arxiv_id":"2505.18283","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18283","snapshot_observed_at":"2026-07-10T18:57:31.620329Z","title":"TAGS: A test-time generalist-specialist framework with retrieval- augmented reasoning and verification","venue":"cs.CL","work_id":"3c4bb8dc-4540-44df-add6-f776a7a3da2f","year":2025},"citing_paper":{"arxiv_id":"2604.06262","last_updated":"2026-04-07T01:59:40Z","snapshot_observed_at":"2026-07-06T22:54:48.916799Z","submitted_at":"2026-04-07T01:59:40Z","title":"From Exposure to Internalization: Dual-Stream Calibration for In-context Clinical Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T19:19:15.053725Z"},"links":{"cited_paper":"/paper/2505.18283","citing_paper":"/paper/2604.06262"},"observation_digest":"sha256:cced3f0362756d11f063e5fdcd19a9dafc3c05f3b4dfecd86b70877fdca4544a","observation_id":"113a3da9-53f7-4a8f-a59d-cb96cbb320af","resolution":{"observed_at":"2026-05-10T23:10:50.329356Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"cited_work":{"arxiv_id":"2505.18283","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18283","snapshot_observed_at":"2026-07-10T18:57:31.620329Z","title":"TAGS: A test-time generalist-specialist framework with retrieval- augmented reasoning and verification","venue":"cs.CL","work_id":"3c4bb8dc-4540-44df-add6-f776a7a3da2f","year":2025},"citing_paper":{"arxiv_id":"2607.07761","last_updated":"2026-07-08T15:19:37Z","snapshot_observed_at":"2026-08-06T23:41:57.869470Z","submitted_at":"2026-07-08T15:19:37Z","title":"Aligning Clinical Needs and AI Capabilities: A Survey on LLMs for Medical Reasoning","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-07-10T18:50:22.827472Z"},"links":{"cited_paper":"/paper/2505.18283","citing_paper":"/paper/2607.07761"},"observation_digest":"sha256:2179fc394cd5ed6c9f63a4c745e4aebe79f5ee1b75e6ffe3c25b8cc0e9e10887","observation_id":"448cbf72-d997-407d-8406-1bf0d6a28624","resolution":{"observed_at":"2026-07-10T18:57:31.621654Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.18283/citation-record","integrity":"/paper/2505.18283/integrity","json":"/paper/2505.18283/citation-record.json","paper":"/paper/2505.18283"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:44.322049Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:44.322049Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:e9d1e4b45aa146775195147eea5bc0d43af0e38768231a5b43d1e49512eb64be","observation_id":"2f73bb8f-3d7e-4fa1-8d57-23529f2171cf","resolution":{"observed_at":"2026-08-07T14:39:44.322049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:44.460019Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:44.460019Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:a64c111578cea1d617d17136e4432a480519e00b601c43736328f0db70adcf10","observation_id":"3ae16b90-353c-4a3f-a9e9-3fea9710b9f6","resolution":{"observed_at":"2026-08-07T14:39:44.460019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-07T14:39:44.559359Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:44.559359Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:4469bc9253404575b0ad86990cf239324ba86c8cd2f2dbf3e16c797184b69a64","observation_id":"21a4b734-9daa-45f6-b5f1-866427088c6b","resolution":{"observed_at":"2026-08-07T14:39:44.559359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:44.638925Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:44.638925Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:4e950bc4852c953982545803b8a12c8e7c48e6144f91446b0565c17f421feb1a","observation_id":"fe043fed-6d4e-4b20-9ebf-a38561fb0fa8","resolution":{"observed_at":"2026-08-07T14:39:44.638925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:44.786017Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:44.786017Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:32177783ba5442796799103d12e7f00be0962ca87de659dfd6ed26a0337f176a","observation_id":"63aaee76-9b48-46ab-893e-dbb492a53faf","resolution":{"observed_at":"2026-08-07T14:39:44.786017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:52.209913Z","title":null,"venue":null,"work_id":"852eab09-2cc1-4b04-970a-451510011aa9","year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:44.925100Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:46833512ebe97be72917007fc7d2f15f08698f6a4c23449e692e90179725cf91","observation_id":"942743cf-2dcf-4d60-b196-3e565c3df8c7","resolution":{"observed_at":"2026-08-07T14:39:52.254951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-07T14:39:45.017583Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:45.017583Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:2e0151be8fcc7f117b85fbe41c5261426142ad0926e04a61d4fb919cc5c499ef","observation_id":"b8a1addd-284d-4cfb-a11d-baecfdd7cd1d","resolution":{"observed_at":"2026-08-07T14:39:45.017583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13856","last_updated":"2025-03-18T03:07:34Z","snapshot_observed_at":"2026-08-07T16:56:06.699251Z","submitted_at":"2025-03-18T03:07:34Z","title":"MDTeamGPT: A Self-Evolving LLM-based Multi-Agent Framework for Multi-Disciplinary Team Medical Consultation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13856","snapshot_observed_at":"2026-08-07T14:39:45.138255Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:45.138255Z"},"links":{"cited_paper":"/paper/2503.13856","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:1f668e254db5891e08092e69a6cda23af24594721b1ff7a35aa2c5c34af090fd","observation_id":"da4f60f5-afce-4385-b2f4-dcc0e8c60890","resolution":{"observed_at":"2026-08-07T14:39:45.138255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:52.066464Z","title":null,"venue":null,"work_id":"b74f1b7d-5e61-4ebd-8532-7b9b73c47fbd","year":2023},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:45.269648Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:b342f68f04cc95d6f6d02d7872bc48353d628ef204f912a540b8233e7a3394c3","observation_id":"6d4c33b4-1038-4301-afdc-a02cae6a6a49","resolution":{"observed_at":"2026-08-07T14:39:52.155047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16326","last_updated":"2025-04-25T22:22:45Z","snapshot_observed_at":"2026-07-06T15:33:31.386787Z","submitted_at":"2023-05-10T13:40:06Z","title":"Benchmarking large language models for biomedical natural language processing applications and recommendations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16326","snapshot_observed_at":"2026-08-07T14:39:45.400320Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:45.400320Z"},"links":{"cited_paper":"/paper/2305.16326","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:fa00a450fad8fc28d8ddc59f8ac595ab03630f97ef1139423d8686f70d3c6792","observation_id":"249da77e-0f45-467f-b066-d7c2c5120461","resolution":{"observed_at":"2026-08-07T14:39:45.400320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:51.964426Z","title":null,"venue":null,"work_id":"2cd81f9f-6f8e-4d75-a184-654d4b807101","year":2025},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:45.535806Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:4e9e856c1c6d7f5f83735ecf7d815f01a03d67b394045f12efcc76735bfa8c02","observation_id":"9b65e5ac-ff94-46be-968b-5dde8bd0b31a","resolution":{"observed_at":"2026-08-07T14:39:52.009053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:51.822019Z","title":null,"venue":null,"work_id":"c6a3d46c-5a9f-4acc-86cd-e621f7e936d6","year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:45.689093Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:8fc338459945d9f8f89d6cf62f7ebf3a11ad9201c7b212e8de74041c15faf4ac","observation_id":"5f68023d-1bd2-4f88-928f-59529407afa4","resolution":{"observed_at":"2026-08-07T14:39:51.920378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:51.707448Z","title":null,"venue":null,"work_id":"145c62f6-0866-4e9f-a1e7-fef569224777","year":2025},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:45.906522Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:866f5784d100e7115f3b6a5aeb4995675c183979726258174238f03be6e124e7","observation_id":"e81a526e-57ad-4f8e-954d-f39c7d852f90","resolution":{"observed_at":"2026-08-07T14:39:51.730005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:51.585147Z","title":null,"venue":null,"work_id":"cabece85-f4ef-46b2-acb9-79d674e7374f","year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.053906Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:74eee7ef5285e9ae9259c2b0f623b1136d725ca9f9d36d18be443338dbf55e18","observation_id":"386dbe0d-985a-4c64-9aaa-e340193ae1d1","resolution":{"observed_at":"2026-08-07T14:39:51.668951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:39:46.142143Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.142143Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:dedf68c86e6d6bf1e22613d01f70a7284482de05783e2242905db96c7349b967","observation_id":"90e707ba-f045-4746-8d19-f043067e5ed4","resolution":{"observed_at":"2026-08-07T14:39:46.142143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:51.421912Z","title":null,"venue":null,"work_id":"ea4bcc05-d82f-4b7f-bfdd-0f2d4d59fa6b","year":2025},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.246287Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:5de3c0259a35e2244d9639dd94ba2d2b6ffcfaf26c2a647921313f4a112668d8","observation_id":"f5484c77-4572-4a40-9a0d-4c83930dbf85","resolution":{"observed_at":"2026-08-07T14:39:51.531922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T14:39:46.362789Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.362789Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:c4fb5040ae6fbb1ee11816bb30a7372760c8692f11189303689673cd8bd3f641","observation_id":"824c08a5-775b-428c-a549-0d39153fa996","resolution":{"observed_at":"2026-08-07T14:39:46.362789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:46.479007Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.479007Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:bd548715445c813302a3c3faddd1b47479d176eb73e78c587e504f26ed23db5c","observation_id":"181ab6fa-4f83-4e78-bcc5-2e208dae63b1","resolution":{"observed_at":"2026-08-07T14:39:46.479007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:51.261693Z","title":null,"venue":null,"work_id":"ad072213-e000-48e8-a611-272ebc90437e","year":2021},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.555425Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:d4fe5f0cb996eadef0fa7054245e43967f978dbdccc7afc90a57b6d5de17b700","observation_id":"aca5fd47-5e01-4b2a-a502-a1dc77d1427b","resolution":{"observed_at":"2026-08-07T14:39:51.319749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06146","last_updated":"2019-09-13T11:18:20Z","snapshot_observed_at":"2026-07-06T08:21:28.880621Z","submitted_at":"2019-09-13T11:18:20Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06146","snapshot_observed_at":"2026-08-07T14:39:46.648166Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.648166Z"},"links":{"cited_paper":"/paper/1909.06146","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:fc2d59ec9b1c5fc94b396fe7e2ee8d5aa120fb3204809d290a48ac8720375068","observation_id":"78bf0e05-106e-46d8-8325-2f3dceeb2182","resolution":{"observed_at":"2026-08-07T14:39:46.648166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:46.741080Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.741080Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:bc9b9560a30921956ab8100926660bd9dfc97ead4c56275b11aa8c58ca5017d1","observation_id":"ada70a8a-467a-4cf3-a43a-17b04ff5f96d","resolution":{"observed_at":"2026-08-07T14:39:46.741080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15155","last_updated":"2024-10-30T02:32:43Z","snapshot_observed_at":"2026-08-08T01:58:32.346151Z","submitted_at":"2024-04-22T06:30:05Z","title":"MDAgents: An Adaptive Collaboration of LLMs for Medical Decision-Making","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15155","snapshot_observed_at":"2026-08-07T14:39:46.820023Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.820023Z"},"links":{"cited_paper":"/paper/2404.15155","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:10f14f04096e9f113c8c6f49a9785ccf01b2d67d2d231a886b92789a7e3af4ad","observation_id":"1c69ee2b-904b-4148-bb64-57f885fa4305","resolution":{"observed_at":"2026-08-07T14:39:46.820023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-08-07T14:39:46.910566Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:46.910566Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:be3476159fa00c135c187fa96c260b9c1a242bef9b55245382075b37b2cd86df","observation_id":"8331722b-b271-4f08-baaf-bc7ae2e6c368","resolution":{"observed_at":"2026-08-07T14:39:46.910566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:47.011883Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.011883Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:688707d4c2bdf802737914d7e5af29683cffa253183da130f868e568da8bf554","observation_id":"db838377-383b-4a05-8232-8565ab43a346","resolution":{"observed_at":"2026-08-07T14:39:47.011883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13736","last_updated":"2024-12-18T11:14:02Z","snapshot_observed_at":"2026-07-06T20:09:10.465980Z","submitted_at":"2024-12-18T11:14:02Z","title":"MedCoT: Medical Chain of Thought via Hierarchical Expert","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13736","snapshot_observed_at":"2026-08-07T14:39:47.103067Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.103067Z"},"links":{"cited_paper":"/paper/2412.13736","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:e0d81ce1e9cdf360d4ac32c0a90829a790b1cc2a61c5652862597543d19b7a49","observation_id":"093c8aad-51ea-4e4a-aca4-d07cecdb0241","resolution":{"observed_at":"2026-08-07T14:39:47.103067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:51.073523Z","title":null,"venue":null,"work_id":"dc3e73f9-e58c-41cf-9ef2-ba0e87dd9f72","year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.194576Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:2967830cff7a4a8884eeaa16fe4f0dc3c7578a2ceeaac57f5b1da02673117fa9","observation_id":"7d604ea5-f51a-4787-9f7a-fab062766f97","resolution":{"observed_at":"2026-08-07T14:39:51.193200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:50.932203Z","title":null,"venue":null,"work_id":"e6049cf3-e227-47a3-b81e-a5b3d67a46b8","year":2022},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.315314Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:4811d5c57a974bb81006a00b3cc9f60440258e1b3efde151cb3e5512e6bee7b6","observation_id":"6a8e3ab5-34e8-43fe-93cc-a45c2f885d5c","resolution":{"observed_at":"2026-08-07T14:39:51.004053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:50.781701Z","title":null,"venue":null,"work_id":"fe5cf5a6-7899-4ef0-b1a6-11a5f33fd9ed","year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.422407Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:289a726e4c13574bc503f9dd5fa8f291466ed33d8acd01c6dd523025262ed729","observation_id":"0a9a6a79-70b8-4ee1-9aaf-3c9ce23c9e92","resolution":{"observed_at":"2026-08-07T14:39:50.850827Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:47.513897Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.513897Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:0e28dc26cb0d0d4babd7e545e5e4a1010afe78d241e37e4113689f99f5522502","observation_id":"0b6ef4a1-f910-4134-9b8d-b9a4236c0e50","resolution":{"observed_at":"2026-08-07T14:39:47.513897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12652","last_updated":"2023-05-24T05:08:07Z","snapshot_observed_at":"2026-08-02T02:08:12.414817Z","submitted_at":"2023-01-30T04:18:09Z","title":"REPLUG: Retrieval-Augmented Black-Box Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12652","snapshot_observed_at":"2026-08-07T14:39:47.653241Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.653241Z"},"links":{"cited_paper":"/paper/2301.12652","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:04040e9569c2db9081225aab887061c731006a813060c2ef251e733f36d50916","observation_id":"177ceed9-f036-4696-adb8-0db06fdb4e9e","resolution":{"observed_at":"2026-08-07T14:39:47.653241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03000","last_updated":"2024-10-04T06:31:47Z","snapshot_observed_at":"2026-07-06T18:10:03.525924Z","submitted_at":"2024-05-05T17:06:31Z","title":"MedAdapter: Efficient Test-Time Adaptation of Large Language Models towards Medical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03000","snapshot_observed_at":"2026-08-07T14:39:47.740780Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.740780Z"},"links":{"cited_paper":"/paper/2405.03000","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:fd2984f41d753693e7c6252a22d7ebb8a797c8325d940187ab192ca9b639111c","observation_id":"fa292c60-3a3b-49a1-ac78-179118869009","resolution":{"observed_at":"2026-08-07T14:39:47.740780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:47.813907Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.813907Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:72ab269bbc2fa369ee49da1838d526ff1b6cb4093e53324dd74a247312ccff8a","observation_id":"c9d297e5-5944-404c-aee6-93fde28c275b","resolution":{"observed_at":"2026-08-07T14:39:47.813907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07459","last_updated":"2026-06-16T17:07:03Z","snapshot_observed_at":"2026-08-07T17:16:21.851580Z","submitted_at":"2025-03-10T15:38:44Z","title":"MedicalAgentsBench for Complex Medical Reasoning: Comparing Internalized Reasoning Models versus Externalized Agent-based Frameworks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07459","snapshot_observed_at":"2026-08-07T14:39:47.899711Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.899711Z"},"links":{"cited_paper":"/paper/2503.07459","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:dcf5153154323f749c023546c320adbc16f1cb9c6fed3ac413be4f28fb56547f","observation_id":"6140b09c-a156-42d9-b6ed-1cf49299c575","resolution":{"observed_at":"2026-08-07T14:39:47.899711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10537","last_updated":"2024-06-04T23:47:43Z","snapshot_observed_at":"2026-07-06T16:49:04.651019Z","submitted_at":"2023-11-16T11:47:58Z","title":"MedAgents: Large Language Models as Collaborators for Zero-shot Medical Reasoning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10537","snapshot_observed_at":"2026-08-07T14:39:47.977667Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:47.977667Z"},"links":{"cited_paper":"/paper/2311.10537","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:c06276ed5b6bedab4cd3da2c131cc9db5871f25231d7ec0e6f0dc11978b8a660","observation_id":"9d7bc3ff-1ef2-457a-84ff-56a75a2bf7ce","resolution":{"observed_at":"2026-08-07T14:39:47.977667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:50.570480Z","title":null,"venue":null,"work_id":"def46b0b-caf8-4789-8fb8-75a908ec7016","year":2022},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:48.098024Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:0415503d2f2a3999dc6f0f15b03043509a3559008dff74120a0804b0f5a37b3d","observation_id":"fe94e60f-8c57-461d-b037-7d2c3f2a1d63","resolution":{"observed_at":"2026-08-07T14:39:50.658965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-07T14:39:48.215218Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:48.215218Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:54eda9ec691e68c0c2403b0d8f12bbeb17c1b2e41be3f02d5310c1a831e43983","observation_id":"0c593aaf-13a9-4e62-9385-8f4bff6cd769","resolution":{"observed_at":"2026-08-07T14:39:48.215218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05300","last_updated":"2024-03-26T14:32:33Z","snapshot_observed_at":"2026-07-06T15:52:36.416440Z","submitted_at":"2023-07-11T14:45:19Z","title":"Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-Collaboration","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05300","snapshot_observed_at":"2026-08-07T14:39:48.331865Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:48.331865Z"},"links":{"cited_paper":"/paper/2307.05300","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:f47d229ed4b150e730ca96e211b70308c9d39cd5819ef69bff787d44ca7d558a","observation_id":"1eb11468-d624-41b7-ac11-0f6cbbda7b71","resolution":{"observed_at":"2026-08-07T14:39:48.331865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:48.451715Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:48.451715Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:8daabe02775c8caa8c5e3a79357b13a4dd2614f1c905bce3b916b1647d6b47e8","observation_id":"0bb16708-274e-4313-a690-049618629622","resolution":{"observed_at":"2026-08-07T14:39:48.451715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00993","last_updated":"2025-04-04T18:29:18Z","snapshot_observed_at":"2026-08-07T16:16:51.008728Z","submitted_at":"2025-04-01T17:31:44Z","title":"MedReason: Eliciting Factual Medical Reasoning Steps in LLMs via Knowledge Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00993","snapshot_observed_at":"2026-08-07T14:39:48.526947Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:48.526947Z"},"links":{"cited_paper":"/paper/2504.00993","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:3f136054dc1b91c24944363fc912f0b397812fb066056fcbf2e20f2fb5ed8d3e","observation_id":"50cc919d-ac28-4224-adb6-06852b1900d2","resolution":{"observed_at":"2026-08-07T14:39:48.526947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:50.372589Z","title":null,"venue":null,"work_id":"e91784a9-4dae-4cc8-9f34-639b860ebf1f","year":2022},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:48.631170Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:1e11d4a3b95a3b92a0e89f840fe10d510164505fb2cb5ac075030da38eaeb8f0","observation_id":"acf5e344-cb33-4e70-952b-dac1767a5ea5","resolution":{"observed_at":"2026-08-07T14:39:50.456815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14461","last_updated":"2024-11-16T18:19:53Z","snapshot_observed_at":"2026-07-06T19:54:00.822571Z","submitted_at":"2024-11-16T18:19:53Z","title":"Towards Next-Generation Medical Agent: How o1 is Reshaping Decision-Making in Medical Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14461","snapshot_observed_at":"2026-08-07T14:39:48.752331Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:48.752331Z"},"links":{"cited_paper":"/paper/2411.14461","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:deb5f0da7c8d22d49a96f65512e1f8900614244ab5e2609cbdd8e46c3832ddf2","observation_id":"109883d9-f698-4ccb-a883-401e5dd110d8","resolution":{"observed_at":"2026-08-07T14:39:48.752331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:39:48.895881Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:48.895881Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:dcf93d8ad7dc908f07799946b8e7c23c058774791e7a92759b3d96e3ba5f588e","observation_id":"32be5360-d328-4fd6-a3d8-65824a4d64dd","resolution":{"observed_at":"2026-08-07T14:39:48.895881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:50.157786Z","title":null,"venue":null,"work_id":"363f3982-42d5-4898-a796-5bcd0cf4298c","year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:48.993240Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:2d447561adcccc20ea69c49c00a723a63d1f2c19a6b5490772b6d6824e5c95c1","observation_id":"d469a5c2-2242-4e76-95ce-2c87d2dd1437","resolution":{"observed_at":"2026-08-07T14:39:50.245561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:39:49.963911Z","title":null,"venue":null,"work_id":"38daf3d1-9e66-44b8-9b1d-ab36a42085e6","year":2024},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:49.114414Z"},"links":{"citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:789f4ba4b68d64734b940081edca2c2f5f9129ed3bed5386d298d1e9b60eac89","observation_id":"32a91c33-d931-4f7c-bfc0-93dff14b8469","resolution":{"observed_at":"2026-08-07T14:39:50.036481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05112","last_updated":"2024-07-22T12:16:30Z","snapshot_observed_at":"2026-07-06T16:45:03.211791Z","submitted_at":"2023-11-09T02:55:58Z","title":"A Survey of Large Language Models in Medicine: Progress, Application, and Challenge","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05112","snapshot_observed_at":"2026-08-07T14:39:49.245494Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:49.245494Z"},"links":{"cited_paper":"/paper/2311.05112","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:0e5280a6b51dff8f7ea35ffc86b088214805aa318189d9f73f9d663f2ff6c1d9","observation_id":"3f7d28cc-d8dc-474d-8f84-d2178671f020","resolution":{"observed_at":"2026-08-07T14:39:49.245494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18362","last_updated":"2025-06-06T13:00:07Z","snapshot_observed_at":"2026-07-06T20:28:24.203633Z","submitted_at":"2025-01-30T14:07:56Z","title":"MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18362","snapshot_observed_at":"2026-08-07T14:39:49.370355Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:39:49.370355Z"},"links":{"cited_paper":"/paper/2501.18362","citing_paper":"/paper/2505.18283"},"observation_digest":"sha256:d1323630cbb870c62dda4da34dc9b8557fff95b2acf6e18b7b907fec96456f38","observation_id":"b7b2aba6-1284-48d0-ae5a-629b81a01a6b","resolution":{"observed_at":"2026-08-07T14:39:49.370355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.18283","last_updated":"2025-05-23T18:28:59Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:31:44.638884Z","submitted_at":"2025-05-23T18:28:59Z","title":"TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 2 inbound Pith citation observations for arXiv:2505.18283."}