{"as_of":"2026-08-23T01:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc49159faa6cd2033355564ba4778e8775b0a62c32732551e8372a1ed945ebc7","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:47:43.589517Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T09:58:55.863209Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"cited_work":{"arxiv_id":"2507.20519","doi":"10.48550/arxiv.2507.20519","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20519","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","venue":"arXiv (Cornell University)","work_id":"63ddd5f4-d9fd-49ab-bf71-e19ecbdf9bcd","year":2025},"citing_paper":{"arxiv_id":"2512.15977","last_updated":"2026-05-11T17:29:44Z","snapshot_observed_at":"2026-07-06T22:39:23.633419Z","submitted_at":"2025-12-17T21:22:44Z","title":"Are vision-language models ready to zero-shot replace supervised classification models in agriculture?","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-16T21:15:20.717705Z"},"links":{"cited_paper":"/paper/2507.20519","citing_paper":"/paper/2512.15977"},"observation_digest":"sha256:0455069cf446ed5ea78097ab20fb2d2cb8413b925a4a2c7fe59c99d8c466017b","observation_id":"a885f9ed-b378-4837-ac15-ca18ab3c9f17","resolution":{"observed_at":"2026-05-16T21:18:32.178552Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20519","snapshot_observed_at":"2026-08-03T09:58:55.863209Z","title":"Agrobench: Vision-language model benchmark in agriculture,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.11906","last_updated":"2026-06-24T19:14:22Z","snapshot_observed_at":"2026-08-11T07:35:11.500544Z","submitted_at":"2026-01-17T04:45:31Z","title":"Visual-Language-Guided Task Planning for Horticultural Robots","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T09:58:55.863209Z"},"links":{"cited_paper":"/paper/2507.20519","citing_paper":"/paper/2601.11906"},"observation_digest":"sha256:a3d9832a632abc41ba83ccf687460964ea6b4abc9c3bdfdf32b217cae2ef90fb","observation_id":"010f8661-8b9e-4f10-b90b-e3a95bfd52cd","resolution":{"observed_at":"2026-08-03T09:58:55.863209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"cited_work":{"arxiv_id":"2507.20519","doi":"10.48550/arxiv.2507.20519","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20519","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","venue":"arXiv (Cornell University)","work_id":"63ddd5f4-d9fd-49ab-bf71-e19ecbdf9bcd","year":2025},"citing_paper":{"arxiv_id":"2605.03259","last_updated":"2026-05-05T01:17:27Z","snapshot_observed_at":"2026-08-13T14:35:58.111216Z","submitted_at":"2026-05-05T01:17:27Z","title":"CropVLM: A Domain-Adapted Vision-Language Model for Open-Set Crop Analysis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T01:36:02.920908Z"},"links":{"cited_paper":"/paper/2507.20519","citing_paper":"/paper/2605.03259"},"observation_digest":"sha256:db8b49d85cd29618566531728e340feca9df1b922eb884ce15f2f6b5545399dc","observation_id":"e67ebefd-9392-4223-ac6e-4085d95f95e1","resolution":{"observed_at":"2026-05-12T10:46:31.137409Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"cited_work":{"arxiv_id":"2507.20519","doi":"10.48550/arxiv.2507.20519","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20519","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","venue":"arXiv (Cornell University)","work_id":"63ddd5f4-d9fd-49ab-bf71-e19ecbdf9bcd","year":2025},"citing_paper":{"arxiv_id":"2605.22034","last_updated":"2026-05-21T06:10:58Z","snapshot_observed_at":"2026-08-18T19:04:55.573639Z","submitted_at":"2026-05-21T06:10:58Z","title":"AgroVG: A Large-Scale Multi-Source Benchmark for Agricultural Visual Grounding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T06:55:10.086869Z"},"links":{"cited_paper":"/paper/2507.20519","citing_paper":"/paper/2605.22034"},"observation_digest":"sha256:ad366fab3c5aebb768df86ae239f286e3f4940cbf35ddeb375c407ef4c317c31","observation_id":"6b6e755b-118e-4df1-a9de-ef4063fb360b","resolution":{"observed_at":"2026-05-22T06:56:10.630884Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"cited_work":{"arxiv_id":"2507.20519","doi":"10.48550/arxiv.2507.20519","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20519","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","venue":"arXiv (Cornell University)","work_id":"63ddd5f4-d9fd-49ab-bf71-e19ecbdf9bcd","year":2025},"citing_paper":{"arxiv_id":"2606.08034","last_updated":"2026-06-06T07:51:52Z","snapshot_observed_at":"2026-07-06T23:47:33.680573Z","submitted_at":"2026-06-06T07:51:52Z","title":"Sci-Rho: A Multilingual Visually-Grounded Symbolic Benchmark for STEM Problems","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-27T20:11:02.445626Z"},"links":{"cited_paper":"/paper/2507.20519","citing_paper":"/paper/2606.08034"},"observation_digest":"sha256:e1a54412707703a4d28f83ca065882e0700ef559de53e4a1afdf3e030f2911a0","observation_id":"292054c1-f989-48f3-a687-dd7ff76b437e","resolution":{"observed_at":"2026-07-02T20:47:22.860403Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.20519/citation-record","integrity":"/paper/2507.20519/integrity","json":"/paper/2507.20519/citation-record.json","paper":"/paper/2507.20519"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.578649Z","title":"Paddy doctor: A visual image dataset for automated paddy disease classification and benchmarking","venue":null,"work_id":"e42d6d11-9bbe-48c6-8368-c4aca90eca17","year":2022},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.311099Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:517b5eafdb829f23579d1c3ef4eeb72ce4e932b084c00f1deab0a7ef008a1e36","observation_id":"41bab2b4-aa44-425c-b050-9ebec1f385ca","resolution":{"observed_at":"2026-08-15T17:47:44.583719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.562587Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":"62a1a6ea-713f-4f98-a99d-59e4532ecda7","year":2022},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.317726Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:ee98a6aa1fb36b775e374137efdcde24d6582572990c6de02b61bdbf3b8380e2","observation_id":"1978450e-a391-4bcf-aa05-5e92b35c8eee","resolution":{"observed_at":"2026-08-15T17:47:44.567905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.547791Z","title":null,"venue":null,"work_id":"4fcae1d5-6596-47f6-a260-0fdb159874c1","year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.323234Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:5e4fd3539ccf3318603a8b84882e2417d4abde7acec83c69477dc527ba5010b7","observation_id":"80a5da7e-5246-479e-80e4-bc6b683a2c09","resolution":{"observed_at":"2026-08-15T17:47:44.552125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08405","last_updated":"2025-01-09T18:43:18Z","snapshot_observed_at":"2026-08-19T17:15:52.385347Z","submitted_at":"2024-10-10T22:38:26Z","title":"AgroGPT: Efficient Agricultural Vision-Language Model with Expert Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08405","snapshot_observed_at":"2026-08-15T17:47:43.328677Z","title":"Agrogpt: Efficient agricultural vision-language model with expert tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.328677Z"},"links":{"cited_paper":"/paper/2410.08405","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:e680f73769bd638cb3812d4014d472a5ab43aa8c9fd0a141068e1cc5c620e04c","observation_id":"70733eb8-f64a-4599-8a62-4d86461dd245","resolution":{"observed_at":"2026-08-15T17:47:43.328677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-20T15:31:01.041088Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-15T17:47:43.334296Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.334296Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:f402b0925c90257ce9d9677e42d80acc591190672f39c7ce48bae807939eea6b","observation_id":"38939375-6582-428f-9fcf-f2f2da06b729","resolution":{"observed_at":"2026-08-15T17:47:43.334296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-15T17:47:43.345336Z","title":"Are we on the right way for evaluating large vision-language models? arXiv preprint arXiv:2403.20330,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.345336Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:2fb43f34a755776e4f4e2bf642ae41ec88dda4d08e7658cdfe1192713f23c877","observation_id":"8f516f31-b4d4-46a3-9041-7748f8aac1f3","resolution":{"observed_at":"2026-08-15T17:47:43.345336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.532238Z","title":"Pali: A jointly-scaled multilingual language- image model","venue":null,"work_id":"93fb6377-ef46-4b08-ba1b-3ddf7ea00408","year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.349828Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:0ae8102881a45be230abfcf91e18af06870d174640f1a06b518b86d5ab6c731d","observation_id":"e89c3eff-c88a-4a10-b778-ccd0d989affa","resolution":{"observed_at":"2026-08-15T17:47:44.537130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.517003Z","title":null,"venue":null,"work_id":"959d7261-8cd1-4392-b48e-07ba48d9d5be","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.354626Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:c1e5e6031a5cfe7b3a16f5fae9d763c55136cac67ccd89eed0c64aa50b90a9c6","observation_id":"9dac781e-e769-4846-b2df-a10be07b6a5a","resolution":{"observed_at":"2026-08-15T17:47:44.521762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.501150Z","title":"tomato- village","venue":null,"work_id":"d225509b-2d77-4a61-842a-c2558f2fa6ec","year":null},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.360078Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:e0b0c8d1ce9f16626ef1980fc363c89ac5465905ddd0ce4ac6735af25eeb2930","observation_id":"f558b8a9-965b-4398-8b79-d8385f248bd2","resolution":{"observed_at":"2026-08-15T17:47:44.506266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.485291Z","title":"Perrenial plants detection, 2021","venue":null,"work_id":"3df6b615-eca1-4dff-8f05-03517d1238b7","year":2021},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.364744Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:848005523fc665c5f0f7b358303fc1bf42ac880536b0701521f99ad26b0050ca","observation_id":"9d31ba8b-9e6f-4af4-8099-b2ee74adf9b4","resolution":{"observed_at":"2026-08-15T17:47:44.490497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.468489Z","title":"A crop/weed field im- age dataset for the evaluation of computer vision based pre- cision agriculture tasks","venue":null,"work_id":"6afde2a4-df10-454e-b58c-1d9be939020d","year":2014},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.369591Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:c00433bd23af15e833253c59757585102d05f261d5ced16873d159500d632815","observation_id":"4416bd07-8977-4ef6-8437-81f611fb4c55","resolution":{"observed_at":"2026-08-15T17:47:44.473498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04535","last_updated":"2024-03-13T17:16:34Z","snapshot_observed_at":"2026-08-16T23:52:31.724802Z","submitted_at":"2024-03-13T17:16:34Z","title":"Image Classification for CSSVD Detection in Cacao Plants","version":1},"cited_work":{"arxiv_id":"2405.04535","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.04535","snapshot_observed_at":"2026-08-15T17:47:43.734069Z","title":"Image Classification for CSSVD Detection in Cacao Plants","venue":"cs.CV","work_id":"7c53baed-0fef-4ef7-98c5-0cac7a916c3d","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.375177Z"},"links":{"cited_paper":"/paper/2405.04535","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:b99109176b017d9188dace97c4da64910cff519da87d331d2c5ee85cfcb99e4b","observation_id":"706f99bb-ab19-4b32-9f87-08ecc48d771f","resolution":{"observed_at":"2026-08-15T17:47:43.742495Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.452699Z","title":"BLIP: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":"7d2d6803-2d6f-4477-a056-ae0a6449c594","year":2022},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.380277Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:5d076fd14d02154a84a1223abbd413c6f2c34397571f0adbeeb8ebe126de4538","observation_id":"2ed19249-9fde-4e9d-b59c-acfe47289569","resolution":{"observed_at":"2026-08-15T17:47:44.457787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.436976Z","title":"BLIP-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"30cb463c-1193-4d32-84ca-dfbb1f8bdddd","year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.385068Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:4a83441308bd7bd0f32758975976c37a54eb4311d9beff250240a52b455802df","observation_id":"1b0cd57d-82c0-4379-8c73-bab907aa2f5b","resolution":{"observed_at":"2026-08-15T17:47:44.442233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.422332Z","title":"Mvbench: A comprehensive multi- modal video understanding benchmark","venue":null,"work_id":"2685fd0b-f522-4600-b9f5-9bde4fb08dc0","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.389560Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:fbe23c81a78ebdbbef6a8e30abaad5f12769d9c414ee2e326192410154a21e9d","observation_id":"5db01a4b-2576-4328-814d-95bae100531d","resolution":{"observed_at":"2026-08-15T17:47:44.427081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-08-15T02:35:59.111911Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-15T17:47:43.394339Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.394339Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:43d2e755fdde1358f741a488ec2d8a77414e15eb4be55b0560373133b2beca4f","observation_id":"ff91eb19-b777-4d21-98e0-5dcfd5253580","resolution":{"observed_at":"2026-08-15T17:47:43.394339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.407506Z","title":"Visual instruction tuning","venue":null,"work_id":"96302bc9-f4e3-4d9b-9de0-b076cc97de48","year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.399826Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:4ae7cb78944967032e9256f7e6e32ecf73fc2533da434f50f28cb431681fc205","observation_id":"b8bf11ea-88a5-4b15-b60c-bd9d2475fffd","resolution":{"observed_at":"2026-08-15T17:47:44.412184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.391409Z","title":"Llava-next: Im- proved reasoning, ocr, and world knowledge, 2024","venue":null,"work_id":"bdf5931c-7e4c-41e9-b7ef-00b52b3f0746","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.404676Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:2a4c7c1b9b110826063b777064f34e901d4b16a0d2510351212777491878b976","observation_id":"f86f5380-1326-4c56-abb9-e3f9802b732c","resolution":{"observed_at":"2026-08-15T17:47:44.396926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.374738Z","title":"A multimodal bench- mark dataset and model for crop disease diagnosis","venue":null,"work_id":"3f808e46-58c4-463d-9814-5f99952ed336","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.409588Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:bfbf0263e58d7718d38dd41bf7009a391f67999e9488f799282b7091b31db211","observation_id":"3fdc80fe-6755-4ba1-b274-c44a1b11faed","resolution":{"observed_at":"2026-08-15T17:47:44.379903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.358090Z","title":"Masks-to-skeleton: Multi-view mask-based 9 tree skeleton extraction with 3d gaussian splatting","venue":null,"work_id":"f4b25017-ceed-4088-9707-5b27d1d366eb","year":2025},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.414618Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:6b30df64609d5905975cfb343fa43496606d4356b0c637c9212e150ba084feff","observation_id":"f2900ca1-ab07-4c5e-96c2-06cb29557268","resolution":{"observed_at":"2026-08-15T17:47:44.363235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.342252Z","title":"Canopy-attention-yolov4-based immature/mature apple fruit detection on dense-foliage tree architectures for early crop load estimation","venue":null,"work_id":"2df20320-949a-4e45-9540-fe7b02b226d7","year":2022},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.419393Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:7fe01aa989e074c96a4ed8f55ca045dee54987da4d4bb6af2e433fe368da89e0","observation_id":"ca4c12d4-f36d-4472-874c-3f0ea7cb12ac","resolution":{"observed_at":"2026-08-15T17:47:44.347300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.326033Z","title":"Cottonweeddet3","venue":null,"work_id":"db7c9d6e-e39a-4efa-b1d0-202fa7ff928d","year":2022},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.423955Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:66ca6b766075d29e069f011c808b05594753d7727c4048a2c8dac2936c7f3862","observation_id":"30472630-8590-478e-a5c7-49678814524c","resolution":{"observed_at":"2026-08-15T17:47:44.331116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.307982Z","title":"Open Plant Phenotype Database of Common Weeds in Denmark, 2020","venue":null,"work_id":"7364b8ab-73f8-4454-bc48-1c7902764ac4","year":2020},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.428763Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:968f0372d2d7506ceea3aa2f885caa0a5c124101d00270c6e0b741607957d9d5","observation_id":"db513614-f004-41f7-804a-c91efa28c69a","resolution":{"observed_at":"2026-08-15T17:47:44.313826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.289066Z","title":"A novel dataset of guava fruit for grading and classification","venue":null,"work_id":"4d24dfa2-4085-441f-8de3-b8579d1b505c","year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.433412Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:76a2c18d7f146b3d0729512d480e7b4ade02c12e0e804910057d2e7794661918","observation_id":"8faeef18-c702-42e7-a0dd-38975de14b43","resolution":{"observed_at":"2026-08-15T17:47:44.294207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.272397Z","title":"ChartQA: A benchmark for question answer- ing about charts with visual and logical reasoning","venue":null,"work_id":"507f9c35-9638-4ee8-8107-369359ca4a5d","year":2022},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.438889Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:56307ca1aaa6be401a44856898efcd265c47b5036dc14cfa10052e6a3f988bed","observation_id":"b1b15f05-1f08-47d7-a97a-5b8d1cb49bf9","resolution":{"observed_at":"2026-08-15T17:47:44.277700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.254090Z","title":"Nakayama, Jose M","venue":null,"work_id":"14bc7eb2-a3bb-448a-8f71-d80255d0e3e0","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.444322Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:4853ac66d42471dbb45a57496da986cbe73ffcfa537b9147f28a41f2c4d44d20","observation_id":"3bfa9539-22ec-4da8-8f8d-dea019ea5579","resolution":{"observed_at":"2026-08-15T17:47:44.259795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.236612Z","title":"Khapra, and Pratyush Kumar","venue":null,"work_id":"2c05dfc8-2427-450f-8136-2428ad6c24f6","year":2020},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.449378Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:e329e67e5b5b96df6d483fae0fdede5e90ef9c6f312aec5cdbdc9f3f8301766c","observation_id":"6f779248-6a35-4257-8b1e-73f41297076d","resolution":{"observed_at":"2026-08-15T17:47:44.242246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.219633Z","title":"Mohanty, David P","venue":null,"work_id":"d39ef5d2-1765-4cb0-8a36-6ce48e8a7652","year":2016},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.453854Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:1a8a1ba0307ca36288e9c64d26ffd1084339da8acbc8ac2cf228e7cbe04f9edb","observation_id":"ee9f5af7-9c91-4b1d-b4b4-158b7045d219","resolution":{"observed_at":"2026-08-15T17:47:44.224958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.459029Z","title":"Video-bench: A com- prehensive benchmark and toolkit for evaluating video-based large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.459029Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:0d8bfc2d043125c6727a4240e2af57ad9ae493af69981b2703adb25cf52562e9","observation_id":"bc214d27-41d4-46ae-b7a9-8801a3a06083","resolution":{"observed_at":"2026-08-15T17:47:43.459029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.191417Z","title":"Deepweeds: A multiclass weed species image dataset for deep learning","venue":null,"work_id":"739b09af-5168-439f-9325-21da1bca9563","year":2019},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.463829Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:0a739c9503a39b51ae8c746b4872e224602bdf3ad2f7b8d586712577a826efea","observation_id":"ac719e43-198d-4cf4-b1dd-f3718a02fe3a","resolution":{"observed_at":"2026-08-15T17:47:44.196718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.174110Z","title":"Gpt-4o, 2024","venue":null,"work_id":"6e6cf4ea-4931-40b8-9994-98ec7743899a","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.469366Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:3c5e0cedad5c303c73646d036d96c27036b1c5c7a784031cff52042bf3db3ca3","observation_id":"125a6dd0-d886-47b1-885e-477c57081c19","resolution":{"observed_at":"2026-08-15T17:47:44.179836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.156224Z","title":"Gpt-4o mini, 2024","venue":null,"work_id":"bda4993a-6791-46fa-88fb-ce01662fedee","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.474001Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:b64b5288f1ebef398f5603881f018adc90a7b89924311d191ed378f56e0af50e","observation_id":"2ec4574b-a63a-4f57-96f8-fa7c37c3dc2b","resolution":{"observed_at":"2026-08-15T17:47:44.161469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.135213Z","title":"In- dian rice disease dataset (irdd), 2023","venue":null,"work_id":"58ac668e-f38c-4828-baee-6ce91ec65a5d","year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.478711Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:7e6520971bc315fd6d4ccfc0b19a9e42593e6f8b4944f677f534760521c2f16d","observation_id":"77995948-ce5e-4215-bfc8-f33f650cd02e","resolution":{"observed_at":"2026-08-15T17:47:44.141950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.483399Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.483399Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:fcd17148f77210a2199a51725805f7c4988a5b5d9c4013d70ff8ccdd46790e90","observation_id":"e0f8569d-7d35-42e8-9101-7fb8069e9354","resolution":{"observed_at":"2026-08-15T17:47:43.483399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.104633Z","title":"Multimedeval: A benchmark and a toolkit for evaluating medical vision-language models, 2024","venue":null,"work_id":"8aad6898-c59b-4276-9629-ab5ce9492378","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.488550Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:348d1b7ad59b4e64c799c3c43418c1567c7963a1408239b39e34a7d0d9d405c9","observation_id":"f6720e29-3a9c-486e-b30f-ebbe3b35ad7a","resolution":{"observed_at":"2026-08-15T17:47:44.109714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.087998Z","title":"Coffee and cashew nut dataset: A dataset for detection, classification, and yield estimation for machine learning applications","venue":null,"work_id":"98a63a18-cca1-47d4-a84a-25b9d2e4289f","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.493186Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:fc410c9ebb336866281c8fc99415eff048217b02941873c50f8fa8084f52e621","observation_id":"da1f17af-bca0-4b77-98cc-ecfde0294fef","resolution":{"observed_at":"2026-08-15T17:47:44.093379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.072024Z","title":"A novel dataset of potato leaf disease in uncon- trolled environment","venue":null,"work_id":"6555c494-ed2a-46de-8a5b-c4c6dac33e15","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.498193Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:80be41a11136bade82909e40f0d4c425e405b3dad1c82e6c6fdbb85a219d47f0","observation_id":"12a826bd-5204-4180-b680-f39ef92e2b39","resolution":{"observed_at":"2026-08-15T17:47:44.077085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.055212Z","title":"Transformer-based ripeness segmentation for tomatoes","venue":null,"work_id":"607f53f1-7907-4e3d-82b6-58ca7f6b66a9","year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.503042Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:ab8f87167e26360cd02aa76889c8c2ca06dde77e42e075f7fe58aa307e8e00e9","observation_id":"282e83f1-07f0-4e41-b3c0-830ea6c29a14","resolution":{"observed_at":"2026-08-15T17:47:44.060584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.035859Z","title":"Sbs figures: Pre-training figure qa from stage-by-stage synthesized images, 2024","venue":null,"work_id":"02d678fc-687d-47b3-933e-75dca9400433","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.507816Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:ec9b98032b606b9916779ae0b469946b7429ecdb383908007c6031ed8e95eb67","observation_id":"8dad8832-6f2b-43bd-a3e5-3c4fc70f3b1e","resolution":{"observed_at":"2026-08-15T17:47:44.042419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:44.012152Z","title":"Plantdoc: A dataset for visual plant disease detection","venue":null,"work_id":"87ac217e-3706-493a-8292-8b97bc5ad92b","year":2020},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.512436Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:c67f0a777c2c9f3e48a10f393a75384d48f725149ef961d8f02bea07873b66ee","observation_id":"55f2bad3-09c9-4fd0-a382-86bb7f9a30dd","resolution":{"observed_at":"2026-08-15T17:47:44.017321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.995485Z","title":"The cropandweed dataset: A multi-modal learning approach for efficient crop and weed manipulation","venue":null,"work_id":"ea20dc94-487e-40c4-8240-ef1017f2f40d","year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.517215Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:a10248012df9031014f55da938d05dd3de9f12d102af5f7044089f61bd062113","observation_id":"cd438104-4213-45cd-a9ae-6c52e3b588cc","resolution":{"observed_at":"2026-08-15T17:47:44.000946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.977508Z","title":"Timbervision: A multi-task dataset and frame- work for log-component segmentation and tracking in au- tonomous forestry operations","venue":null,"work_id":"4bc5c175-2a16-4b83-a693-42f8a16e1d95","year":2025},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.521813Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:2d1ea20b33af56a7cb83d841f284965050cf87721e7ef43a08c949457d88ec03","observation_id":"c09627f6-767f-40ab-8c21-040523866afb","resolution":{"observed_at":"2026-08-15T17:47:43.983056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13286","last_updated":"2024-05-08T03:09:22Z","snapshot_observed_at":"2026-08-16T14:32:51.503158Z","submitted_at":"2023-12-20T18:59:58Z","title":"Generative Multimodal Models are In-Context Learners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13286","snapshot_observed_at":"2026-08-15T17:47:43.526801Z","title":"Generative multimodal models are in-context learners","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.526801Z"},"links":{"cited_paper":"/paper/2312.13286","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:32522a055bd3231971a1729d4103eb1fead028469960d21214f80d5bf4789ad1","observation_id":"82201e94-8e75-4847-94fa-692ce4aedb6d","resolution":{"observed_at":"2026-08-15T17:47:43.526801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05222","last_updated":"2024-05-08T02:46:43Z","snapshot_observed_at":"2026-08-06T07:46:37.713769Z","submitted_at":"2023-07-11T12:45:39Z","title":"Emu: Generative Pretraining in Multimodality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05222","snapshot_observed_at":"2026-08-15T17:47:43.532079Z","title":"Generative pretraining in mul- timodality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.532079Z"},"links":{"cited_paper":"/paper/2307.05222","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:62120f93af396fe935c1050a1f18a3c488868a1f6eed2d0caff154ebbbd5d133","observation_id":"e32c5383-778c-46eb-9225-c5802dd5cf32","resolution":{"observed_at":"2026-08-15T17:47:43.532079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.959017Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context, 2024","venue":null,"work_id":"134ca1a6-e4fd-4cee-940c-696b931f0841","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.537238Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:d2f819fbae29b29f741fc4041e516e57d1849e59352eaac3f1f07138779c4369","observation_id":"d7f9c06b-6653-4b50-8cf5-0ab943cef199","resolution":{"observed_at":"2026-08-15T17:47:43.965548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.941896Z","title":"Sugarcane leaf dataset: A dataset for disease de- tection and classification for machine learning applications","venue":null,"work_id":"44c5c2f2-c4d8-48c5-9a0e-703727037feb","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.542245Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:7ace8033154ee9876b0c14fa5aa28e375a92fe803749b6a8ee02298e39f2de06","observation_id":"d1a69da3-e6b6-45c7-ac11-26125c51b017","resolution":{"observed_at":"2026-08-15T17:47:43.947213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02158","last_updated":"2024-12-04T08:34:49Z","snapshot_observed_at":"2026-08-12T14:25:50.767875Z","submitted_at":"2024-12-03T04:34:23Z","title":"Agri-LLaVA: Knowledge-Infused Large Multimodal Assistant on Agricultural Pests and Diseases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02158","snapshot_observed_at":"2026-08-15T17:47:43.546851Z","title":"Agri-llava: Knowledge-infused large multimodal assistant on agricultural pests and diseases","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.546851Z"},"links":{"cited_paper":"/paper/2412.02158","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:ebabd5cce8ea7764f9402f11c51a43048699580099c9bd8d68b2f7cacb33d785","observation_id":"e7c1856f-10df-4a73-9e21-6e73e7c59e07","resolution":{"observed_at":"2026-08-15T17:47:43.546851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.924227Z","title":"Agripest: A large-scale domain-specific bench- mark dataset for practical agricultural pest detection in the wild","venue":null,"work_id":"8a9aa188-a387-4993-ad46-9262588910a9","year":2021},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.551465Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:993208155960e118602a19fd3653414781fa5d5d843107b235afbbb40ae32edf","observation_id":"6fcd5f91-be96-405d-ab4c-1fa9e1adeff4","resolution":{"observed_at":"2026-08-15T17:47:43.930542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.906204Z","title":"Cogvlm: Visual expert for pretrained language models","venue":null,"work_id":"3c9e9e2e-3b80-4990-bbb2-99123139f043","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.556162Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:82164f2c5d053dd1e4a109b28e4c8fc706ce3c48fee1b276627352065bb829d2","observation_id":"4d1051a7-732d-46d3-ab20-dcf310ea89e0","resolution":{"observed_at":"2026-08-15T17:47:43.912020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-15T17:47:43.560699Z","title":"Emu3: Next-token prediction is all you need","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.560699Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:d804a2f95b8992b03239e4955d3f0e9b556ffb2640c2e7173ec2dbd58a9ee209","observation_id":"7800d373-9702-4db5-9772-5d08ba3068f1","resolution":{"observed_at":"2026-08-15T17:47:43.560699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.887490Z","title":"Benchmarking in-the-wild multimodal disease recognition and a versatile baseline","venue":null,"work_id":"757c92ea-897f-4491-827f-d2fa0c660ba6","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.565838Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:d501d734828328775fccfdc0230e643c0c2fa0eef69e2f4b4a272fd179b797fe","observation_id":"2ab98ab6-8c30-4a4f-b898-4ada840727fa","resolution":{"observed_at":"2026-08-15T17:47:43.893373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.869431Z","title":"Ip102: A large-scale benchmark dataset for insect pest recognition","venue":null,"work_id":"5da36953-362d-4936-aba3-94581a26b873","year":2019},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.570611Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:b558006d172e073183f74ef366667509e7f735dc48ae9f8e782d6cb1ddf4e8fb","observation_id":"d5a13252-9c64-4616-98a3-86a3967436c1","resolution":{"observed_at":"2026-08-15T17:47:43.874589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.849220Z","title":"Crop identification using deep learning on lucas crop cover photos","venue":null,"work_id":"9ba2972a-7506-49c9-91b7-76e6de07b257","year":2023},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.575347Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:fa22dd4057e08af3ae4e7be11e9761e36d45b90174d129f499c81947276f03a2","observation_id":"b47d59f3-a2d9-44f6-8e11-56a7e6f1a287","resolution":{"observed_at":"2026-08-15T17:47:43.855743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.829990Z","title":"Mmmu: A massive multi-discipline multimodal understand- ing and reasoning benchmark for expert agi","venue":null,"work_id":"8821936f-d48d-4054-b307-8c7e22f67809","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.579844Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:c71b6b3787d3cde58b41698a3724763ede447119ef31e8a69225cd352bd990bf","observation_id":"07e03f4f-2e27-4a98-a70f-258a39ed3c1c","resolution":{"observed_at":"2026-08-15T17:47:43.835702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02813","last_updated":"2025-05-22T08:22:02Z","snapshot_observed_at":"2026-08-20T22:20:11.069630Z","submitted_at":"2024-09-04T15:31:26Z","title":"MMMU-Pro: A More Robust Multi-discipline Multimodal Understanding Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02813","snapshot_observed_at":"2026-08-15T17:47:43.584451Z","title":"Mmmu-pro: A more robust multi-discipline multimodal un- derstanding benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.584451Z"},"links":{"cited_paper":"/paper/2409.02813","citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:1ef228f4c63fad3bc3616f25ae0e85015c747b5c3693b2dd2a3915c4e454bc76","observation_id":"0c25f7d8-0b55-4aff-ab0e-474faa5d479c","resolution":{"observed_at":"2026-08-15T17:47:43.584451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:43.810435Z","title":"Statistics This section provides detailed statistics of AgroBench","venue":null,"work_id":"c2648e4f-d721-4e8e-a3eb-6f579fef2b97","year":2024},"citing_paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:43.589517Z"},"links":{"citing_paper":"/paper/2507.20519"},"observation_digest":"sha256:6c6571ce6136da13627f6e622f52d66b4f76b9ed9946d89531de81f832504b51","observation_id":"89ba6e0b-ce4d-4c57-9913-dc3effbf1397","resolution":{"observed_at":"2026-08-15T17:47:43.816892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20519","last_updated":"2025-07-28T04:58:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T17:39:53.072048Z","submitted_at":"2025-07-28T04:58:29Z","title":"AgroBench: Vision-Language Model Benchmark in Agriculture"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":42},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 5 inbound Pith citation observations for arXiv:2507.20519."}