{"as_of":"2026-08-06T13:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8de05b0eee15cc720719545e82ae9d6d3182614bbb841802681d0cc1fc630b23","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T19:50:44.664358Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T19:50:44.664358Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-20T19:53:42.705448Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"cited_work":{"arxiv_id":"2605.16460","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.16460","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","venue":"cs.CV","work_id":"16bcf445-3524-4c20-8430-905a8fc80a9d","year":2026},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2605.16460","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:19f67a28ef12cc56701fa040999d1c7b416ff554ce979713663368d8806a0825","observation_id":"5acbda0e-249a-447b-8bad-bb760e481e2c","resolution":{"observed_at":"2026-05-20T19:53:42.708729Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.16460/citation-record","integrity":"/paper/2605.16460/integrity","json":"/paper/2605.16460/citation-record.json","paper":"/paper/2605.16460"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"green pears on the table","venue":null,"work_id":"6b95e779-ee12-4664-aa09-cc8706a492cb","year":null},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:7ad9b6b743142ae546414adeb4fdbbf8e2666783479b12fddac1fd991b8365e9","observation_id":"d5dd42f8-1c7d-4035-9359-15fcfef5045a","resolution":{"observed_at":"2026-05-20T19:53:58.096525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"cited_work":{"arxiv_id":"2605.16460","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.16460","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","venue":"cs.CV","work_id":"16bcf445-3524-4c20-8430-905a8fc80a9d","year":2026},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2605.16460","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:19f67a28ef12cc56701fa040999d1c7b416ff554ce979713663368d8806a0825","observation_id":"5acbda0e-249a-447b-8bad-bb760e481e2c","resolution":{"observed_at":"2026-05-20T19:53:42.708729Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1bd712b2-4b4e-410e-817c-4ad9bf5bb536","year":null},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:984b4a702436f68802bb0876320c1fb4ecedd9ae8bceb8f207083de218012a50","observation_id":"a8a0e66a-42bf-40fa-b2d0-286050be13b5","resolution":{"observed_at":"2026-05-20T19:53:58.092588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"think- range-answer","venue":null,"work_id":"95d3b67e-443b-4a75-887c-076efa15e41d","year":2048},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:5a8becce2435b3f01dc77b37fc71a34cf4faf453891813ec1b74ca2d98e5a186","observation_id":"0ad7f245-ed6d-4c9d-9f9f-343c69866a4d","resolution":{"observed_at":"2026-05-20T19:53:58.110663Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"First, we introduce thethink-range-answerparadigm, which reframes REC from a direct mapping task to a struc- tured decision-making process","venue":null,"work_id":"0a22c1a7-412f-4a7e-aac2-48795fbce9aa","year":null},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:4dbff48befedf12d344711178fad614a11733a8a117230870c4b1b4eda985c2e","observation_id":"eb2dd265-cefc-4bfe-8a2b-fc55289c226b","resolution":{"observed_at":"2026-05-20T19:53:58.126758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Referring expres- sion counting","venue":null,"work_id":"2e394453-0ac4-4c62-a3f8-f22b7dceeefe","year":2024},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:a99facad561c8bda61a48c88b1289fe7ab420708f3894efa315f3f03408b32c5","observation_id":"fa21a024-d8b6-4059-ba8e-6df198f2fbd9","resolution":{"observed_at":"2026-05-20T19:53:58.119430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":"8c74ee22-0836-434c-8eb4-2ddc68c56437","year":2022},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:63695ecce51cc62923c389914460896da0b31f64643dc150a0eeedad7f78e2a5","observation_id":"886e33c0-627c-4a42-97f7-627a42bc3ae3","resolution":{"observed_at":"2026-05-20T19:53:58.116240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:9387b5c999ae50ac40965d5a393174e854655524a8c6bf0ff99b308000831333","observation_id":"7fcb5de3-7398-411c-8781-a41ac302cb80","resolution":{"observed_at":"2026-05-20T19:53:42.697778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:69d80c8cd3777c9f8e9d831d5c9cdd4ac20a126c21301b00cd9bdbc3e9b7ad9b","observation_id":"e13a416d-ef69-4622-8241-dfeeb0ab6f40","resolution":{"observed_at":"2026-05-20T19:53:42.740011Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:9ed45d9d67c6d13e7ef05508918ae19c757e958b8405e011cbd902914cfc6ae2","observation_id":"91f7cfd4-ca4e-4555-aee3-15dee224110e","resolution":{"observed_at":"2026-05-20T19:53:42.702682Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"ab100cf5-be2a-469d-b0d6-ac2dcc448c09","year":2022},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:b80e680e23c5745de463601c6e87eb86a4d205c370b497cbd9cc454d16baab03","observation_id":"5c31dca6-b342-42e4-8cd0-cb73478baa03","resolution":{"observed_at":"2026-05-20T19:53:58.086181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10615","last_updated":"2025-03-18T08:52:34Z","snapshot_observed_at":"2026-07-06T20:52:09.743730Z","submitted_at":"2025-03-13T17:56:05Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","version":2},"cited_work":{"arxiv_id":"2503.10615","doi":"10.48550/arxiv.2503.10615","metadata_source":"pith","pith_arxiv_id":"2503.10615","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R1-Onevision: Advancing Generalized Multimodal Reasoning through Cross-Modal Formalization","venue":"cs.CV","work_id":"bd2bf4d0-20bf-49b8-8dac-b54a8019be6c","year":2025},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2503.10615","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:00ecebf796ba65056a70406c39e320c05777f4f991393a79e35ed9a038f0f324","observation_id":"e349868d-69e2-4fce-a3b8-563e9815eb43","resolution":{"observed_at":"2026-05-20T19:53:42.723794Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":"2504.07615","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-07-11T03:17:51.904109Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","venue":"cs.CV","work_id":"d36889cb-edb6-448f-9a50-36df8b1623e5","year":2025},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:e6cb42058cf652c7d4a557aa8693435f08ce1961b18524b33ccb1561e71ded54","observation_id":"0485ebef-7be1-4b9f-a61c-b0f2c7b707ab","resolution":{"observed_at":"2026-05-20T19:53:42.735106Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17352","last_updated":"2025-11-11T08:13:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-21T17:52:43Z","title":"OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles","version":3},"cited_work":{"arxiv_id":"2503.17352","doi":"10.48550/arxiv.2503.17352","metadata_source":"pith","pith_arxiv_id":"2503.17352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles","venue":"cs.CV","work_id":"de4c64e1-82b1-4f70-8311-a3539e7bf400","year":2025},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2503.17352","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:9ac516770889bae51bfb5fcd1becb4932290a13508ccc706e07cccde638c0fe2","observation_id":"de35b5cc-35bc-4a75-ad77-98354d6796ea","resolution":{"observed_at":"2026-05-20T19:53:42.713868Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual-rft: Visual reinforcement fine-tuning","venue":null,"work_id":"afea531e-faa8-4933-a588-ac6d8ba19eeb","year":2025},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:57c8883cd16deb3a452dd8a38553d36f9887e31357c6e2466ddf388818d1853d","observation_id":"0086127c-19de-406d-a21c-3b0511f0348f","resolution":{"observed_at":"2026-05-20T19:53:58.107620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Let’s verify step by step","venue":null,"work_id":"cdc4563d-60e7-42a1-afa0-b5138f485e6d","year":2023},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:fa65f9def88882de43728d66c055a952644ea6bad20c37bd75586d8544475a30","observation_id":"32844b63-1e93-459c-aaeb-2f705ce6e92a","resolution":{"observed_at":"2026-05-20T19:53:58.122753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Single- image crowd counting via multi-column convolutional neural network","venue":null,"work_id":"bfddf1d6-e42c-445f-89fe-ef4b9df149de","year":2016},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:a6553ecd4dcc7e0a7ed195283de6f3a2f47dbc6b23a1f74db1b7392e88ee41e1","observation_id":"d9a04fcf-2aa1-4f80-b596-f81987399c91","resolution":{"observed_at":"2026-05-20T19:53:58.089270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":"29d780d1-5e9b-42b2-b942-2e1f2d3cb501","year":2024},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:3953fb05fa48e713c4277fa8242fe02380978d2ca2eb1888bee353080abf9711","observation_id":"da7074ea-9da6-46f7-b5ae-ca7c64f478d5","resolution":{"observed_at":"2026-05-20T19:53:58.100526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:5d0af358e9529c59734e91460cbd9bdaf30de0cef3c28197a297320c956cbeb6","observation_id":"d584742c-e9ef-46a1-b466-696fde5db1d4","resolution":{"observed_at":"2026-05-20T19:53:42.691930Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.03724","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Crowdvlm-r1: Expanding r1 ability to vision language model for crowd counting using fuzzy group relative policy reward","venue":null,"work_id":"3509e31e-6a06-4c71-bcf4-3466c65022fe","year":2025},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:1418f6c6580386ae04422ef62bae88b751bc399c11aa69494699688e0766539a","observation_id":"a911b37e-eb79-4798-b82d-457a8a27bd85","resolution":{"observed_at":"2026-05-20T19:53:42.729818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":"ee581147-6077-4114-84ae-98991b8a3d23","year":2024},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:a002c0ceb27962ea551d5effb835c5a3c314f925a71782f0196eac26620fc9cf","observation_id":"4ed1c87f-696e-4ce4-bbb7-3abdc9fc5249","resolution":{"observed_at":"2026-05-20T19:53:58.104637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:8ab936afbaa42719d1f5217f2b17ffbcdc2c419580edd8ffd2e1db38b36d5da7","observation_id":"87c704fb-ac31-40b5-8590-ebc1164a92cc","resolution":{"observed_at":"2026-05-20T19:53:42.718924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The llama 3 herd of models","venue":null,"work_id":"315c94bf-6f70-4937-aaf3-0e94548e3ff4","year":2024},"citing_paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T19:50:44.664358Z"},"links":{"citing_paper":"/paper/2605.16460"},"observation_digest":"sha256:c780fe50a0bf0ae1ce20b4138ae6030ec946dc5d2de36cd4be336179c9d09ebe","observation_id":"0f07e651-39d4-47e9-aa80-9e8dc1471b9c","resolution":{"observed_at":"2026-05-20T19:53:58.113198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.16460","last_updated":"2026-05-15T07:37:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T00:28:16.694770Z","submitted_at":"2026-05-15T07:37:45Z","title":"REC-RL: Referring expression counting via Gaussian and range-based reward optimization"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":9,"verified_fuzzy":11},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 1 inbound Pith citation observation for arXiv:2605.16460."}