{"as_of":"2026-08-07T01:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d74fcce9a77fc803ec0154e7ec3db09ade31f0b56e4e65279b2c95d57b156985","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T06:23:12.214888Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.04986/citation-record","integrity":"/paper/2606.04986/integrity","json":"/paper/2606.04986/citation-record.json","paper":"/paper/2606.04986"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Multimedia Systems 29, 2049–2057 (2023)","venue":null,"work_id":null,"year":2049},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:47b34db114313558c2de4dd7ffe0295754dd3184ce46bcd17dad6dc4549f6eae","observation_id":"99736b95-9030-4e8a-9cb5-badd4c77425d","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07953","last_updated":"2017-01-19T12:49:11Z","snapshot_observed_at":"2026-08-03T14:10:39.739606Z","submitted_at":"2016-04-27T07:20:55Z","title":"Simultaneous Food Localization and Recognition","version":2},"cited_work":{"arxiv_id":"1604.07953","doi":null,"metadata_source":"pith","pith_arxiv_id":"1604.07953","snapshot_observed_at":"2026-07-02T08:06:48.020237Z","title":"Simultaneous Food Localization and Recognition","venue":"cs.CV","work_id":"b45a4fe6-9c97-40e9-b77d-603ba1895287","year":2016},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"cited_paper":"/paper/1604.07953","citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:558b01caabdda5ff2862beee086e0784416cd2b80481a4e1aff742a92bd949c8","observation_id":"576c2efc-6d5f-4a6c-9a36-f1d65a6320ed","resolution":{"observed_at":"2026-07-02T08:06:48.021413Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Computer Vision – ECCV 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:55b0e92b2f8ecdd3699edf6031052b68b1b990a8bb24edad71009a9feb383b5f","observation_id":"4145a8db-492b-4dd2-9014-78be88e432e3","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Proceedings of the 24th ACM International Conference on Multimedia","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:43711c2dcd767df1e5ccd1302d8304ad2211b50c4586f03f1e9987a4f987b77a","observation_id":"94df35d1-0e53-4280-9a47-6c9ba3610b27","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.15509","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T04:34:31.154024Z","title":"Chart-r1: Chain-of- thought supervision and reinforcement for advanced chart reasoner","venue":null,"work_id":"d7079281-c46f-4be6-9566-06b8244063da","year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:fc038af09a8d9b1e7a8be8bcf17cb5e9029bef4df721746ef21534e13bb0756e","observation_id":"2a848aa4-51f2-4373-87c6-e95d373510f4","resolution":{"observed_at":"2026-07-02T08:06:48.013100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14391","last_updated":"2024-05-12T18:45:52Z","snapshot_observed_at":"2026-07-06T16:11:06.578398Z","submitted_at":"2023-08-28T08:14:20Z","title":"FIRE: Food Image to REcipe generation","version":2},"cited_work":{"arxiv_id":"2308.14391","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.14391","snapshot_observed_at":"2026-07-02T08:06:48.012087Z","title":null,"venue":null,"work_id":"e28609bf-4acc-45d5-bed8-65ec32963d73","year":2024},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"cited_paper":"/paper/2308.14391","citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:cdc079f1f153eeec9f04a253fce240d5b558fa17a6507be54e685aa869b6e639","observation_id":"4e33413c-fa6a-4c8e-b599-e719864c5c40","resolution":{"observed_at":"2026-07-02T08:06:48.013372Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"IEEE Journal of Biomedical and Health Informatics21, 588–598 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:06df4805e4f0407ea696d52f5377da46b07b16aec1aac44facce54f93b086857","observation_id":"0fd15a07-90fd-4829-b1ea-0cf42bc077c9","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10429","last_updated":"2025-08-14T07:59:31Z","snapshot_observed_at":"2026-08-05T20:32:33.187449Z","submitted_at":"2025-08-14T07:59:31Z","title":"MM-Food-100K: A 100,000-Sample Multimodal Food Intelligence Dataset with Verifiable Provenance","version":1},"cited_work":{"arxiv_id":"2508.10429","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10429","snapshot_observed_at":"2026-07-10T07:46:56.511792Z","title":"MM-Food-100K: A 100,000-Sample Multimodal Food Intelligence Dataset with Verifiable Provenance","venue":"cs.AI","work_id":"e8f3ad40-0e40-404a-beca-df11123b72b8","year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"cited_paper":"/paper/2508.10429","citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:2af49326081050338eb0316e5edbd6a8050ef95219c8d4bb4f895e20edeb2164","observation_id":"af960ec9-cd70-4b99-a356-f22d4de981fb","resolution":{"observed_at":"2026-07-02T08:06:48.023690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: International Conference on Learning Representations (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:c103fcc69ab31a207b991b798eaefdbf23012f002c227ff49bd3052047cc5d0e","observation_id":"2fb6c2b0-b842-4f06-8c8b-51a175744371","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-07-06T20:49:27.466064Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":"2503.06749","doi":"10.48550/arxiv.2503.06749","metadata_source":"pith","pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","venue":"cs.CV","work_id":"38998646-34ee-4605-b661-ab356f16d6e5","year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:5e0d6537fd42ce2472c6561aac6cd5b635e2394654cf7f2622bdb726fde5b551","observation_id":"66e628c2-b4c9-4f57-b401-d6c123b25adc","resolution":{"observed_at":"2026-07-02T08:06:48.021206Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07608","last_updated":"2025-03-10T17:59:42Z","snapshot_observed_at":"2026-08-01T16:55:41.453922Z","submitted_at":"2025-03-10T17:59:42Z","title":"AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","version":1},"cited_work":{"arxiv_id":"2503.07608","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.07608","snapshot_observed_at":"2026-07-05T11:41:02.666322Z","title":"AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","venue":"cs.CV","work_id":"6cb91ed2-9a71-43b2-8cdc-656e5c3e918d","year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"cited_paper":"/paper/2503.07608","citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:fc36fd5b28bc4b4dc445073d0e1e48de4ee8eef876424d6ae1ebdf5d841e2aaa","observation_id":"f51055fa-a265-4927-8545-cf95443349aa","resolution":{"observed_at":"2026-07-02T08:06:48.008147Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:1324d4591b95fd56d3b1442f6748ed32fb980ec980f09879a710feb327c453e8","observation_id":"825918f3-e390-45af-8d49-77cb47533506","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12730","last_updated":"2024-12-16T06:16:27Z","snapshot_observed_at":"2026-08-05T22:34:04.983688Z","submitted_at":"2024-07-17T16:49:34Z","title":"RoDE: Linear Rectified Mixture of Diverse Experts for Food Large Multi-Modal Models","version":3},"cited_work":{"arxiv_id":"2407.12730","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.12730","snapshot_observed_at":"2026-07-04T03:49:30.360089Z","title":"Rode: Linear rectified mixture of diverse experts for food large multi-modal models","venue":null,"work_id":"f031e760-10a3-4260-a16c-846ad1885cca","year":2024},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"cited_paper":"/paper/2407.12730","citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:07e0e5c86cf3160436453b2d078fec63a5426b4fc34107fe9ec895f5d4e85870","observation_id":"8eecc7d6-0393-4b61-90d5-beaf57c7ddf1","resolution":{"observed_at":"2026-07-02T08:06:48.007832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: International Conference on Learning Representations (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:7807aa74d01103b4394df5910b843480507b4a3d11826f4a8b2e4a7c1b518c40","observation_id":"6d4b8b6a-a330-4a96-8444-3081d5c56ed2","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Text Summarization Branches Out","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:61255423fa8906120b3407195ab12b7add32382736e44ed8dd0c988599ae9a6f","observation_id":"30706b64-6cc2-43db-bd81-a00176a6d6f1","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"IEEE Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:4506d1eb298f6147704cf89257ce7191645be4f752f8f37930d7573f394f0caf","observation_id":"4a0d632e-f794-4b5b-811b-72da59df6742","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Proceedings of the IEEE/CVF Winter Conference on Appli- cations of Computer Vision","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:ad3c56d1a82f929c18aa67ed4a546553eb36b35996ce763df2ff471fa6bdf17e","observation_id":"448e5c93-975d-404c-92a5-2c01de5ea6d9","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"IEEE Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:eed60d09b52d894a16188ac826b4db923229b87eed9c31aff8ad2be29c68e806","observation_id":"0aa20358-29a1-4a7d-ba3f-d21a78a24032","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Cambridge University Press (2008)","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:3249e822210e03ea02ebc608b46c06e7fc49b88f5a263e3a9413271bb418b19b","observation_id":"552fd296-d6fc-47a1-90ff-b374a4472d7b","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"IEEE Trans","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:99f219bb959dd2cb1e0b511a91ed8b94d4d592294059c6850ca9d81a0d648f06","observation_id":"8ba8ad6f-1c2a-408b-a4ed-4f23fc531b75","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"IEEE Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:9890bd4ee0e639aafc7891066d01265f7886e4cb415f4aa244768bb20aa786fd","observation_id":"3378e63e-9a3b-4341-9a0b-f10c76a5d054","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Proceedings of the 33rd ACM International Conference on Information and Knowledge Management","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:fa9739c3ba868c1f11930e2e370eaa1befec6ba5d3348e43f2044387326904ee","observation_id":"b2c05f12-ffbe-48af-b147-3561817bc3be","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Advances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:cea4996af23cfd74c7bdb13d4f82d91170a69a78cb5da5620cb1a42a7432204e","observation_id":"9e204571-530f-49c3-b6fb-e9e23e1d1779","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Proceedings of the 40th Annual Meeting of the Association for Computational Linguistics","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:3585febd4aab9c08dd8e0335244f97ebdeb36d1b79ed50f275bc6f3bb5ac9279","observation_id":"c512e116-30aa-41f5-9cdb-500f93054a14","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Proceedings of the Third Conference on Machine Translation: Research Papers","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:4b9fa088681ebcafc48e11077857b3dfac671c229e7883c67c1ec885568abb4a","observation_id":"ee0cb536-0ba1-441e-9de1-de1333c37ff8","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Pro- ceedings of the IEEE Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:4935b601453bceea3bb8cc7c0756fbecce89af5dfac941ac6114dcac893d998a","observation_id":"dbeb24af-73f8-4611-b7f5-96cfe97b3a1f","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:31f372187fe19f1e5475a8f93ca6d639c67a5be4c31d5ecfdf64b92bc38fbd84","observation_id":"ebed713e-7f2a-4977-bcf3-6d0fbcb24cd4","resolution":{"observed_at":"2026-07-02T08:06:48.023940Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: MultiMedia Model- ing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:aa8528485c7295e5a568470a1f48ab7ff781821ab5806735c846b8601aeef049","observation_id":"f6cfce1c-c841-4baa-84cc-6cce2a570ebf","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Nutrients17(7), 1128 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:c145d0ab78017a88ed65be7c24f11b9cc5bc2be525540ad89a27a67dd17554b6","observation_id":"42b2c09a-c5d5-4e70-98bd-7aadeba3927e","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Proceed- ings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:4ba04b3a0bad59992b58b358d2cef8baf007c197841a2068058cad28ff2f0303","observation_id":"31a16b2f-ab31-4f6c-b5dc-a18998d56404","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:11b499131265abe42f6eacab1d42eec69831c859d1fedeab9b43c095777b6398","observation_id":"4520f8e3-62a7-46ae-bc86-0bbf052873ae","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09936","last_updated":"2024-12-13T07:51:32Z","snapshot_observed_at":"2026-07-06T20:06:26.221438Z","submitted_at":"2024-12-13T07:51:32Z","title":"CaLoRAify: Calorie Estimation with Visual-Text Pairing and LoRA-Driven Visual Language Models","version":1},"cited_work":{"arxiv_id":"2412.09936","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09936","snapshot_observed_at":"2026-07-02T08:06:48.025165Z","title":null,"venue":null,"work_id":"d5fafc35-a2d7-40e8-a2d1-855258811fb6","year":2024},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"cited_paper":"/paper/2412.09936","citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:2d2d7e13feb4cd540ce18cb175b5993a8ec331a030ca1e6bd3cd0f97678b03ef","observation_id":"cab45510-768e-49bd-9506-8de03ed7067d","resolution":{"observed_at":"2026-07-02T08:06:48.026831Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"IEEE Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:62f4ba625cbf51c0832ad88e1d4efded97d5b8af91724e5406a4af17562cfc21","observation_id":"187f66bc-b9da-4cbe-95a8-182cfcb8e640","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:d90ed4d8985bbe80b9a3830a8656f15f79927a59624e235433bcf6aad0e10d18","observation_id":"b0f26e9d-d632-429d-8819-4ba744e6ab64","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"In: International Conference on Learning Rep- resentations (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:cd30cbd8da7af6fbbc23396c3cef3bc6028dd8e945a36622c0d96d12bfb19e55","observation_id":"13b74ffd-7623-44b1-bc20-ff0d9a94e7bf","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"yes” or “partial","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:d3207229a0b207e05c9ba969c3f504d2e6bff87ad69403010b193010795cce52","observation_id":"3d174670-075a-4faa-892c-abd24686509c","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"4) One quantity item, whose name may be generic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:3f38740095593d5859971b61322ef567919de3c84f41665524dc8108d0147464","observation_id":"e512a990-2656-45d4-a597-698bdf0df531","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:cb644679f198adf0f7434d7317ded848941033498e9fcae0aaa8b209404d28af","observation_id":"81bf88cb-c535-49a4-a341-6153105dd586","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"high” or “low","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:fdb64b9de5b281ffc265ee5e973d51550125600ee1b95159d474e4e1bed1c6d3","observation_id":"6f43f572-7c22-427e-a0f8-0208a83f97a7","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Remind the user to keep their overall diet diverse and balanced, instead of focusing on a single meal","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:d03d64c9c81f06a225d23446f35c1a0abc014251395a1027185301df2756ec70","observation_id":"3b621d85-d912-424e-bd46-add1b2d40ad4","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:46fa8406298e6f7bdc346d1cc65813ebe58232e0c5cdd8197e42fe42b079cd24","observation_id":"2809fcea-fdda-44dd-bf08-8d20a2ec7ab3","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:c2b199bea3cc464f3893847e7e2ec29d82bc5cd608bcc0ad05ce652090f8bacf","observation_id":"bdfaa8ea-c407-4941-85e4-f6f5a920a960","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Calorie Estimation Fig","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:d7e25187a46aee579f553dedb83708f9a82b2cb1290d85182b774a448cf88ae3","observation_id":"b40394c6-49ee-4b65-8ced-6c82cea98a04","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:b696f720e99eda79604d431d63e8364f773df9ac1bb7c2a961249c4937fd2880","observation_id":"d8f40c57-154b-4e60-9c3e-8b791ab45212","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:6eb1be2ed0090ba43bed1f6f56d576c412454595e3d88f3f41a73f6c72367b88","observation_id":"9a193001-6a27-453b-86db-e1c68bdaf9bf","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Constraints: Do NOT give medical diagnoses, disease risk, or treatment advice","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:6ac08a597c700ae83d29138f28059756ab045a42b4ff7de973089a4da6445e5a","observation_id":"ef532a80-5b78-417d-bc09-593c64b40e99","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:d8f4a9c31d0d84b0ff11c5b26ce00ec7ccc711fc74e42108cb0fbcce6729cc66","observation_id":"a008fd06-ea59-4e9b-b229-4f9220a338cf","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:f7be9149e2ca19fe784950810acfcc50f03733b909cb95efdb9e991039f480c2","observation_id":"c09e9837-559e-4db4-a77b-98f80986af40","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Food Classification Fig","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:3f85e7f7de57cd755ad797ce6d3cbeeecf309ca29cf31cebe1e3f4641b5e5855","observation_id":"5569c754-e24d-4a65-83d1-abfbd023a740","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:adeaf8e735378ec92b8ee67c2cd644670218b151ee7809206a2de52ef5393f94","observation_id":"7e19ec36-3063-45c2-a28b-91dae70d4d09","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:ac7104cc1c8abad47394cc5cba79d529b2832b545355efb87c834a05e4a32940","observation_id":"dc8eb2ce-fb2d-4878-a7a7-de3b9ecc4d3b","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Ingredient Recognition Fig","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:fa823a52b84990a5bcb2aa5f936fe74639b6082754f14b73ba2332634decb8a8","observation_id":"69096260-4713-467b-84d2-269fe489aa62","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:6ad9da2b59d5d419af0275f6688b0bff455074f99726f6c514a4ddc6d10b2961","observation_id":"574a9692-8f56-4547-b9eb-16e54eb396ef","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:ad3d799e5cd6c4615ba6333b461465630eb71f3fdd60a516abc15831f8e3addb","observation_id":"f74f298f-6cf9-4040-8abe-f9dc99333dea","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Recipe Generation Fig","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:96d02c86f677afc9121df7926c75f5da15c7c0d31ee1401c953cf2896e52833b","observation_id":"df64247a-ea78-424d-b9bc-a745737cb44c","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"# reasoning Produce one block wrapped in <answer>...</answer>","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:55116e3b97ecc2dccf563954ee13d75547db1426d6e911c7864e8d5ba29833a6","observation_id":"ca9d2c09-b29b-48ab-b70e-cdfa294fdc50","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"# reasoning Produce one block wrapped in <answer>...</answer>","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:9b78de81aa6f6270c9c40737d8d3251ff0eb3f7d7ef438b41ca50e28f5f44f4b","observation_id":"d5faac2b-f021-4f8b-bc94-28c3d8405fe3","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"# reasoning Produce one block wrapped in <answer>...</answer>","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:e91ef86935afaea2573f3a75d64c1f01e36459e98ca01db9e20d66de62fecf79","observation_id":"4e016705-b6aa-4f79-b3d4-dcc7d7548458","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"# reasoning Answer strictly in the following format: <think> …</think><answer>The ingredient is <IngredientName>","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:1d742f1210d39dc9b4203e633e5ac1ea31be9c54b8a37e6aa035a90432230dcf","observation_id":"328d7f35-5f15-4fe6-b8fb-72a2ba93ce24","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"# reasoning Answer strictly in the following format: <think> …</think><answer>The ingredient is <IngredientName>","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:e4518cf312a69780bb8a11be9361e99dc9835230ad9a4fb27c91edfd0854b354","observation_id":"d72319ba-e65e-41df-8ba6-1f33849b8a5f","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:a77a8715524399f29f8fe03e5aedb11bb6bbba515719234adc889c74e6c0018d","observation_id":"12de93fe-4a25-4e73-9ff1-4586c7936472","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:1bbae8f96c56372a38dd215ed9ff1670c553bd2e9a793fb3a81c9a8fde19861c","observation_id":"15a93e52-df51-4ee2-ba0a-fe85a6f98521","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:61d51c00411384ae7d01d10659b0280cf7cd34afd5b034baa1a073874faa2d93","observation_id":"320ae8d9-006b-4565-afc0-8f36d3206ce1","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"End with the summed total","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:7cb98c91257962c322831db52bae95ad538de3fdf7e7843659cce97448e357fd","observation_id":"179873b1-b178-41b2-8a33-ef36f0dc651b","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:1a0df1833ddb180f4cad344b3b0d03163e1b4b43d38df247fd4518a239127263","observation_id":"c29a2f37-c5c3-4f5d-bb51-f2ba3958ec45","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:23:12.214888Z","title":"Do not discuss the whole dish or other ingredients","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T06:23:12.214888Z"},"links":{"citing_paper":"/paper/2606.04986"},"observation_digest":"sha256:0a4815a38736987f9e2333eed03a2b4b2985b56ceedfae78c75ab40d7b729677","observation_id":"4b7d21c0-f40c-44a0-b59f-3d526e8fff2d","resolution":{"observed_at":"2026-06-28T06:23:12.214888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.04986","last_updated":"2026-06-03T15:07:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:45:02.342193Z","submitted_at":"2026-06-03T15:07:12Z","title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":57,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2606.04986."}