{"as_of":"2026-08-08T04:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eb003b2a25f852abcacadcd6c96588b0efe6b476f33b0884ce3304a13502c1b5","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:27:50.052728Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:20:04.591495Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T05:20:04.993495Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.18831","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18831","snapshot_observed_at":"2026-08-07T05:20:04.993495Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","venue":"cs.IR","work_id":"840e871c-fdd5-4a1e-a28c-8ca473d8a2e7","year":2025},"citing_paper":{"arxiv_id":"2506.08352","last_updated":"2025-06-10T02:09:57Z","snapshot_observed_at":"2026-08-07T10:30:38.151886Z","submitted_at":"2025-06-10T02:09:57Z","title":"Reinforcement Fine-Tuning for Reasoning towards Multi-Step Multi-Source Search in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:20:04.591495Z"},"links":{"cited_paper":"/paper/2505.18831","citing_paper":"/paper/2506.08352"},"observation_digest":"sha256:9928027e5b9af45783248c8ca7b05266954a9fe5f291a5ae8a7231e264726070","observation_id":"bf6c5fa1-85b2-49ab-a248-e5411c7e1338","resolution":{"observed_at":"2026-08-07T05:20:04.997818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.18831/citation-record","integrity":"/paper/2505.18831/integrity","json":"/paper/2505.18831/citation-record.json","paper":"/paper/2505.18831"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:51.169420Z","title":null,"venue":null,"work_id":"9aa21a9a-8a05-452a-9208-e26735355aa6","year":null},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.741454Z"},"links":{"citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:9097af0661315811cf9aa24b1e812f308ccc91f69914a3a5bb0e4cfd434cdfbf","observation_id":"275b4e78-d049-43e7-9e7d-499a0839ab6b","resolution":{"observed_at":"2026-08-07T14:27:51.174336Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01523","last_updated":"2025-04-02T09:10:02Z","snapshot_observed_at":"2026-08-07T16:15:14.520422Z","submitted_at":"2025-04-02T09:10:02Z","title":"Adapting Knowledge Prompt Tuning for Enhanced Automated Program Repair","version":1},"cited_work":{"arxiv_id":"2504.01523","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.01523","snapshot_observed_at":"2026-08-07T14:27:51.091184Z","title":"Adapting Knowledge Prompt Tuning for Enhanced Automated Program Repair","venue":"cs.SE","work_id":"f7bd2b04-3cee-4ded-8244-d492c475cd1b","year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.757251Z"},"links":{"cited_paper":"/paper/2504.01523","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:6b80f6d4b2a4920dd69792e894e59eeeec1aa6d7ae9f01c2398286faeb3b9320","observation_id":"031634fd-eb23-4a55-9843-b3d924c0a3cd","resolution":{"observed_at":"2026-08-07T14:27:51.097726Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07942","last_updated":"2025-07-21T11:23:21Z","snapshot_observed_at":"2026-08-07T16:06:45.594067Z","submitted_at":"2025-04-10T17:53:23Z","title":"MARS: a Multimodal Alignment and Ranking System for Few-Shot Segmentation","version":2},"cited_work":{"arxiv_id":"2504.07942","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07942","snapshot_observed_at":"2026-08-07T14:27:51.067535Z","title":"MARS: a Multimodal Alignment and Ranking System for Few-Shot Segmentation","venue":"cs.CV","work_id":"614011e6-5ce1-40fc-b725-da9bd61de5f6","year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.765545Z"},"links":{"cited_paper":"/paper/2504.07942","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:0d805e70f641e26ebd5041de6868c2128c160a64962bc7c4b1266f42ef5b0172","observation_id":"64778890-b6a6-4654-a09a-bf2c576f6b6b","resolution":{"observed_at":"2026-08-07T14:27:51.072304Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:49.775596Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.775596Z"},"links":{"citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:53ebfd9d4439d0759718390fc607e1d689110c4059a4851e1eb27ce5ebf0fa7a","observation_id":"26421d0a-b553-4bbe-8545-ea9fa2490670","resolution":{"observed_at":"2026-08-07T14:27:49.775596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-03T14:31:51.401500Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-08-07T14:27:49.783064Z","title":"Brown, Miljan Martic, Shane Legg, and Dario Amodei","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.783064Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:27eaeb899d40b3e4bdb37b40c1a0828306b52a60622d3e2a85245e08c572ae7e","observation_id":"8b14969c-8e5d-4b38-a3a8-68e785e093ae","resolution":{"observed_at":"2026-08-07T14:27:49.783064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13885","last_updated":"2025-03-09T17:33:35Z","snapshot_observed_at":"2026-08-07T15:07:28.074313Z","submitted_at":"2024-08-25T16:26:55Z","title":"Neural Spacetimes for DAG Representation Learning","version":2},"cited_work":{"arxiv_id":"2408.13885","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.13885","snapshot_observed_at":"2026-08-07T14:27:50.928238Z","title":"Neural Spacetimes for DAG Representation Learning","venue":"cs.LG","work_id":"4121453e-ca07-4bce-820d-f7d5e5613cf0","year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.790379Z"},"links":{"cited_paper":"/paper/2408.13885","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:522ab337001f231e5bf3f67bfe65d7cf8e3bba482b896f1dd080c1706b81e76b","observation_id":"a1385966-e092-4749-9504-d1e5f63e5406","resolution":{"observed_at":"2026-08-07T14:27:50.935300Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-07T14:27:49.799189Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.799189Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:7a4b882fef4c55274ba58e1ee7885af8a32ddc73a5d310c47bced3fed45f2ec9","observation_id":"e9ccada1-68ee-43c4-ba63-fc0410daa3ce","resolution":{"observed_at":"2026-08-07T14:27:49.799189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07957","last_updated":"2025-04-27T07:20:02Z","snapshot_observed_at":"2026-08-07T16:06:45.226662Z","submitted_at":"2025-04-10T17:59:12Z","title":"MM-IFEngine: Towards Multimodal Instruction Following","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07957","snapshot_observed_at":"2026-08-07T14:27:49.807752Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.807752Z"},"links":{"cited_paper":"/paper/2504.07957","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:3042de48c32c4ce0c93b3b4a63d8ab64ad57caabac2e90997ba73be89f9cc8ae","observation_id":"e589d879-6482-434a-914b-44d8abc6423e","resolution":{"observed_at":"2026-08-07T14:27:49.807752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12726","last_updated":"2023-01-30T08:51:19Z","snapshot_observed_at":"2026-07-06T14:45:55.345502Z","submitted_at":"2023-01-30T08:51:19Z","title":"Specializing Smaller Language Models towards Multi-Step Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12726","snapshot_observed_at":"2026-08-07T14:27:49.818904Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.818904Z"},"links":{"cited_paper":"/paper/2301.12726","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:b3e0ddcc05ff34ab9aaa606b6269c860a01b32f11e1ca2bd0287d7452bfe849c","observation_id":"d80d2367-28ca-4496-964d-aa9e971b0b74","resolution":{"observed_at":"2026-08-07T14:27:49.818904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06606","last_updated":"2025-04-09T06:09:40Z","snapshot_observed_at":"2026-08-07T16:07:18.452869Z","submitted_at":"2025-04-09T06:09:40Z","title":"Benchmarking Multimodal CoT Reward Model Stepwise by Visual Program","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06606","snapshot_observed_at":"2026-08-07T14:27:49.827346Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.827346Z"},"links":{"cited_paper":"/paper/2504.06606","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:a6d1d8cf66da04e9387c82577b0ea78c36f339aa8a6fe46a8a8ef329eab0b296","observation_id":"cdaeaf76-f5ee-4ca1-9485-b665ec98a63e","resolution":{"observed_at":"2026-08-07T14:27:49.827346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:51.152904Z","title":null,"venue":null,"work_id":"c0e8bb9f-f29d-40ea-93ca-47da8e18668e","year":null},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.834225Z"},"links":{"citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:e35cfed00ddf9b0b7c4ee402f7d0a81505b4d8e38193c46d820cf327599ef7b1","observation_id":"392c4abf-df88-4a78-b058-ab2240a985fb","resolution":{"observed_at":"2026-08-07T14:27:51.158399Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.01403","last_updated":"2021-04-02T20:27:44Z","snapshot_observed_at":"2026-07-06T10:11:08.648093Z","submitted_at":"2020-11-03T01:10:39Z","title":"Supervised Contrastive Learning for Pre-trained Language Model Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.01403","snapshot_observed_at":"2026-08-07T14:27:49.847670Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.847670Z"},"links":{"cited_paper":"/paper/2011.01403","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:1a46cee502d9f471ed8dac479bb6afe0977a75a720ff3d8b3ee6fbea8b12980a","observation_id":"91f6d3af-5d5b-4245-abe8-cda51feb0c9d","resolution":{"observed_at":"2026-08-07T14:27:49.847670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10459","last_updated":"2025-02-12T07:26:07Z","snapshot_observed_at":"2026-07-06T20:36:50.081370Z","submitted_at":"2025-02-12T07:26:07Z","title":"LLM4GNAS: A Large Language Model Based Toolkit for Graph Neural Architecture Search","version":1},"cited_work":{"arxiv_id":"2502.10459","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.10459","snapshot_observed_at":"2026-08-07T14:27:50.817927Z","title":"LLM4GNAS: A Large Language Model Based Toolkit for Graph Neural Architecture Search","venue":"cs.LG","work_id":"ad2b19bf-4c64-4163-bdc6-79bca9dd7846","year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.840646Z"},"links":{"cited_paper":"/paper/2502.10459","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:cdd80e42c82705896496691ba751c123c510f5b47a187436a9586c28b15e87d5","observation_id":"ea22e792-a2e9-4167-834f-3ea8266a9e64","resolution":{"observed_at":"2026-08-07T14:27:50.825725Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12959","last_updated":"2024-11-27T08:49:12Z","snapshot_observed_at":"2026-07-06T19:18:17.523057Z","submitted_at":"2024-09-19T17:59:45Z","title":"MMSearch: Benchmarking the Potential of Large Models as Multi-modal Search Engines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12959","snapshot_observed_at":"2026-08-07T14:27:49.863423Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.863423Z"},"links":{"cited_paper":"/paper/2409.12959","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:2e141dfa5ccc25a5c0ccaf28d53d7127ca30825b1339cc97a638d01811e91c89","observation_id":"de8244f9-100b-431b-b4c8-1a2cba1335e1","resolution":{"observed_at":"2026-08-07T14:27:49.863423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12399","last_updated":"2025-07-09T03:59:49Z","snapshot_observed_at":"2026-07-06T20:24:03.105038Z","submitted_at":"2025-01-08T07:50:50Z","title":"FinSphere, a Real-Time Stock Analysis Agent Powered by Instruction-Tuned LLMs and Domain Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12399","snapshot_observed_at":"2026-08-07T14:27:49.856183Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.856183Z"},"links":{"cited_paper":"/paper/2501.12399","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:8cf3f7095381ba66017c17aa6671fd45243a2682e633137a5e0f2fe484628cf3","observation_id":"1b27107d-9ac8-4be0-88f6-40b1ce23ec4e","resolution":{"observed_at":"2026-08-07T14:27:49.856183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-07T14:27:49.881434Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.881434Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:b09fe058dfaa54eec62e458f2dab13094c8d705893ef7b153892613145a8ae49","observation_id":"ae46c352-c78f-49c3-8cff-7b10dd8c232d","resolution":{"observed_at":"2026-08-07T14:27:49.881434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:49.873650Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.873650Z"},"links":{"citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:46f817f96a155d9e687016f3e8c26e31c5d190cc07b6fb68294b96d587452b04","observation_id":"fa6067af-3fdc-4d38-b2e0-94fb346c2aa7","resolution":{"observed_at":"2026-08-07T14:27:49.873650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00267","last_updated":"2024-09-03T14:01:54Z","snapshot_observed_at":"2026-07-06T16:13:07.384791Z","submitted_at":"2023-09-01T05:53:33Z","title":"RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00267","snapshot_observed_at":"2026-08-07T14:27:49.901444Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.901444Z"},"links":{"cited_paper":"/paper/2309.00267","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:cb00533b302015e3b7da1953026e950305b4b4bf6c2cb5666096dffeaecad6f2","observation_id":"22e71aaf-666b-4a64-87f1-da82be82236f","resolution":{"observed_at":"2026-08-07T14:27:49.901444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04925","last_updated":"2024-06-22T08:18:48Z","snapshot_observed_at":"2026-07-06T17:13:33.874642Z","submitted_at":"2024-01-10T04:37:38Z","title":"The Impact of Reasoning Step Length on Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04925","snapshot_observed_at":"2026-08-07T14:27:49.887553Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.887553Z"},"links":{"cited_paper":"/paper/2401.04925","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:08a98075415e828e9fb25a7866334b2d427a8dba14cae64e6335ff7fc1b416a8","observation_id":"9b5d2bbe-8e6a-4cff-85f2-8db749303448","resolution":{"observed_at":"2026-08-07T14:27:49.887553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:49.918527Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.918527Z"},"links":{"citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:2036b8c420f82815a9b61dc374cc71aafa9d6e732a390fd7b1fe216bdc22dd9b","observation_id":"750792ca-cc5a-478a-8f98-0e2f4d552475","resolution":{"observed_at":"2026-08-07T14:27:49.918527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05812","last_updated":"2024-05-21T08:37:05Z","snapshot_observed_at":"2026-07-06T16:45:32.248661Z","submitted_at":"2023-11-10T01:12:03Z","title":"CFBenchmark: Chinese Financial Assistant Benchmark for Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05812","snapshot_observed_at":"2026-08-07T14:27:49.909403Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.909403Z"},"links":{"cited_paper":"/paper/2311.05812","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:132be413fad30b301ae911abecad81830c29dd080510fd6d7c1ac5c687b216af","observation_id":"0d0d412e-0076-4204-94fe-b559e03ca013","resolution":{"observed_at":"2026-08-07T14:27:49.909403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15684","last_updated":"2024-12-14T07:26:39Z","snapshot_observed_at":"2026-07-06T20:40:34.378362Z","submitted_at":"2024-12-14T07:26:39Z","title":"An Agent Framework for Real-Time Financial Information Searching with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15684","snapshot_observed_at":"2026-08-07T14:27:49.935581Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.935581Z"},"links":{"cited_paper":"/paper/2502.15684","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:4adcadccc304e055db3638e378d3de54a78272834f912c07867f5754b49c3d38","observation_id":"36cf3bfc-5601-4f4d-bc80-a95622c814d3","resolution":{"observed_at":"2026-08-07T14:27:49.935581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-07T14:27:49.926983Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.926983Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:e7b314e4e393d46566ec28a5f05cd7e2a3623ea138ce67a25c938c1b3855a1b3","observation_id":"d0bd0eeb-95f8-4056-8104-7f10d90f1f7a","resolution":{"observed_at":"2026-08-07T14:27:49.926983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:49.950393Z","title":"Guerreiro, Ricardo Rei, and André F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.950393Z"},"links":{"citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:7b84db234c374cad48235c23f609e157a777a0f13ccd0d9f6f295a1385e80a74","observation_id":"f08b0495-f438-4f42-bebb-920bf9c62329","resolution":{"observed_at":"2026-08-07T14:27:49.950393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-07-06T14:32:37.317828Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-07T14:27:49.942606Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.942606Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:037e845e4b7e4d64826573e61d022ebe0ca98bd451338598f253e84dfae90b24","observation_id":"73b135fb-f751-41b0-9faa-c6c38078de3a","resolution":{"observed_at":"2026-08-07T14:27:49.942606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03744","last_updated":"2023-11-08T20:06:28Z","snapshot_observed_at":"2026-07-06T15:51:35.559366Z","submitted_at":"2023-07-07T17:53:07Z","title":"Comparing Traditional and LLM-based Search for Consumer Choice: A Randomized Experiment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03744","snapshot_observed_at":"2026-08-07T14:27:49.963186Z","title":"Rothschild, Daniel G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.963186Z"},"links":{"cited_paper":"/paper/2307.03744","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:3ba8bb5dd85acbe1ce41d626dd9bc1cc12d56e880afb029fe605142d39acafcd","observation_id":"c09c6818-50c4-4fb2-984c-f7c2a686d488","resolution":{"observed_at":"2026-08-07T14:27:49.963186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07924","last_updated":"2024-06-05T13:23:49Z","snapshot_observed_at":"2026-07-06T15:54:28.831510Z","submitted_at":"2023-07-16T02:11:34Z","title":"ChatDev: Communicative Agents for Software Development","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07924","snapshot_observed_at":"2026-08-07T14:27:49.956005Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.956005Z"},"links":{"cited_paper":"/paper/2307.07924","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:1ebd479eccdde66a807ad1d49074227eb5170bacfb4ab7e7a2b552b3d6446abc","observation_id":"7cea74e3-a911-4837-9650-50ffeb60436d","resolution":{"observed_at":"2026-08-07T14:27:49.956005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T14:27:49.977250Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.977250Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:cb04e63f832f96f1c83ac08926b77615353ee4f18bfb957e8a3055304e1010ba","observation_id":"edd306ae-02fe-48cf-aa94-51706cb421df","resolution":{"observed_at":"2026-08-07T14:27:49.977250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05934","last_updated":"2024-11-08T19:44:12Z","snapshot_observed_at":"2026-08-07T04:45:41.737086Z","submitted_at":"2024-11-08T19:44:12Z","title":"Qwen2.5-32B: Leveraging Self-Consistent Tool-Integrated Reasoning for Bengali Mathematical Olympiad Problem Solving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05934","snapshot_observed_at":"2026-08-07T14:27:49.970944Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.970944Z"},"links":{"cited_paper":"/paper/2411.05934","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:a9829027421075dde413093b5f6ddb5072c1de4dac8314dc97306213fa6195c4","observation_id":"b6349f8a-556b-4ac1-9675-7700c1b0c9c4","resolution":{"observed_at":"2026-08-07T14:27:49.970944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18407","last_updated":"2025-02-25T17:58:02Z","snapshot_observed_at":"2026-08-07T17:49:27.969414Z","submitted_at":"2025-02-25T17:58:02Z","title":"AgentRM: Enhancing Agent Generalization with Reward Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18407","snapshot_observed_at":"2026-08-07T14:27:49.996079Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.996079Z"},"links":{"cited_paper":"/paper/2502.18407","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:351b014e839c0b061881dd501ac96ed9488e7c9f6f1e66839c014fc72e4ed0db","observation_id":"75960073-c17a-4b22-a1eb-b9bd92624d67","resolution":{"observed_at":"2026-08-07T14:27:49.996079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:27:49.987872Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.987872Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:1c0034da605a8930e0b619e56e58fd699dff37f1dd1070810cdeea721ad4be19","observation_id":"f6c886b5-483f-4cf4-8968-c21974c3a241","resolution":{"observed_at":"2026-08-07T14:27:49.987872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T14:27:50.016325Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:50.016325Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:858f3fd66c1d5a3bb3355f2abf9397f4e18e51fb90320c62a24a8cc56c9f06e8","observation_id":"3425af78-980c-4011-bb1d-316548ee1f9e","resolution":{"observed_at":"2026-08-07T14:27:50.016325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00128","last_updated":"2024-06-28T03:52:13Z","snapshot_observed_at":"2026-08-04T02:09:59.170120Z","submitted_at":"2024-06-28T03:52:13Z","title":"When Search Engine Services meet Large Language Models: Visions and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00128","snapshot_observed_at":"2026-08-07T14:27:50.005082Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:50.005082Z"},"links":{"cited_paper":"/paper/2407.00128","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:a2f2cd06f76399c73381aa98e1c1443cf79594cfa9ba64f2ad7b19b77da4488c","observation_id":"e473578f-6892-4132-860e-fda9dfc47eca","resolution":{"observed_at":"2026-08-07T14:27:50.005082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09296","last_updated":"2024-07-01T03:38:57Z","snapshot_observed_at":"2026-07-06T15:43:03.878575Z","submitted_at":"2023-06-15T17:20:46Z","title":"KoLA: Carefully Benchmarking World Knowledge of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09296","snapshot_observed_at":"2026-08-07T14:27:50.030313Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:50.030313Z"},"links":{"cited_paper":"/paper/2306.09296","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:245d0af42bef110d99db3d88192db454d7417cfa1adca2ac46fe1579e98e8d9e","observation_id":"3a082e5b-f3c2-4673-82a7-e5dce44208d8","resolution":{"observed_at":"2026-08-07T14:27:50.030313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09219","last_updated":"2025-03-12T10:06:03Z","snapshot_observed_at":"2026-08-07T17:10:33.725355Z","submitted_at":"2025-03-12T10:06:03Z","title":"Rethinking Prompt-based Debiasing in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09219","snapshot_observed_at":"2026-08-07T14:27:50.023055Z","title":"Wong, Shu Yang, Junchao Wu, and Lidia S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:50.023055Z"},"links":{"cited_paper":"/paper/2503.09219","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:514bd001710921d87b1c7dccaa70aafe336775d713cb1edf76da4f63a4405da7","observation_id":"96fa39a9-a874-41d9-b13b-7de76a7f2b20","resolution":{"observed_at":"2026-08-07T14:27:50.023055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15820","last_updated":"2024-10-18T04:38:47Z","snapshot_observed_at":"2026-08-07T00:54:30.453152Z","submitted_at":"2024-09-24T07:34:50Z","title":"Supervised Fine-Tuning Achieve Rapid Task Adaption Via Alternating Attention Head Activation Patterns","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15820","snapshot_observed_at":"2026-08-07T14:27:50.045237Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:50.045237Z"},"links":{"cited_paper":"/paper/2409.15820","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:6e16c194147e2d768196de6a3a22273421003589d7756e279ae5bfbf54f7b467","observation_id":"295697fa-3ccd-42ca-879d-7ef5f9d16560","resolution":{"observed_at":"2026-08-07T14:27:50.045237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10744","last_updated":"2024-01-19T15:09:39Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:09:39Z","title":"FinLLMs: A Framework for Financial Reasoning Dataset Generation with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10744","snapshot_observed_at":"2026-08-07T14:27:50.037756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:50.037756Z"},"links":{"cited_paper":"/paper/2401.10744","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:71e6c6e92190dcab7681b4f30939a93a6addd31f8cef06a903ac59aa714eca81","observation_id":"cc5701c9-e022-4f44-91c4-62ebc5f5da33","resolution":{"observed_at":"2026-08-07T14:27:50.037756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-07T14:27:50.052728Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:50.052728Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:a33a6dcdb661f3a58b331a399f49151d6cef7f4fad13a6230850e3bcd72fc0ac","observation_id":"4a305ed3-4c3d-454d-af58-5eb73bb3d940","resolution":{"observed_at":"2026-08-07T14:27:50.052728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01980","last_updated":"2025-03-03T19:01:17Z","snapshot_observed_at":"2026-08-07T17:32:33.992373Z","submitted_at":"2025-03-03T19:01:17Z","title":"Recurrence-Enhanced Vision-and-Language Transformers for Robust Multimodal Document Retrieval","version":1},"cited_work":{"arxiv_id":"2503.01980","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01980","snapshot_observed_at":"2026-08-07T14:27:51.115756Z","title":"Recurrence-Enhanced Vision-and-Language Transformers for Robust Multimodal Document Retrieval","venue":"cs.CV","work_id":"a498b521-81af-4636-8ed2-4ea6a3d92c99","year":2025},"citing_paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:49.750523Z"},"links":{"cited_paper":"/paper/2503.01980","citing_paper":"/paper/2505.18831"},"observation_digest":"sha256:898e51a3926bddfe67688de5d52bec6d38afaf0d7c9b5584364fdeda12d03cae","observation_id":"a46bd610-488d-4298-9323-952222564da3","resolution":{"observed_at":"2026-08-07T14:27:51.120580Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.18831","last_updated":"2025-05-24T19:00:36Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-07T15:06:24.787553Z","submitted_at":"2025-05-24T19:00:36Z","title":"Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":34,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2505.18831."}