{"as_of":"2026-08-06T22:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:975acbcfb556ba56612b39c15e2fb431d87ee0408b974dd28c5c02c5904667c5","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:57:17.255005Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.02129/citation-record","integrity":"/paper/2509.02129/integrity","json":"/paper/2509.02129/citation-record.json","paper":"/paper/2509.02129"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.873793Z","title":null,"venue":null,"work_id":"9f06cf9d-2745-43bc-a083-788de959f223","year":2023},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.316998Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:53860218e2fb69a9bc04c1cf58097dc6c6e5c35af8c8e528470a33940a3cea0b","observation_id":"bf1d124e-84b7-41ae-8bdc-4010ad07f9d6","resolution":{"observed_at":"2026-08-05T11:57:17.877913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.859964Z","title":null,"venue":null,"work_id":"b2d204e6-ef25-4b42-be58-f10480f46579","year":2024},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.355902Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:9f8dfe9cbffa0c42e74308ccfb9ee5f067d88458559b52c9df337d366a20fb82","observation_id":"f5110ec7-93fd-4714-b01c-f7e3064378ef","resolution":{"observed_at":"2026-08-05T11:57:17.864379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.846121Z","title":null,"venue":null,"work_id":"477b56ef-44dc-409f-972c-8d1e7a042fda","year":2008},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.455330Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:f7618c309ba59e132ce13009e62a742deabe8848e00a3ed3cbbd3e512f63b416","observation_id":"fd67a794-0360-486f-a8e0-5680d2dda27f","resolution":{"observed_at":"2026-08-05T11:57:17.850435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.832589Z","title":null,"venue":null,"work_id":"3cf0ad30-d60f-4ac5-a92d-3950a27018f2","year":2023},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.519091Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:41d3ba883c1db2c4eb5d5aa47a0b5b6bb5f6f5f94e5b7ef2a1cf518d36e7abf3","observation_id":"5990be6f-6b82-403f-a1be-9c77f2b4f35c","resolution":{"observed_at":"2026-08-05T11:57:17.836818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:16.596950Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.596950Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:ec57d426d9881945cca65890788e66fa46924543f4567b2aae757de4c55a07fc","observation_id":"e029c155-342d-4b6c-a22b-0cc2dc634b09","resolution":{"observed_at":"2026-08-05T11:57:16.596950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.818114Z","title":null,"venue":null,"work_id":"2843ed0e-cddd-458c-a490-a336233cb12e","year":2012},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.683160Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:e3154df8a8704dcedb599d163d513237ce6363dc5f01f44ec46a76b5e0971386","observation_id":"87999208-3bcf-46a6-90d6-3171d90122ce","resolution":{"observed_at":"2026-08-05T11:57:17.822687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-07-06T16:25:25.534843Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-05T11:57:16.716582Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.716582Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:aed77016cdd99ede2f9980ac0cd2ee7e78dd8d462c7fe2300e9ca019d98923b4","observation_id":"14285457-87e1-4d05-a671-243df4b6e228","resolution":{"observed_at":"2026-08-05T11:57:16.716582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.804012Z","title":null,"venue":null,"work_id":"52a8fa8f-8fca-4efa-9c6a-162cf71003bf","year":2021},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.800663Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:c5727ea899c2fbb5e048e569343eb9bcb67df4a4c078ba7c1b0b499caf826005","observation_id":"0cff251c-719f-4a14-9b30-ce93e8ae5b13","resolution":{"observed_at":"2026-08-05T11:57:17.808279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.790340Z","title":null,"venue":null,"work_id":"fa1838f5-792d-45d4-9b97-68e753142807","year":2024},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:16.955019Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:222a0f44bc368a4e24894e1e15376293ec2302dc5fe40af3b9a3ea76eba6866b","observation_id":"bcf3f1b3-a73c-42a9-be4c-295b3440c589","resolution":{"observed_at":"2026-08-05T11:57:17.794198Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.775125Z","title":null,"venue":null,"work_id":"20106ed2-a56f-435a-8413-9c47ac8f1806","year":2015},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.116224Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:95b2457c1c22924d904772e18931bd0db782ba66082452ac40418bef6634f124","observation_id":"2b2e8ff4-0239-490e-9170-fb08871dc77f","resolution":{"observed_at":"2026-08-05T11:57:17.779771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.759801Z","title":null,"venue":null,"work_id":"fda8bb3d-44be-4e49-ae3f-3d6ee39d5b15","year":2024},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.120543Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:c0ab5137d6431c21f7fd78c7ba6e124f72374fb925d043ba0e531e8cf61f0187","observation_id":"a17a134d-2444-482f-89be-826632a77ee2","resolution":{"observed_at":"2026-08-05T11:57:17.764029Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.185085Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.185085Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:806bd52f6c79fe4e8f049a965185462b5b9d65b3b80deab485905a476fa4f985","observation_id":"6b92c121-f72f-463a-919a-55f1ef69da0f","resolution":{"observed_at":"2026-08-05T11:57:17.185085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17520","last_updated":"2024-06-25T12:59:46Z","snapshot_observed_at":"2026-07-06T18:36:42.830927Z","submitted_at":"2024-06-25T12:59:46Z","title":"Tell Me Where You Are: Multimodal LLMs Meet Place Recognition","version":1},"cited_work":{"arxiv_id":"2406.17520","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.17520","snapshot_observed_at":"2026-08-05T11:57:17.430738Z","title":"Tell Me Where You Are: Multimodal LLMs Meet Place Recognition","venue":"cs.CV","work_id":"63b7fb40-02dc-41da-b93d-566ef6d92bbc","year":2024},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.189338Z"},"links":{"cited_paper":"/paper/2406.17520","citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:cffc4f2d8d0b8d2f351eb971bc4a440977324cf34fc41cd4d60d81aeb1ec8681","observation_id":"30b25eca-efca-4649-a6c8-d395812f596d","resolution":{"observed_at":"2026-08-05T11:57:17.435287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.194612Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.194612Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:dc8919f2e40114d25f4b710d76f0f941db305ecabf29fbd77ab191a401811f9b","observation_id":"e23b4d26-4498-4661-bff8-d1c5facd7bdb","resolution":{"observed_at":"2026-08-05T11:57:17.194612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16033","last_updated":"2025-09-03T03:41:08Z","snapshot_observed_at":"2026-07-06T19:37:07.379149Z","submitted_at":"2024-10-18T04:38:21Z","title":"TreeBoN: Enhancing Inference-Time Alignment with Speculative Tree-Search and Best-of-N Sampling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16033","snapshot_observed_at":"2026-08-05T11:57:17.198660Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.198660Z"},"links":{"cited_paper":"/paper/2410.16033","citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:a73e6860078fcea9892ff586430bf345f443bbbbe07d4435e90ae63bf1076835","observation_id":"c266c17b-4bbe-4c14-a8b9-b450801b6029","resolution":{"observed_at":"2026-08-05T11:57:17.198660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T11:57:17.203309Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.203309Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:b199ef2072c607c596335bf17f276e2bd4474b925c3113983a07d5e599f79d46","observation_id":"509ee550-866c-4896-8ebe-960f1fe8c9d4","resolution":{"observed_at":"2026-08-05T11:57:17.203309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.744875Z","title":null,"venue":null,"work_id":"5b1bf3ea-cc72-46d4-8c72-1dd12c07fe73","year":2015},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.208210Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:6f35b1dd8b5c0ea92f1b47efcf6be0c516629f2f48e66e32bd7861d8982ab180","observation_id":"04a8acd0-7b26-4efa-854d-20f1bf1a13b3","resolution":{"observed_at":"2026-08-05T11:57:17.749532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.730413Z","title":null,"venue":null,"work_id":"2f734da6-037d-4ae1-a2a8-a39d5fb35e55","year":2013},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.212218Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:1455cadf11aef444ea51806d5513582ceebb177e5dac9c50ed2b7e7a73537eed","observation_id":"f9a92daa-1f23-4d7f-ac87-7567485d0efa","resolution":{"observed_at":"2026-08-05T11:57:17.734489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.715881Z","title":null,"venue":null,"work_id":"1b93bbc5-c35f-417f-81bb-9a884ccc4fc4","year":2023},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.216064Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:470507450ffa7ce6a0f975997c5ef4dcecaf33f280b5ff73c174acb0c53fce1f","observation_id":"65273ceb-6a4d-4eb7-ab27-4ff2ade810b1","resolution":{"observed_at":"2026-08-05T11:57:17.720097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.700751Z","title":null,"venue":null,"work_id":"e063be27-9b33-4d94-88af-ad2c0f90ab0a","year":2023},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.220188Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:7a153ee4e2ad4e6e1d1628c504dac30b4110f7f7c1c1e1c30be59470a8504cc1","observation_id":"324a6c31-86b4-420a-888f-0b02322b2b8e","resolution":{"observed_at":"2026-08-05T11:57:17.705310Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.224316Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.224316Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:70369399fe5630f21468a412e27355fe7ed0301936d051548db8d5dde2a900b1","observation_id":"1d75041c-d04c-407a-a219-1a13e8945aee","resolution":{"observed_at":"2026-08-05T11:57:17.224316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.676346Z","title":null,"venue":null,"work_id":"c9033c4b-f4f8-4334-9552-c063ba8cc0fd","year":2024},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.228965Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:d807d43c32a8bef7db92bb5cbbf2b789e456e071326a2260990038695a87b81d","observation_id":"60d893ea-1597-4763-9791-91d1b4f62f40","resolution":{"observed_at":"2026-08-05T11:57:17.680668Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.661782Z","title":null,"venue":null,"work_id":"45084c08-698f-4573-8f4f-86fb4d51f774","year":2023},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.232985Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:beacf3bedf21dc8d2e53e95cb7791ad27421fdcf86feca54634b7da06aa3c4b0","observation_id":"40a982e5-ef36-4df9-9b57-8794f38db75d","resolution":{"observed_at":"2026-08-05T11:57:17.666062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.647055Z","title":null,"venue":null,"work_id":"61e32a12-8be7-4cf4-85fd-09dd07d2fd46","year":2023},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.237103Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:2529bea32249eb51e6f80bf520376fefb66ab68790751ec5c941651bdfd7bd43","observation_id":"420fffb0-6471-4d2c-9441-8ffda85c88f6","resolution":{"observed_at":"2026-08-05T11:57:17.651568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.631281Z","title":null,"venue":null,"work_id":"e78a48ee-8e2d-4bdd-9e6d-861b76088dbb","year":2021},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.241091Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:dfbf57e34498e5bdc2727ecd76f0a5eebbf8e8905bc7f83f0f45916baf6e48c0","observation_id":"1e339af1-e62b-49c2-8f8b-6aa90c937897","resolution":{"observed_at":"2026-08-05T11:57:17.636106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14638","last_updated":"2025-02-20T15:21:35Z","snapshot_observed_at":"2026-07-06T20:39:52.280081Z","submitted_at":"2025-02-20T15:21:35Z","title":"NAVIG: Natural Language-guided Analysis with Vision Language Models for Image Geo-localization","version":1},"cited_work":{"arxiv_id":"2502.14638","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.14638","snapshot_observed_at":"2026-08-05T11:57:17.292525Z","title":"NAVIG: Natural Language-guided Analysis with Vision Language Models for Image Geo-localization","venue":"cs.CL","work_id":"3a5a9943-f8b1-4f8b-86fb-95ea2648bb04","year":2025},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.245721Z"},"links":{"cited_paper":"/paper/2502.14638","citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:d0bf5619a6f7cc2608c525b7e6e26bd259b5c48a4ec9fba3b8aade66c142fab1","observation_id":"ee72edad-a407-4f03-a9d5-32a6ed516ff4","resolution":{"observed_at":"2026-08-05T11:57:17.299591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.250154Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.250154Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:afaea177e343af77df4947dc2a470ddf17846d945e804757f0dcfe41f769dd13","observation_id":"3f7f82c3-67a0-4d0c-8d48-1ca3b9fa2d63","resolution":{"observed_at":"2026-08-05T11:57:17.250154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:57:17.255005Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T11:57:17.255005Z"},"links":{"citing_paper":"/paper/2509.02129"},"observation_digest":"sha256:0df78e1cf69b73fdfa8e6d5777e7d72e6ca0c2c7a0b631d2e1738e9a6b41ebc9","observation_id":"d131aa0b-05ae-48fe-a02e-1a6a066da91a","resolution":{"observed_at":"2026-08-05T11:57:17.255005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.02129","last_updated":"2025-09-02T09:25:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T11:57:14.896890Z","submitted_at":"2025-09-02T09:25:13Z","title":"Scale, Don't Fine-tune: Guiding Multimodal LLMs for Efficient Visual Place Recognition at Test-Time"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2509.02129."}