{"as_of":"2026-08-17T05:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8aa73b01bd4448db069a36324b223c9601202795b205d1324a5e8c37da00b83f","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:25:17.677115Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.08781/citation-record","integrity":"/paper/2508.08781/integrity","json":"/paper/2508.08781/citation-record.json","paper":"/paper/2508.08781"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:28.794488Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":"fc41a84b-e5f4-432f-8c6d-cace3fcdea9c","year":2017},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:13.161460Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:058135788dc7aa87fb79639081a621529ed0642097263b0f442cc0ec1100ddc2","observation_id":"908425ca-f249-4141-8a1c-91594e33ddf0","resolution":{"observed_at":"2026-08-05T21:25:28.854476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:28.594928Z","title":"Matterport3d: Learning from rgb-d data in indoor environments","venue":null,"work_id":"0686fa2d-d752-4b02-8e6a-d467018e0b24","year":2017},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:13.322846Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:096ead9416c9154ca23866f50c421451f93605f52656e472051a1e373b9a65c4","observation_id":"c6ee75ca-2bce-45d9-9358-348bfe27eefc","resolution":{"observed_at":"2026-08-05T21:25:28.675005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:28.453549Z","title":"3d-future: 3d furniture shape with texture","venue":null,"work_id":"eeb13fdd-d21a-4c54-a23e-0749f799d9cc","year":2021},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:13.416523Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:1e12dbf0c8ef7cbe3a3e199071f8b160ed48b807b7583aba7939e5f8df5485a3","observation_id":"9c8f2c4d-223c-43cb-aa5c-408581fe01a0","resolution":{"observed_at":"2026-08-05T21:25:28.512740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:28.254218Z","title":"Referit3d: Neural listeners for fine-grained 3d object identification in real-world scenes","venue":null,"work_id":"c755d385-030e-4bfd-89a1-707d17e1c64d","year":2020},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:13.497984Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:aa06d66cbd1c4b1bfe0a03ae7b031f2cded21d964018a394277299307c5a06e5","observation_id":"54a1b864-86e7-48d2-a345-580ccbfe57a2","resolution":{"observed_at":"2026-08-05T21:25:28.357745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:28.045502Z","title":"Scanrefer: 3d object localization in rgb-d scans using natural language","venue":null,"work_id":"ccd33831-f4c6-498a-88ff-01a63d76b571","year":2020},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:13.607607Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:f3fe0e5a1b6c15c0243db18b39ff36dbd1435a74e04b25eef5a667653b2cbdd6","observation_id":"0d543063-92a7-4896-afd9-ef32c2ba2958","resolution":{"observed_at":"2026-08-05T21:25:28.156284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:27.839526Z","title":"Vigil3d: A linguistically diverse dataset for 3d visual grounding","venue":null,"work_id":"19f1f04a-4d26-4312-97b1-a5ffe9122999","year":2025},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:13.724139Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:38e376707fc6790b502c159f7ae5b57fcb7e0195a43ab38beecbf9c0ced8e015","observation_id":"98ecac41-2724-4359-a618-c53dc2ad1830","resolution":{"observed_at":"2026-08-05T21:25:27.948099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:27.600252Z","title":"2D Image-Based 3D Scene Retrieval","venue":null,"work_id":"becb35bc-5292-4dc5-a7b6-beea66ee4f6e","year":2018},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:13.803739Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:0da4bc33e464f2ec5bb39adfbce234cd896dd6363606b1c780d3679d88fa3a9c","observation_id":"7d414922-00a9-4ed6-b0fc-a1b8dbd4161e","resolution":{"observed_at":"2026-08-05T21:25:27.710291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:27.433695Z","title":"SHREC’19 track: Extended 2d scene image-based 3D scene retrieval","venue":null,"work_id":"36c6358d-1b5b-4dd2-bc16-203562e0f37d","year":2019},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:13.874240Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:ba3d30e281028649d0ad081f931d97c7ef2372cce1e68a85d3105d7f96ed93ee","observation_id":"eac076f4-b0a8-45bc-9b04-ae676ec8d509","resolution":{"observed_at":"2026-08-05T21:25:27.508957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:27.239973Z","title":"SHREC 2019- monocular image based 3D model retrieval","venue":null,"work_id":"9ade999e-2833-49ad-9833-44ff8dc42a44","year":2019},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:13.984373Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:3e9ee95cbbe4576af7fd980f5d592928166865505b64cc847065d3f99cdbe7b6","observation_id":"4ce0ebc7-7e0e-4519-9837-9d31f55e9d93","resolution":{"observed_at":"2026-08-05T21:25:27.329756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:27.037788Z","title":"SHREC 2020 track: extended monocular image based 3d model retrieval","venue":null,"work_id":"00d418ac-f52c-48d7-a463-92112a83a3c0","year":2020},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.062921Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:bbdf2d6c8a62556a6a176b83f1f025dd8bc139b4a088b0016a30051ab594120d","observation_id":"41029d4c-0c40-4def-a64d-b4c590d4be2d","resolution":{"observed_at":"2026-08-05T21:25:27.115793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:26.811974Z","title":"SHREC’22 track: Open-set 3D object retrieval","venue":null,"work_id":"55ee70e6-81be-49c5-9ed2-fc2db2cf08ca","year":2022},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.175559Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:2356e7f17f4974ba4b88d457f132fc1111af4d144cb020fab4dfeca6e4377326","observation_id":"c02271db-68dc-4c24-8ccf-f8d73acad5ee","resolution":{"observed_at":"2026-08-05T21:25:26.885801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:26.596116Z","title":"Shrec’22 track: Sketch-based 3D shape retrieval in the wild","venue":null,"work_id":"eb0b212b-a4f1-4d77-9422-80623d33aeb1","year":2022},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.293566Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:db2d8ca020471fd90b951842b8183b06911c761557920993d73f0b9a608d603d","observation_id":"727da715-548e-4968-b5c1-f02e45b39242","resolution":{"observed_at":"2026-08-05T21:25:26.702204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:26.368809Z","title":"Sketchanimar: Sketch-based 3d animal fine-grained retrieval","venue":null,"work_id":"4c76ef3f-9cb1-45f4-a099-e55be369d3fc","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.406030Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:05296850a607e198b48c4aa5f6d130b6e9e971e551ab7c8d3320f665973841df","observation_id":"aabbc13d-32c0-491f-a087-50efad8448dd","resolution":{"observed_at":"2026-08-05T21:25:26.459662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:26.143643Z","title":"Textanimar: text-based 3d animal fine-grained retrieval","venue":null,"work_id":"92a9d02c-b467-4f4c-a2c0-2f20fff9d79d","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.520462Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:96cb82c8e0fa82a46366e01e1bf086b9ab864444fd61ab388e91c93a60297047","observation_id":"8cad2707-da89-4c5c-9a44-2a88304525fc","resolution":{"observed_at":"2026-08-05T21:25:26.270129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:25.878638Z","title":"Multi3drefer: Grounding text descrip- tion to multiple 3d objects","venue":null,"work_id":"5ee469d5-da47-4fb1-b72f-2ead722514f5","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.600140Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:4608d1d07bbd586b2fc49d026d91f919537e790c2101c8d629ff2c23eac8fe18","observation_id":"5fa9aee1-d699-4a35-aa2c-aed2553f0fb3","resolution":{"observed_at":"2026-08-05T21:25:25.996119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:25.577450Z","title":"Referitgame: Re- ferring to objects in photographs of natural scenes","venue":null,"work_id":"f2598126-f340-4447-983f-892af0eda93c","year":2014},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.672220Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:846fa7db5f4d21dee41ae89487b97f4fe48a3aa013bd43dccc4d36b8408b7cec","observation_id":"b42c0903-5264-4d00-97df-fe311a848d0d","resolution":{"observed_at":"2026-08-05T21:25:25.738564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:25.290527Z","title":"Generation and comprehension of unambiguous object descriptions","venue":null,"work_id":"941dedc7-19dc-4f4e-9fbf-f0bbb5d98f05","year":2016},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.746469Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:6e8e6b33c52dc2f4978c92ebd547ec95368428274e61ad9aa99dcfb7fb97928e","observation_id":"b049efca-5fc8-48ba-8501-15e632697b7b","resolution":{"observed_at":"2026-08-05T21:25:25.413430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:25.035075Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"eeb81e75-0527-48d3-9913-e399e4c2b08c","year":2014},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.857670Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:57b75f33026e085de75f285cd652f832e77455fd37252627b678f9b66c09be74","observation_id":"3add20de-8449-4727-81f4-469bb3ed41c8","resolution":{"observed_at":"2026-08-05T21:25:25.151296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:24.741441Z","title":"Mat- tnet: Modular attention network for referring expression comprehension","venue":null,"work_id":"a6cbe38e-99a5-45da-aaab-f027257b78ef","year":2018},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:14.934659Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:91568d676c6b95ef9911c56091051996d49380a4d07432dbbbcf2b176752a691","observation_id":"1b206f2a-a1ce-4895-ae23-a073fa2f75e2","resolution":{"observed_at":"2026-08-05T21:25:24.894486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:24.377066Z","title":"Lavt: Language-aware vision transformer for referring image segmentation","venue":null,"work_id":"d0f8d53d-1e1a-4fab-9a69-b6e8f78e3180","year":2022},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:15.052393Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:119101a96e98f32d6d521b2ac8110dc4ff4b4ade0a255f0a516b4dd2f625bb66","observation_id":"9906e3ea-37b6-4bd5-8722-ff06bf744d3b","resolution":{"observed_at":"2026-08-05T21:25:24.569899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:24.051611Z","title":"Language as queries for referring video object segmentation","venue":null,"work_id":"b2d4e6b0-9cee-4168-b559-680c9c6703cd","year":2022},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:15.170560Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:6ff53fc352c88e122f151d76e2f973a88976396ce7e67f5d770b76ec65c79a1a","observation_id":"eb583db1-cb6f-4a8f-bd89-3c6a2df6aa74","resolution":{"observed_at":"2026-08-05T21:25:24.232623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:23.750481Z","title":"Masked- attention mask transformer for universal image segmentation","venue":null,"work_id":"8b9b6b35-7637-4448-85cb-e6d22991bd15","year":2022},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:15.280592Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:2ed158eac0eaa51e7bf0658d6863b41a8e063fad3781863e5449362fefaa6668","observation_id":"bde0f82c-a628-4a16-b3ff-a9bd6a4a39db","resolution":{"observed_at":"2026-08-05T21:25:23.913268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:23.496457Z","title":"Partnet: A large-scale benchmark for fine-grained and hierarchical part-level 3d object understanding","venue":null,"work_id":"74a4e6cf-f965-4576-9123-effe4bce1a8d","year":2019},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:15.390197Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:cdf20324025794c2434ab4882f45395b20bdcf30a93a97ff38821da866239197","observation_id":"71f5c14f-4d87-436c-964e-7f6e5effa588","resolution":{"observed_at":"2026-08-05T21:25:23.637999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:23.253862Z","title":"Point2cad: Re- verse engineering cad models from 3d point clouds","venue":null,"work_id":"476d6da1-8526-4192-83ce-b5115af790cb","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:15.575342Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:636f58e3edba4012368efe5aec564723cd6f32400f7d0a422c17d08d9a410c9d","observation_id":"79a5bf6e-3ed6-492b-9f36-107425363d91","resolution":{"observed_at":"2026-08-05T21:25:23.351673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:23.025455Z","title":"Mask3d: Mask transformer for 3d semantic instance segmentation","venue":null,"work_id":"cddbfbef-1d64-4a8a-b214-965aa748c715","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:15.684977Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:e6396a5bfc548dd038eecbda2e26d4339885e7aa972b3109272c8bf9f7ad2712","observation_id":"7448b06e-1ca2-457f-b2ec-9ee1bb59d801","resolution":{"observed_at":"2026-08-05T21:25:23.149860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:22.886378Z","title":"Refmask3d: Language-guided transformer for 3d re- ferring segmentation","venue":null,"work_id":"d329becd-3f95-4a1f-ab7e-405b565b9774","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:15.791327Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:db8cf155304610638cb8348965796df411420d0d2c13729eea94a3c95ec1abe7","observation_id":"21e17340-e1f2-48d5-a2d2-4084029708d2","resolution":{"observed_at":"2026-08-05T21:25:22.956126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:22.665457Z","title":"Segment any 3d object with language","venue":null,"work_id":"499e09bb-5090-4799-bb78-64e0f7c2507b","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:15.865239Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:d7188009aa4bc34d42418cb3a91d08841dd409cdb3bda70cae45b53e1c558fa3","observation_id":"00fde7c4-0c89-4834-85aa-f3f3c8dc2396","resolution":{"observed_at":"2026-08-05T21:25:22.768006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:22.482502Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"f7a8b39e-8723-417d-9d27-1b50b90148d5","year":2021},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:15.953163Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:7bf3a829a88dc1270dc17223e874a67e893640bc2b87cbf92fa58142c2408f4a","observation_id":"57ab3f5b-7194-4d3f-b3ba-a992e7751266","resolution":{"observed_at":"2026-08-05T21:25:22.558827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:22.212881Z","title":"Ulip: Learning a unified representation of language, images, and point clouds for 3d understanding","venue":null,"work_id":"861b071f-6ec5-4699-8c10-8a3056cacb75","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.083636Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:b26636ffaee156d867022da38334fe868267d2cf0ed2a9cca32ccce5f2357e65","observation_id":"c5f68a0b-cf18-45ed-b49a-0114f1839a43","resolution":{"observed_at":"2026-08-05T21:25:22.360633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:21.984204Z","title":"Ulip-2: Towards scalable multimodal pre-training for 3d under- standing","venue":null,"work_id":"f4ac6525-d267-41bd-822d-ccaefb0aa53f","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.220337Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:5cc32fc2acc3b0dc25b786f219c921e33fe275cde10134c5647e4334eff70acd","observation_id":"80557ae1-996b-4b35-8aab-db600304fd46","resolution":{"observed_at":"2026-08-05T21:25:22.093300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:21.752374Z","title":"Objaverse-xl: A universe of 10m + 3d objects","venue":null,"work_id":"d71c5b94-8bca-4842-9d22-a14f61435575","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.268945Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:5689ce209f09d541df4a97d3722b0323e8c204ade4b6892f1c34a7f4e09b5540","observation_id":"1811c936-cfdf-40dd-8b4b-44bd13e1fc07","resolution":{"observed_at":"2026-08-05T21:25:21.859885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:21.560048Z","title":"3ur-llm: An end-to- end multimodal large language model for 3d scene understanding","venue":null,"work_id":"83e36ead-10db-4ee1-ae3c-98b0d90f6092","year":2025},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.293856Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:bdbad16a13e8c346c1163f1bde4d6f403eb1dbcf5262019354541c67e02ded28","observation_id":"5038030e-26b9-4dbb-aadc-9c0b6ed5c010","resolution":{"observed_at":"2026-08-05T21:25:21.671040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:21.368591Z","title":"Shrec’14 track: Extended large scale sketch-based 3D shape retrieval","venue":null,"work_id":"49206198-96a0-4ff8-be95-c1155b00ded8","year":2014},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.313808Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:c2021f636479f565ad5d7341269ac66069b8343f779d36d26bacc18e9f30f9ff","observation_id":"e5cb46bc-f9f4-485e-8324-2fd973cf68c3","resolution":{"observed_at":"2026-08-05T21:25:21.477746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:21.136785Z","title":"Shrec’19 track: Extended 2d scene sketch-based 3D scene retrieval","venue":null,"work_id":"57b6fb7c-eab5-4a87-a4c1-e0714188a3ac","year":2019},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.346368Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:a5125dc64746918597e05f0cc4cd6283b3f60dc8a5b2fa1099c3de7c20df8a72","observation_id":"be49a04d-cd1c-4147-bf70-ecbaabfb8ece","resolution":{"observed_at":"2026-08-05T21:25:21.243865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:20.982856Z","title":"Llama: Open and e fficient foundation language models","venue":null,"work_id":"b10815b4-4aee-4b5e-8800-01ef3bd157b4","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.397587Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:926472bcd1af5abe8ec795514da06f962a585541aa164a731eebcc07982a1cd2","observation_id":"c0b136c7-ae59-46d3-b211-208454d868df","resolution":{"observed_at":"2026-08-05T21:25:21.052840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:20.745868Z","title":"Sigmoid loss for lan- guage image pre-training","venue":null,"work_id":"9fb44e27-21f6-453d-98ca-1d3b7e8e5d76","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.452044Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:5a391a5dd35b4a87d5c4f7601bdb64b8f1000d2a231270471af2c1ecb5209967","observation_id":"5e4e45af-8777-49da-a876-d63683d32337","resolution":{"observed_at":"2026-08-05T21:25:20.863625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:20.419267Z","title":"Scaling instruction-finetuned language models","venue":null,"work_id":"5c64825d-c48a-4540-b0ad-26355626a5e9","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.553225Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:94456278570611f3c93cf8213170d47c2f387ed94c31ccc67d8624998919b57f","observation_id":"62f3a624-0279-4398-9612-2c5f00bbdd7f","resolution":{"observed_at":"2026-08-05T21:25:20.575769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:20.090457Z","title":"C-pack: Packed resources for general chinese embeddings","venue":null,"work_id":"b1428b37-1e21-4384-867e-231a891a933d","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.718367Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:4a6161509ccff699e6bfaeb870d881d203b2dfb9972dcde216cd8bbf028cccd3","observation_id":"1c43f6dd-b8a1-4864-ab99-3a7bd87b6d7b","resolution":{"observed_at":"2026-08-05T21:25:20.252637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:19.821318Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"82b7df87-e953-4d78-b1fb-8851463b64f8","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.783471Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:41f1eccf6cd58670e9599747e3a4dacf000a893253bd8be91d020ea2f8603124","observation_id":"8d8cacc6-f7a5-4bc8-a672-20da75f6b208","resolution":{"observed_at":"2026-08-05T21:25:19.938726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:19.551157Z","title":"Point-bert: Pre- training 3d point cloud transformers with masked point modeling","venue":null,"work_id":"477793aa-dac4-4f18-8bff-24677ccefb8e","year":2022},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.860381Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:75ef4f09a19ee1f9fff2a30c90663ad9306e5c60b44b1434ef174632937e7e08","observation_id":"0566c228-841f-482f-9f83-e0ed6531b04b","resolution":{"observed_at":"2026-08-05T21:25:19.660909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:19.255356Z","title":"Openshape: Scaling up 3d shape representation towards open-world understand- ing","venue":null,"work_id":"0ac7ed3d-422c-46dd-b2c7-9cd88c4e8214","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:16.924365Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:5b9b47a61d1e7c98f0c750d5272e37994449ded66ecd4381c4f0e9a00e657e70","observation_id":"6c895884-222c-478a-bc7a-2c228b6cb2d2","resolution":{"observed_at":"2026-08-05T21:25:19.378025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:19.115279Z","title":"Panoformer: panorama transformer for indoor 360 ◦ depth estimation","venue":null,"work_id":"aa29c6b8-ceb3-4598-baf1-477335e30f20","year":2022},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:17.000637Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:8bcc4ceb26063c7ad091293cdc0946d1fe3fcb8197cda0d4c661dee075310765","observation_id":"9f94caa9-3555-41c8-949d-6c19c09cd5db","resolution":{"observed_at":"2026-08-05T21:25:19.171635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:18.873053Z","title":"Florence-2: Advancing a unified representation for a variety of vision tasks","venue":null,"work_id":"27655d6a-b3b8-4475-b793-ee060aa3b035","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:17.064923Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:bca47d2fbeb207440cef42325444f4466bdf249afa06b06dea6e50cccfef5c77","observation_id":"b7d45613-40e5-4150-8254-f0e1574ff875","resolution":{"observed_at":"2026-08-05T21:25:19.009548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:18.729267Z","title":"Yolov11: An overview of the key architectural enhancements","venue":null,"work_id":"b3903884-99ec-4e4c-8331-d6ef5fa589dd","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:17.226238Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:00e3a7b2fc99f21b017c8f975894ca16ed774bb8156719305bf7d885800fc432","observation_id":"5a958535-9815-456b-af78-624a2f4cdc32","resolution":{"observed_at":"2026-08-05T21:25:18.784683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:18.510092Z","title":"Exaone 3.0 7.8 b instruction tuned language model","venue":null,"work_id":"c3827834-4018-46fe-96ff-659011a94603","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:17.329602Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:ed27a023e2f3de36e22c21586173f9d50d3b12fec705e94c2176087bbb30a1bc","observation_id":"b4184087-79fa-4ec8-b4a7-bbb284299f3e","resolution":{"observed_at":"2026-08-05T21:25:18.608849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:18.319491Z","title":"Zero- painter: Training-free layout control for text-to-image synthesis","venue":null,"work_id":"67f51bb5-2b4c-4b31-94f1-45ea1a72ed51","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:17.439074Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:4525b02b8763f310856f5fd51d514ccf0fd4443c87d9f2c92c354670dabb6c14","observation_id":"74cff093-7cf5-42f4-90f7-a474f86c80e9","resolution":{"observed_at":"2026-08-05T21:25:18.410207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:18.126112Z","title":"Enhanc- ing the reasoning ability of multimodal large language models via mixed preference optimization","venue":null,"work_id":"301e3d7b-5754-4deb-8844-d0f55cf4d02d","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:17.505731Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:ad5adff40450886f4c8237a85398dc100444cdc4e5608210d8dde862e1cbd218","observation_id":"9b39378d-6b1d-409e-a051-c6aa4e8cfa39","resolution":{"observed_at":"2026-08-05T21:25:18.217754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:17.954423Z","title":"Reproducible scaling laws for contrastive language-image learning","venue":null,"work_id":"4ee5af04-2c17-4bb9-b4b2-e47f874e50ad","year":2023},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:17.579956Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:8f0d1772c3de8d0d13e46355df68bd4b8bbb528e0c2cd55506cdd6bf151e74c9","observation_id":"2a23ca6e-6f77-4f49-a04d-302b39384ee2","resolution":{"observed_at":"2026-08-05T21:25:18.042020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:25:17.846764Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling","venue":null,"work_id":"6ed835d9-cea8-4be0-957c-cacc732c0599","year":2024},"citing_paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T21:25:17.677115Z"},"links":{"citing_paper":"/paper/2508.08781"},"observation_digest":"sha256:b30a4d108f45dd92b395706e39d7360f3966dd06c0a53371d5c51e629fec6459","observation_id":"fc105b44-ad2b-4b5d-a186-507712f81c5b","resolution":{"observed_at":"2026-08-05T21:25:17.869062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.08781","last_updated":"2025-08-12T09:36:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T21:25:06.247108Z","submitted_at":"2025-08-12T09:36:05Z","title":"SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":49},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2508.08781."}