{"as_of":"2026-08-19T14:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b279f79f50b9d2a4f634623a97d5516a1090534d7d8bf68d19e6646aeaae6952","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:49:42.241870Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:24:15.644051Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17826","snapshot_observed_at":"2026-08-04T08:24:15.644051Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.21151","last_updated":"2026-05-28T16:26:50Z","snapshot_observed_at":"2026-08-16T13:54:56.832878Z","submitted_at":"2025-10-24T04:45:29Z","title":"VOGUE: A Multimodal Dataset for Conversational Recommendation in Fashion","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T08:24:15.644051Z"},"links":{"cited_paper":"/paper/2504.17826","citing_paper":"/paper/2510.21151"},"observation_digest":"sha256:0bc8ccb8243d5c6aa7911470a09ec16eb023300a6e3f3d364ad49979774ddf79","observation_id":"76cc31d9-f9ee-4b35-ab27-39f79bf088c2","resolution":{"observed_at":"2026-08-04T08:24:15.644051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.17826/citation-record","integrity":"/paper/2504.17826/integrity","json":"/paper/2504.17826/citation-record.json","paper":"/paper/2504.17826"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.967797Z","title":"A comprehensive review of circular economy research in the textile and clothing industry,","venue":null,"work_id":"7c459a75-943a-4170-9cfb-f4a76e261000","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:41.983098Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:75e3d4f57ec783edfe5c278636b7de2dfdf73a6517e24dfb25a6abd279687a07","observation_id":"d6ebd7ef-2cab-4eda-bdae-30207a101239","resolution":{"observed_at":"2026-08-16T10:49:42.971514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.956065Z","title":"Hybrid recommender systems: Survey and experiments,","venue":null,"work_id":"e650b7e5-3378-47a5-9f1b-6e369511a9c0","year":2002},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:41.988436Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:954f1c8bad44a03deeb6f1a361d0ffbd79cac4c01c7a6ec0e6c9db7719b8c707","observation_id":"fcf3f090-d082-49b4-9eef-9bbd07afcae3","resolution":{"observed_at":"2026-08-16T10:49:42.959647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.937159Z","title":"The evolution and future of retailing and retailing education,","venue":null,"work_id":"c57f463a-9328-4005-89e5-4d740c4fcd5d","year":2018},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:41.992451Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:3317a3cff345fae1b7d0478682baba4967061bce58cbecbf677326cea8ac6226","observation_id":"d218ef83-bad9-47f6-8aab-61276da57a93","resolution":{"observed_at":"2026-08-16T10:49:42.947233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.925935Z","title":"Knowledge management and fashion retail performance: the moderating role of product complexity,","venue":null,"work_id":"19d706bb-ff4f-4a1e-a656-92d48162f43f","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:41.996628Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:a3bfe620dec7256a553e9d48ef9fb5663444373d768819a55f7af12456f98a50","observation_id":"9b3de4e0-b6be-4c35-82ad-b2b98c55be52","resolution":{"observed_at":"2026-08-16T10:49:42.929603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.915214Z","title":"Assembled or unassembled? different types of outfit coordination presentations in online fashion retailing,","venue":null,"work_id":"2c4b0c5d-b0b9-44e6-a18b-a6ea1f23c028","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.001584Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:5a701a7dca7d0825da1e6650da845fd5343a4ed03985658ae2acd8616b9a42a0","observation_id":"23df6d15-1792-4a65-935f-0afdd43daaa5","resolution":{"observed_at":"2026-08-16T10:49:42.919311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.904724Z","title":"What is the future of fashion retailing with generative ai? understanding consumer response through twitter data,","venue":null,"work_id":"3e82afbc-3ddb-425e-aa56-7271cd39626c","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.005660Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:2365e6233fd3eae92db8feba8aa102a4d8ca9ca164eecad2926aed55a3cac94f","observation_id":"5ca171eb-9269-4c97-a562-889fcffe719a","resolution":{"observed_at":"2026-08-16T10:49:42.908261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.894117Z","title":"Modeling fashion compat- ibility with explanation by using bidirectional lstm,","venue":null,"work_id":"19e27ec6-5b1a-4030-ad02-f3dcafad8f4e","year":2021},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.009696Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:49800fa96eaeb28c22818327cd1be17fc464752f0109a39379225901777107ce","observation_id":"4ad9fe94-f38e-4dd2-a3c9-4d6bcad1399a","resolution":{"observed_at":"2026-08-16T10:49:42.897964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.882079Z","title":"Fashion forward with ai creations using gan,","venue":null,"work_id":"da26bca9-4e4b-4dd0-904d-23e45d43cac8","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.013260Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:3698cc7a0bd1a0eb7a956ea12f7b0f64a60f602a1860c0629f807d3b6c31ab64","observation_id":"d601fc5b-cceb-45db-aaa9-3992d260555b","resolution":{"observed_at":"2026-08-16T10:49:42.886767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.871070Z","title":"Per- sonalized clothing recommendation fusing the 4-season color system and users’ biological characteristics,","venue":null,"work_id":"c8f29851-1846-47ae-873f-2288d5a7f8df","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.016917Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:7d54adbcdaf1375f723e1b92cf25da737ddb35887f524c73c21548e1a997ffe7","observation_id":"9bdba344-d270-45c8-831f-9acbb7fc60a0","resolution":{"observed_at":"2026-08-16T10:49:42.874852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.859830Z","title":"The impact of servitization on perceived quality, purchase intentions and recommendation intentions in the ready- to-wear sector,","venue":null,"work_id":"0f723227-0b21-45fb-b263-822aaaa1e0c2","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.020743Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:01ce88c31bb4674b717461da013b1aeaf130fcf24923f9cd1a83697003a4d139","observation_id":"59e376e9-40cc-4bf9-b4ac-aff76ccb13df","resolution":{"observed_at":"2026-08-16T10:49:42.864199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.024872Z","title":"An intelligent recommendation system in e- commerce using ensemble learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.024872Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:0036444409ec0421fac6fe9f8a8b6632a246e315c66ee9e966a79f6946fb6f81","observation_id":"38e67e14-3b44-4658-b088-1724cfc4be93","resolution":{"observed_at":"2026-08-16T10:49:42.024872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.841527Z","title":"Learning binary code for personalized fashion recommendation,","venue":null,"work_id":"a1ad7233-2665-4e23-8acb-ee7c04028729","year":2019},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.029645Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:0946c88be7cba9a71a71fa00775ea3728dabdeed16014b4c6e9fdcf3655fd781","observation_id":"49df58c6-66c3-4346-b453-a6c04b04f727","resolution":{"observed_at":"2026-08-16T10:49:42.845495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.829882Z","title":"Learning similarity conditions without explicit supervision,","venue":null,"work_id":"280c506c-77d5-4aea-9469-017bec30fe87","year":2019},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.033751Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:b1eeebe2b5e93e830b802fbc5d964640fef7d0b0474f6fcb1e8e2aee7013d620","observation_id":"4223bc97-087a-481f-a5ba-41adcf0c4843","resolution":{"observed_at":"2026-08-16T10:49:42.834856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.818534Z","title":"Fashion outfit complementary item retrieval,","venue":null,"work_id":"adaad9dc-97f6-431f-b97c-d285dd5f66b5","year":2020},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.037131Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:e4911bda3a6bd7a4013a43abc1e240aa63ffda6c9f6053a7fb76f7f91dca1d8e","observation_id":"03888240-d1d9-4143-8b86-8b4e385d7eb9","resolution":{"observed_at":"2026-08-16T10:49:42.823103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.807146Z","title":"Learning type-aware embeddings for fashion compatibil- ity,","venue":null,"work_id":"4b0e78f8-368a-4154-b9dc-80900bed1bb9","year":2018},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.041190Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:21c1749db3edd241f935c36651cefecdd5ec63c2db317afa13320c336cc1d689","observation_id":"92a3a12c-c34c-420d-af64-dcc1710a4e3e","resolution":{"observed_at":"2026-08-16T10:49:42.810800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-16T10:49:42.044957Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.044957Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:d5824fdaae6d62ecdb846fb6aed4b6a831dd95c41cfadbf8b20a531a0c803776","observation_id":"04f470de-a5e3-48ae-b05e-2d1148969b2a","resolution":{"observed_at":"2026-08-16T10:49:42.044957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.049567Z","title":"Diffusion models beat gans on image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.049567Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:da28ce7aafabed8378a00b542f81d691038b05fdc8d32fd91bccff6787fe1707","observation_id":"34b984d3-b27b-4c79-a915-5db6fe7bb0d9","resolution":{"observed_at":"2026-08-16T10:49:42.049567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.786599Z","title":"Outfitgan: Learning compatible items for generative fashion outfits,","venue":null,"work_id":"8ebed125-fd99-4b98-b755-cdb8932f5615","year":2022},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.053741Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:e3444d300225cf2fd33dd25089375859e64792e12f729045eb3530647f6eb5d1","observation_id":"916039de-4ea0-4f87-8ab9-33d0d13958cc","resolution":{"observed_at":"2026-08-16T10:49:42.790837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.774717Z","title":"Diffusion models for generative outfit recommendation,","venue":null,"work_id":"cec2ff91-e037-45b1-bcc1-abd676ac31e2","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.057222Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:9570e8012b7eb6fa70f7c40f7baac095baa4835d5263a0d52d1b8497d6bb3553","observation_id":"35468094-ca76-446a-8c53-f5ee30af0b12","resolution":{"observed_at":"2026-08-16T10:49:42.779867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03516","last_updated":"2024-02-25T17:56:29Z","snapshot_observed_at":"2026-08-16T15:42:05.067630Z","submitted_at":"2023-04-07T07:20:16Z","title":"Generative Recommendation: Towards Next-generation Recommender Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03516","snapshot_observed_at":"2026-08-16T10:49:42.060893Z","title":"Generative rec- ommendation: Towards next-generation recommender paradigm,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.060893Z"},"links":{"cited_paper":"/paper/2304.03516","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:8140720a2e4e83c1c52da9c096fab5fe4d748b5aa8b6de3db909da23017460d0","observation_id":"b4065064-c0a2-496e-b449-ba67dcf1f27b","resolution":{"observed_at":"2026-08-16T10:49:42.060893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15696","last_updated":"2025-01-03T21:49:44Z","snapshot_observed_at":"2026-08-19T05:41:44.296805Z","submitted_at":"2025-01-03T21:49:44Z","title":"Integrating Domain Knowledge into Large Language Models for Enhanced Fashion Recommendations","version":1},"cited_work":{"arxiv_id":"2502.15696","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.15696","snapshot_observed_at":"2026-08-16T10:49:42.389320Z","title":"Integrating Domain Knowledge into Large Language Models for Enhanced Fashion Recommendations","venue":"cs.CL","work_id":"daa8132d-1495-4993-9815-862e474c1dce","year":2025},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.065843Z"},"links":{"cited_paper":"/paper/2502.15696","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:892f0d8ffa582a03d86b7c7e7c71445e6317371a4696914040537cfb7aa15ed3","observation_id":"7cc38f3c-14b4-4d98-bd98-e1e07b7ba541","resolution":{"observed_at":"2026-08-16T10:49:42.393472Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.760974Z","title":"Fashion recommendation systems, models and methods: A review,","venue":null,"work_id":"004c69b0-7210-4d99-b4ab-3587bc5684b3","year":2021},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.069789Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:5dd8d6160fc8186721d9504a0a4806f8499a0913afc6f3549ac7deef6338645b","observation_id":"14a1073a-e31e-421d-891f-8695acba9703","resolution":{"observed_at":"2026-08-16T10:49:42.765987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.073654Z","title":"A review of modern fashion recommender systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.073654Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:5ad32c1e3d2c3af3089a9f8025204735f03b3c5341e42cdef3c9955d1bec2308","observation_id":"113184b5-5842-4344-a21c-39fc651835f4","resolution":{"observed_at":"2026-08-16T10:49:42.073654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.749994Z","title":"Generative ai-based style recommendation using fashion item detection and classification,","venue":null,"work_id":"c78d3c7f-d473-49d8-9437-d8f6e5e4a247","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.078462Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:371d6246d7f909fda595fb8fa1e7a9d67f8ec8c67551476932b8ab56b9309844","observation_id":"6921501c-af88-4c7b-9c59-448a31e6dc66","resolution":{"observed_at":"2026-08-16T10:49:42.753901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.737379Z","title":"Fashioning consumer choices: recommendation, motivation, and purchase intention toward instagram commerce. a mediation analysis,","venue":null,"work_id":"b9b3eaae-7633-47f7-99d8-842e1b2ba03f","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.082462Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:f23877d1bea4f0c02fc945c0a065e0751a5c4db89f5a4feeb39731248a78b6ae","observation_id":"a8c9c96e-8d5b-48ba-a249-86473d7b7951","resolution":{"observed_at":"2026-08-16T10:49:42.742186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.087018Z","title":"Image-based recommendations on styles and substitutes,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.087018Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:679b1a2ea3a18c708380500c6130a0a6d90e27cba04e1e1eda1b45f2b64351e8","observation_id":"f1f6d656-2781-4b52-8244-2621037c24ec","resolution":{"observed_at":"2026-08-16T10:49:42.087018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.717103Z","title":"Category-aware mul- timodal attention network for fashion compatibility modeling,","venue":null,"work_id":"7438bc2b-9c6e-4994-9129-2353d0306cba","year":2023},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.090758Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:38f9c05044505cc13609ceb476521b36bb748022b0c3bbddc93da63d54ab8732","observation_id":"0bca17aa-a28f-42c9-b5b6-5b88cb44b3c1","resolution":{"observed_at":"2026-08-16T10:49:42.721727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.704982Z","title":"Toward explainable fashion recommenda- tion,","venue":null,"work_id":"e0885349-aaeb-4bf6-a0cd-2c3399d6fedd","year":2020},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.094854Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:4ebc204ace9404103a469427f451d071a38c822f1301596ae473295f9464b5e0","observation_id":"042a6278-ebe6-4b38-978c-22a76d2f86fa","resolution":{"observed_at":"2026-08-16T10:49:42.708638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.693870Z","title":"Collaborative fashion recommendation: A functional tensor factorization approach,","venue":null,"work_id":"32db3bbc-0dc9-44fa-8c23-d5eb892f0811","year":2015},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.098706Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:b7620cd8cee0edf30b0940adeffb7c723e316a5645dae440ed61f2f81d745a04","observation_id":"a3927eb3-d3e8-4692-8aef-b1b0668c5d92","resolution":{"observed_at":"2026-08-16T10:49:42.698118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.682346Z","title":"Personalized outfit recom- mendation with learnable anchors,","venue":null,"work_id":"a8eb98aa-d27a-447e-9c17-48f279dca957","year":2021},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.102562Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:ead46d4909fb492f468514b9d5e3a2d8f255370de033f35e4338177f6af7b9e6","observation_id":"1316061f-c01c-4588-9f1f-a089a484a63e","resolution":{"observed_at":"2026-08-16T10:49:42.686209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.671641Z","title":"Pog: personalized outfit generation for fashion recommendation at alibaba ifashion,","venue":null,"work_id":"f2a58a84-d324-41bc-a7bd-851e09a7f725","year":2019},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.106272Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:7166da0fdd194f7dbee9f152c36070db30f34e16a413f4673c29246331bdea17","observation_id":"689557c6-caa8-4125-a7ac-66f34705b0de","resolution":{"observed_at":"2026-08-16T10:49:42.675323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.661641Z","title":"Hierarchical fashion graph network for personalized outfit recommendation,","venue":null,"work_id":"4575224c-b2d9-45c5-9987-682591d89ac6","year":2020},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.109441Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:b8d272cdb41085c1f0007e793404bd3ef62898abc48f64d5d2b841363cb684a3","observation_id":"1ad6f48e-fef5-4b09-bca2-e00221bffbd0","resolution":{"observed_at":"2026-08-16T10:49:42.665113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.650715Z","title":"Learning visual body-shape-aware embeddings for fashion compatibility,","venue":null,"work_id":"843e9c69-e403-4f49-83b6-7645ef9bd884","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.113587Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:47dc4cd32204510d2ed357f0cb0359775b9bc2204f6f6b3047f8b53554f4e87b","observation_id":"ef82ee6d-951b-4985-b583-5a47653e21aa","resolution":{"observed_at":"2026-08-16T10:49:42.654748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.640093Z","title":"What dress fits me best? fashion recommendation on the clothing style for personal body shape,","venue":null,"work_id":"8cb4fcdb-3d9d-40b0-911e-75f1ab201114","year":2018},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.117841Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:44222ad713a8be9aa33758f8f8940620e210e72aabc555ce1a4e0a30c23e8053","observation_id":"5fb99c97-18b9-41f1-b963-e99a32d5fb3a","resolution":{"observed_at":"2026-08-16T10:49:42.644253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.630532Z","title":"Hairstyle suggestion using statisti- cal learning,","venue":null,"work_id":"ef00e02f-edca-4bd5-a268-d03f8df1dd13","year":2012},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.122070Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:7b00891d239bafe7c3d95b429f3f5456bfa779c8cd86ce76f5ba07af200ec4b3","observation_id":"29a7a6b5-98b0-4287-bff5-4720dd444ac4","resolution":{"observed_at":"2026-08-16T10:49:42.634137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.620452Z","title":"Wow! you are so beautiful today!","venue":null,"work_id":"a1df41b3-99b8-40ba-a761-9006fc077121","year":2014},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.126593Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:125ec4812a9a305272cb8e7cc609a98bef6904c1ccf90d4ab2c5cf78b5d0befc","observation_id":"9cd4eaef-68b1-4fc3-b6d2-2e5aa45f5ecc","resolution":{"observed_at":"2026-08-16T10:49:42.624114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.607851Z","title":"Show me the best outfit for a certain scene: A scene-aware fashion recommender system,","venue":null,"work_id":"ac8506f7-df56-4889-a968-2ce7bdd44ff9","year":2023},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.130137Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:f3039eddc93d5b11fc78909d898603e8acaaa7907cba5078c79a685805c7a39e","observation_id":"479a73d6-b855-4fb7-a791-04f0a7b11274","resolution":{"observed_at":"2026-08-16T10:49:42.612449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.598284Z","title":"A unified framework for outfit design and advice,","venue":null,"work_id":"e67e63ae-f626-4e08-8d5e-d5706af4b22b","year":2019},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.134807Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:796d3da232e20428cc8bfd7e1d35fd5ac9d826d85ae1395d17583e38a5b6e567","observation_id":"3ed2e207-a413-427c-b8c7-7d2406d0f19c","resolution":{"observed_at":"2026-08-16T10:49:42.601950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.587714Z","title":"Explainable outfit recommendation with joint outfit matching and comment genera- tion,","venue":null,"work_id":"d5a67e88-cd24-4d2d-83cf-a63453500c28","year":2019},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.138383Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:c54cde294d7aeb830df6d52c8ffe4d2674b4c03a32e5285c7fbaaff6d30c1a93","observation_id":"e3bada71-a438-4903-a925-ac57ad0a463a","resolution":{"observed_at":"2026-08-16T10:49:42.591247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.575883Z","title":"Fashion outfit generation for e-commerce,","venue":null,"work_id":"4cab1212-3e0c-47ad-a05d-94ec172e2334","year":2020},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.142267Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:a3d96e1e696b6c43362b33534a421c9c9b6a7af963bfca59775903611836c787","observation_id":"646017b4-2335-4d6c-972f-5092d7ea5605","resolution":{"observed_at":"2026-08-16T10:49:42.579433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.565102Z","title":"Fashion compatibility modeling through a multi-modal try-on-guided scheme,","venue":null,"work_id":"3466a9fa-c4e2-44b2-8200-20893dd107ac","year":2020},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.145936Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:c30c2e94323609ffd4b222977d93cdc16c6be3d4882a13a50c73929877e3b80a","observation_id":"2a76fc3a-6daa-4be9-a6e9-ef6e2d1dbd83","resolution":{"observed_at":"2026-08-16T10:49:42.568817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.553784Z","title":"Knowledge-guided compatibility mod- eling,","venue":null,"work_id":"8b9b81e2-d92e-49b3-8399-16708a80bbbf","year":2020},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.149821Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:7d6d10495f56b71d9d0237f13559c28c388fb809a58a5fcfa638386df1e4aae0","observation_id":"5acbc0c6-c13e-49f4-9325-de760b9d5a96","resolution":{"observed_at":"2026-08-16T10:49:42.557797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.542804Z","title":"Outfittransformer: Outfit representations for fashion rec- ommendation,","venue":null,"work_id":"8f52003d-f14f-4962-aa71-0f2ff372b472","year":2022},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.154104Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:440a0bc5fe42d1a30119ad6a77722bd06998af8dc9d67803f35881e4e912ae10","observation_id":"c0981c9f-6b8b-468d-8b05-8fca8f371a20","resolution":{"observed_at":"2026-08-16T10:49:42.546631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.531164Z","title":"Leveraging multimodal features and item-level user feedback for bundle construc- tion,","venue":null,"work_id":"57b58a83-834d-487a-9124-6bebe1305d5f","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.158153Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:813f76d1f5357cfd36e0cb7ed2e9862ee316512c560c7684137976f3a9d51c9e","observation_id":"fa579f24-0b81-4238-9cc0-a69009d914fc","resolution":{"observed_at":"2026-08-16T10:49:42.535235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.518660Z","title":"AI-Yo: Embedding Psychosocial Aspects In the Fashion Stylist Chatbot Design,","venue":null,"work_id":"2c7d9b72-af1d-4b69-b256-1f49a4b798c2","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.162563Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:184405ea9dc5c7a6f174ec881430d9e6c8c9c3ccdd8f87bd3225890aad56fab8","observation_id":"376f3bef-d490-4731-9cc0-b7ef31a06180","resolution":{"observed_at":"2026-08-16T10:49:42.523104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.506384Z","title":"Multimodal conversational fashion recommendation with positive and negative natural-language feedback,","venue":null,"work_id":"013e08ff-d62f-4d54-a48e-9bea2ca69667","year":2022},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.166391Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:d72194cc0bbd90ff6a9eb93f1753afab0caa762a73e25b956226f5370bc0851c","observation_id":"d412ecd8-1a2f-4cd2-a6c0-36e51fbaf25f","resolution":{"observed_at":"2026-08-16T10:49:42.510418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.495277Z","title":"Multi-modal dialog state tracking for interactive fashion recom- mendation,","venue":null,"work_id":"57f96949-4e41-4bd4-9a1e-b4a01a062281","year":2022},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.170570Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:0e66f552dcb4a810508ebd705e41481e675a661ced12e072b5e1a67c39249d2a","observation_id":"7a8317ee-331e-46d2-958b-9c597e62340b","resolution":{"observed_at":"2026-08-16T10:49:42.499440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-08-18T17:34:44.890427Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-16T10:49:42.174850Z","title":"Show-o: One single transformer to unify multimodal understanding and generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.174850Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:93b286447d908c152b089a9a26d6555cdb20c57c0b4bca4f73bfdfd0e9c5c867","observation_id":"0a18937b-87f2-4f53-9a82-2c1d43f8067c","resolution":{"observed_at":"2026-08-16T10:49:42.174850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07975","last_updated":"2025-03-24T08:33:32Z","snapshot_observed_at":"2026-08-19T14:16:58.804962Z","submitted_at":"2024-11-12T17:55:10Z","title":"JanusFlow: Harmonizing Autoregression and Rectified Flow for Unified Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07975","snapshot_observed_at":"2026-08-16T10:49:42.179374Z","title":"Janusflow: Harmonizing autoregression and rectified flow for unified multimodal understanding and generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.179374Z"},"links":{"cited_paper":"/paper/2411.07975","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:c7e58ea40dd8744537082263933aa02764260d88d031e18e3f6c742b222f1946","observation_id":"a3550611-3e6f-42f4-ad15-0d675fd31e71","resolution":{"observed_at":"2026-08-16T10:49:42.179374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19806","last_updated":"2024-10-08T08:39:04Z","snapshot_observed_at":"2026-08-19T14:13:35.819573Z","submitted_at":"2024-10-08T08:39:04Z","title":"Vitron: A Unified Pixel-level Vision LLM for Understanding, Generating, Segmenting, Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19806","snapshot_observed_at":"2026-08-16T10:49:42.183744Z","title":"Vitron: A unified pixel-level vision llm for understanding, generating, segmenting, edit- ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.183744Z"},"links":{"cited_paper":"/paper/2412.19806","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:c1e3a3d320500806d2036a6d6a4144bc2b4be3c1cfaf6cff3947962a58ea3483","observation_id":"2de4414d-15ec-4860-9b09-af3631469b4f","resolution":{"observed_at":"2026-08-16T10:49:42.183744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11305","last_updated":"2024-10-12T14:13:58Z","snapshot_observed_at":"2026-08-19T14:12:35.873976Z","submitted_at":"2024-08-21T03:17:20Z","title":"UniFashion: A Unified Vision-Language Model for Multimodal Fashion Retrieval and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11305","snapshot_observed_at":"2026-08-16T10:49:42.188238Z","title":"Unifashion: A unified vision-language model for multimodal fashion retrieval and generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.188238Z"},"links":{"cited_paper":"/paper/2408.11305","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:7d9719e00a633c868928559c946d9c34f7845df0b5094370ffe088b9d16e1f10","observation_id":"8023ea8e-1476-45c1-911b-9da72d5165bc","resolution":{"observed_at":"2026-08-16T10:49:42.188238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.484895Z","title":"Fashionai: A hierarchical dataset for fashion understanding,","venue":null,"work_id":"aa5cb6ee-cc8a-4d1c-a856-9f2009b82bf1","year":2019},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.192936Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:c177b2f4f1743cfb416839c24f17a456946970e562ad5389f77a2874a3534609","observation_id":"d103c76e-a62f-449e-bcc4-9db9d62144dd","resolution":{"observed_at":"2026-08-16T10:49:42.488566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06227","last_updated":"2020-10-05T03:30:08Z","snapshot_observed_at":"2026-08-19T14:17:01.083649Z","submitted_at":"2019-12-12T21:32:28Z","title":"Theme-Matters: Fashion Compatibility Learning via Theme Attention","version":3},"cited_work":{"arxiv_id":"1912.06227","doi":null,"metadata_source":"pith","pith_arxiv_id":"1912.06227","snapshot_observed_at":"2026-08-16T10:49:42.329584Z","title":"Theme-Matters: Fashion Compatibility Learning via Theme Attention","venue":"cs.CV","work_id":"56189e6c-a857-4795-aea7-6cc716d1b050","year":2019},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.197024Z"},"links":{"cited_paper":"/paper/1912.06227","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:9ea28d56782e1e8917be3b2c6aa091ec627c45f2736e7c4a20be9fd7275c7343","observation_id":"32fbaedb-b21c-4dc0-90ea-ee853f37cc24","resolution":{"observed_at":"2026-08-16T10:49:42.335894Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.201520Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.201520Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:082a4824530be311e5573556c67e0ad600dd179e9661879c1559b5ddebc823a0","observation_id":"de069976-6d0f-4a81-ad7a-e0880fa44380","resolution":{"observed_at":"2026-08-16T10:49:42.201520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05737","snapshot_observed_at":"2026-08-16T10:49:42.204933Z","title":"Language model beats diffusion–tokenizer is key to visual generation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.204933Z"},"links":{"cited_paper":"/paper/2310.05737","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:dc237ea95ace68ccfcadf461481fb832128cf23db5f630c983a5418b197395c3","observation_id":"dd45b2ed-729f-4f7c-b847-8dc746814640","resolution":{"observed_at":"2026-08-16T10:49:42.204933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-08-13T11:19:55.436754Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-16T10:49:42.209513Z","title":"Textbooks are all you need,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.209513Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:47bfb694f8b83e6813b9137ea2c9148c3284df48e9208eac78fe95ab9a0b1520","observation_id":"32f8db0a-dd76-4981-8c6a-8124608e2e13","resolution":{"observed_at":"2026-08-16T10:49:42.209513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.465619Z","title":"Chainlit,","venue":null,"work_id":"cba74720-273b-434c-a8a2-66d3a33073f9","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.213663Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:4ad1b0ed818641fbdf290c85e6e5fb805f357f8843ae5ff4eacb12fdd2218b10","observation_id":"ea24a450-8af1-4f57-a406-babb0debca26","resolution":{"observed_at":"2026-08-16T10:49:42.469884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.455163Z","title":"Llama-3.2-11B-Vision,","venue":null,"work_id":"3f951262-3ca5-46b2-9841-08a3b8496f48","year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.217508Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:a559fbdb17d545e9d6e597d24b2ee0071cf09995e63b4033c1192c6d5ae96b86","observation_id":"7c19551d-caf2-4862-adef-aef3707635c8","resolution":{"observed_at":"2026-08-16T10:49:42.458673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-16T10:49:42.221737Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.221737Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:9261cfc032a3e9f9fdfa173e6524bee0f5e43df11cf5ca458fb786544d71a2b8","observation_id":"8abe641f-b175-4ce7-8758-0a6338a3f0b2","resolution":{"observed_at":"2026-08-16T10:49:42.221737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19260","last_updated":"2025-01-02T18:46:05Z","snapshot_observed_at":"2026-08-16T13:53:04.662481Z","submitted_at":"2024-12-26T15:54:10Z","title":"MEDEC: A Benchmark for Medical Error Detection and Correction in Clinical Notes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19260","snapshot_observed_at":"2026-08-16T10:49:42.226577Z","title":"Medec: A benchmark for medical error detection and correction in clinical notes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.226577Z"},"links":{"cited_paper":"/paper/2412.19260","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:c525fe8246560c4b464cae3b52990e55a668c5c23f879003a1e61becdf7ed2f2","observation_id":"e2f3e9d6-9200-4b0a-a4ed-f25704b398a7","resolution":{"observed_at":"2026-08-16T10:49:42.226577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-16T10:49:42.230853Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.230853Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:2f2035a2211b4ea9a4ed257366c95060d5c511249d15dda2da8aabef08f803ed","observation_id":"b4f98a40-f1da-43ec-848b-1815959cf879","resolution":{"observed_at":"2026-08-16T10:49:42.230853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.444008Z","title":"messages=[{‘role’: ‘system’, ‘content’: ‘‘‘ As a fashion expert, generate a user−system conversation for training a fashion stylist model","venue":null,"work_id":"7838a3e2-1ec7-4f06-b880-a63e288aaf0d","year":null},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.234869Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:5a7af6fc9f33c4e48170cf60dc00913da243fdf78e8afc233c77fc1f798d14eb","observation_id":"3bb3c7ef-01f5-4ad5-9a97-bfb8c3976ac6","resolution":{"observed_at":"2026-08-16T10:49:42.447897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.433353Z","title":"messages=[{‘role’: ‘system’, ‘content’: ‘‘‘ Create a user−system conversation for training a personalized fashion stylist model","venue":null,"work_id":"4e16edf1-9f95-4b0c-bdc8-1dbfde887a45","year":null},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.238322Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:2e91610fda71836f10fad3029c32700043c0f75cfc27f17e4a4695a904d7dc4d","observation_id":"95936c60-9f34-4c63-b94e-17a5a97b8363","resolution":{"observed_at":"2026-08-16T10:49:42.436927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:49:42.422598Z","title":"UN GAYVOE MVEREI LELS","venue":null,"work_id":"78bd8281-df03-4730-82db-e89451e2d037","year":null},"citing_paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T10:49:42.241870Z"},"links":{"citing_paper":"/paper/2504.17826"},"observation_digest":"sha256:010b8b1cb369b17a17dd4c08092c01a480154162727b71ef347364c2b1cae8f9","observation_id":"f1c15865-64ea-40eb-ab7c-14e9c73bd39e","resolution":{"observed_at":"2026-08-16T10:49:42.426483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.17826","last_updated":"2025-04-24T02:44:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T10:44:32.072406Z","submitted_at":"2025-04-24T02:44:22Z","title":"FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":2,"verified_fuzzy":46},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 1 inbound Pith citation observation for arXiv:2504.17826."}