{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:J7VRARQQ7EDA6F4Y627E2NAINQ","short_pith_number":"pith:J7VRARQQ","schema_version":"1.0","canonical_sha256":"4feb104610f9060f1798f6be4d34086c30d1e2bdf31c4abaf7d09c1c5069d2f6","source":{"kind":"arxiv","id":"2508.10429","version":1},"attestation_state":"computed","paper":{"title":"MM-Food-100K: A 100,000-Sample Multimodal Food Intelligence Dataset with Verifiable Provenance","license":"http://creativecommons.org/licenses/by-sa/4.0/","headline":"","cross_cats":["cs.CR","cs.CV"],"primary_cat":"cs.AI","authors_text":"Scott Shi, Yi Dong, Yi Zhang, Yusuke Muraoka","submitted_at":"2025-08-14T07:59:31Z","abstract_excerpt":"We present MM-Food-100K, a public 100,000-sample multimodal food intelligence dataset with verifiable provenance. It is a curated approximately 10% open subset of an original 1.2 million, quality-accepted corpus of food images annotated for a wide range of information (such as dish name, region of creation). The corpus was collected over six weeks from over 87,000 contributors using the Codatta contribution model, which combines community sourcing with configurable AI-assisted quality checks; each submission is linked to a wallet address in a secure off-chain ledger for traceability, with a fu"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2508.10429","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by-sa/4.0/","primary_cat":"cs.AI","submitted_at":"2025-08-14T07:59:31Z","cross_cats_sorted":["cs.CR","cs.CV"],"title_canon_sha256":"3c59570775d5c00b0db09d44e9e38ce30e31d293df1701d3d0332127c3bc7c05","abstract_canon_sha256":"5598d772e4844f71363a42f500f0c74fa055154ac820af8f50da2ad1cf95f60f"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:53:56.079068Z","signature_b64":"fiTGt38gjKiUm/YBiT/6rpyaRlF3978gBzEGmTDG3WOVes5Ylu5dplyH4LA5oXUbsuI9hG0RUjNAplnCpfGNDw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"4feb104610f9060f1798f6be4d34086c30d1e2bdf31c4abaf7d09c1c5069d2f6","last_reissued_at":"2026-07-05T11:53:56.078633Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:53:56.078633Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"MM-Food-100K: A 100,000-Sample Multimodal Food Intelligence Dataset with Verifiable Provenance","license":"http://creativecommons.org/licenses/by-sa/4.0/","headline":"","cross_cats":["cs.CR","cs.CV"],"primary_cat":"cs.AI","authors_text":"Scott Shi, Yi Dong, Yi Zhang, Yusuke Muraoka","submitted_at":"2025-08-14T07:59:31Z","abstract_excerpt":"We present MM-Food-100K, a public 100,000-sample multimodal food intelligence dataset with verifiable provenance. It is a curated approximately 10% open subset of an original 1.2 million, quality-accepted corpus of food images annotated for a wide range of information (such as dish name, region of creation). The corpus was collected over six weeks from over 87,000 contributors using the Codatta contribution model, which combines community sourcing with configurable AI-assisted quality checks; each submission is linked to a wallet address in a secure off-chain ledger for traceability, with a fu"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2508.10429","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2508.10429/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2508.10429","created_at":"2026-07-05T11:53:56.078688+00:00"},{"alias_kind":"arxiv_version","alias_value":"2508.10429v1","created_at":"2026-07-05T11:53:56.078688+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2508.10429","created_at":"2026-07-05T11:53:56.078688+00:00"},{"alias_kind":"pith_short_12","alias_value":"J7VRARQQ7EDA","created_at":"2026-07-05T11:53:56.078688+00:00"},{"alias_kind":"pith_short_16","alias_value":"J7VRARQQ7EDA6F4Y","created_at":"2026-07-05T11:53:56.078688+00:00"},{"alias_kind":"pith_short_8","alias_value":"J7VRARQQ","created_at":"2026-07-05T11:53:56.078688+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":2,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2607.08423","citing_title":"OmniFood-Bench: Evaluating VLMs for Nutrient Reasoning and Personalized Health Advice","ref_index":30,"is_internal_anchor":true},{"citing_arxiv_id":"2606.04986","citing_title":"Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning","ref_index":8,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/J7VRARQQ7EDA6F4Y627E2NAINQ","json":"https://pith.science/pith/J7VRARQQ7EDA6F4Y627E2NAINQ.json","graph_json":"https://pith.science/api/pith-number/J7VRARQQ7EDA6F4Y627E2NAINQ/graph.json","events_json":"https://pith.science/api/pith-number/J7VRARQQ7EDA6F4Y627E2NAINQ/events.json","paper":"https://pith.science/paper/J7VRARQQ"},"agent_actions":{"view_html":"https://pith.science/pith/J7VRARQQ7EDA6F4Y627E2NAINQ","download_json":"https://pith.science/pith/J7VRARQQ7EDA6F4Y627E2NAINQ.json","view_paper":"https://pith.science/paper/J7VRARQQ","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2508.10429&json=true","fetch_graph":"https://pith.science/api/pith-number/J7VRARQQ7EDA6F4Y627E2NAINQ/graph.json","fetch_events":"https://pith.science/api/pith-number/J7VRARQQ7EDA6F4Y627E2NAINQ/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/J7VRARQQ7EDA6F4Y627E2NAINQ/action/timestamp_anchor","attest_storage":"https://pith.science/pith/J7VRARQQ7EDA6F4Y627E2NAINQ/action/storage_attestation","attest_author":"https://pith.science/pith/J7VRARQQ7EDA6F4Y627E2NAINQ/action/author_attestation","sign_citation":"https://pith.science/pith/J7VRARQQ7EDA6F4Y627E2NAINQ/action/citation_signature","submit_replication":"https://pith.science/pith/J7VRARQQ7EDA6F4Y627E2NAINQ/action/replication_record"}},"created_at":"2026-07-05T11:53:56.078688+00:00","updated_at":"2026-07-05T11:53:56.078688+00:00"}