开发面向印度市场的应用时常需要模拟人口数据用于测试、UI预览或训练ML模型,但标准生成器随机组合姓名、宗教、地区,容易产生不合逻辑的档案。indian-fakedata 基于印度人口普查、NFHS-5等真实数据源,生成统计上合理的人口档案,支持按宗教、种姓、邦、性别、年龄、教育、职业等维度过滤,输出 JSON/JSONL/CSV 格式。
安装
Node.js:npm install @abhay557/indian-fakedata(需 Node >=18)
Python:pip install indian-fakedata(需 Python 3.8+)
CLI 用法indian-fakedata [options],常用选项:--count--output--format (json/jsonl/csv)--seed
过滤维度:--religion--state--gender--caste--socialCategory--areaType--minAge/maxAge--education--occupation--maritalStatus
Enrichment 层--outcomes添加信用分、健康风险等;--narrative生成贷款申请、病历等文本;--persona输出LLM可用角色设定。
程序化API
Node:import { generate, generateEnriched } from '@abhay557/indian-fakedata'
Python:from indian_fakedata import generate, generate_enriched
数据来源: Census 2011, NFHS-5, MSME Census, UIDAI, CSDS/Lokniti 等
工具已发布到 npm 和 PyPI,可直接集成到测试或ML工作流中。
#开发者 #工具 #IndianFakedata #Nodejs #Python #MockData #CLI #Testing #DataGeneration
@DevToolboxHub