GenMedGPT_json.py

import json


list = []
paragraph = []
with open('./icliniq-21k.json', mode='r', encoding='utf-8') as f:
    json_list = json.load(f)
    for index, dict in enumerate(json_list):
        quary = 'instruction: ' + dict['instruction'] + ' input: ' + dict['input']
        answer = ['output: ' + dict['output']]  # a
        paragraph.append({"q": quary, "a": answer})  # 一条对话信息添加到paragraph
        qa = {"id": 0, "paragraph":paragraph}
        list.append(qa)
        paragraph = []


with open('./Sicliniq_21k.json',mode='w',encoding='utf-8',newline='\n') as f:
    index = 0
    for i in list:
        # print(i)
        index += 1
        i['id'] = index
        f.write(json.dumps(i, ensure_ascii=False) + '\n')

手写python脚本转换格式(不推荐),推荐使用alpaca2qa.py套模板转换格式.

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值