python实现将dataframe直接插入Elasticsearch数据库的方法

由于比较喜欢使用pandas包中的dataframe进行数据预处理,处理完后需要导入到数据库中,为避免重复转换数据格式,一下函数可直接完成导入。


from elasticsearch import Elasticsearch

def connect_es(frame, index_, type_):

    try:
        es = Elasticsearch(host, http_auth=(user, password), port='9200')
        df_as_json = frame.to_json(orient='records', lines=True)
        bulk_data = []
        
        for json_document in df_as_json.split('\n'):
            bulk_data.append({"index": {
                '_index': index_,
                '_type': type_,
            }})
            bulk_data.append(json.loads(json_document))
            
            # 一次bulk request包含1000条数据
            if len(bulk_data) > 1000:
                es.bulk(bulk_data)
                bulk_data = []
                
        es.bulk(bulk_data)
        print('database connet successfully')

    except Exception as e:
    
        print(e)
Python中,你可以使用`pyodbc`或`sqlalchemy`库来连接达梦(DM)数据库并将DataFrame存储进去。这里以`sqlalchemy`为例,因为它的API设计更为简洁,适合处理复杂操作。 首先,你需要安装`sqlalchemy`和`pandas`库,如果还没有安装,可以使用`pip install sqlalchemy pandas`命令。然后,按照以下步骤操作: 1. **导入所需模块**: ```python from sqlalchemy import create_engine, Table, Column, Integer, String import pandas as pd ``` 2. **创建数据库引擎**: 根据你的达梦数据库连接信息(主机、端口、用户名、密码、数据库名等)创建引擎。假设数据库服务器地址为`db_server`, 端口为`db_port`,数据库名为`database`,登录用户和密码分别为`username` 和 `password`: ```python engine = create_engine(f'dm+pyodbc://@{db_server}:{db_port}/{database}?driver=FreeTDS&uid={username}&pwd={password}') ``` 3. **定义DataFrame列和表结构**: ```python metadata = MetaData() df_table = Table('your_table_name', metadata, Column('column1', Integer, primary_key=True), Column('column2', String), # 添加其他列... ) ``` 4. **将DataFrame转换为表并插入数据**: ```python df.to_sql(df_table.name, con=engine, if_exists='replace', index=False) # replace表示替换现有表,如果没有则新建 ``` 5. **检查数据是否成功存储**: ```python with engine.connect() as connection: result = connection.execute(f'SELECT * FROM {df_table.name}') print(result.fetchall()) ``` 记得将上述代码中的`your_table_name`替换为你实际的表名,以及列名和数据库配置。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

'Humz

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值