Pandas AI安装和使用教程

Python Pandas是一个为Python编程提供数据操作和分析功能的开放原始码工具包。过去它已成为数据科学家和分析师的必备工具。现在我们可以搭配使用ChatGPT 让Pandas提供了一种更有效的方法来管理结构化数据(Series和DataFrame)。

Pandas AI 是一个Python 库,它将生成人工智能功能集成到Pandas 中,让我们可以透过类似ChatGPT 的对话做资料处理

在人工智能领域,Pandas 经常用于机器学习和深度学习过程的预处理步骤。Pandas通过提供数据清理、重塑、合并和聚合,可以将原始数据集转换为结构化的、随时可用的2维表格,并将其输入人工智能算法。

项目地址:https://github.com/gventuri/pandas-ai

使用pip 安装Pandas AI

pip install pandasai

使用OpenAI 导入PandasAI

在下一步中,我们将导入之前安装的pandasai 库,然后导入LLM(大型语言模型)功能。截至2023 年5 月,pandasai 仅支持OpenAI 模型,我们将使用它来理解数据。

import pandas as pd
from pandasai import PandasAI

# Sample DataFrame
df = pd.DataFrame({
    "country": ["United States", "United Kingdom", "France", "Germany", "Italy", "Spain", "Canada", "Australia", "Japan", "China"],
    "gdp": [19294482071552, 2891615567872, 2411255037952, 3435817336832, 1745433788416, 1181205135360, 1607402389504, 1490967855104, 4380756541440, 14631844184064],
    "happiness_index": [6.94, 7.16, 6.66, 7.07, 6.38, 6.4, 7.23, 7.22, 5.87, 5.12]
})

# Instantiate a LLM
from pandasai.llm.openai import OpenAI
llm = OpenAI(api_token="your_API_key")

pandas_ai = PandasAI(llm)
pandas_ai.run(df, prompt='Which are the 5 happiest countries?')

6            Canada
7         Australia
1    United Kingdom
3           Germany
0     United States
Name: country, dtype: object

要使用OpenAI API,您必须输入自己的OpenAI API Key。

因为pandas的特性,我们不仅仅可以处理csv文件,我们还可以连接关系型的资料库,例如pgsql:

# creating the uri and connecting to database
 pg_conn = "postgresql://YOUR URI HERE"
 
 #Query sql database 
 query = """
 SELECT *
 FROM table_name
 """
 
 #Create dataframe named df
 df = pd.read_sql(query,pg_conn)

然后像上面程式码一样,我们可以直接与它进行对话了:

# Using pandas-ai!
 pandas_ai = PandasAI(llm)
 pandas_ai.run(df, prompt='Place your prompt here)

当然,你也可以让PandasAI 进行更复杂的查询。例如,可以要求PandasAI 求出2 个最不幸福国家的GDP 总和:

pandas_ai.run(df, prompt='What is the sum of the GDPs of the 2 unhappiest countries?')

上面的程式码将返回以下内容:

19012600725504

也可以请PandasAI 产生图表:

pandas_ai.run(
    df,
    "Plot the histogram of countries showing for each the gpd, using different colors for each bar",
)

最后

ChatGPT、Pandas 是强大的工具,当它们结合在一起时,可以改变我们与数据交互和分析的方式。ChatGPT 凭借其先进的自然语言处理能力,可以更直观地与数据进行类似人类的交互。而PandasAI 可以增强Pandas数据分析体验。通过将复杂的数据操作任务转换为简单的自然语言查询,PandasAI 使用户更容易从数据中提取有价值的见解,而无需像过去一样编写大量的Python 程式码。

这对于那些还不熟悉Python 或pandas 操作/转换的人来说是一种做资料处理的新方法。我们不需要为你想要执行的任务编程,而是只是与AI代理交谈,明确的告诉它想要的结果,PandaAI 替你转换为电脑可解释的程式码,并帮助您做资料处理。

本文链接地址:https://www.wwsww.cn/rgzn/22541.html
郑重声明:本文版权归原作者所有,转载文章仅为传播更多信息之目的,如作者信息标记有误,请第一时间联系我们修改或删除,多谢。