ÇfarĂ« na solli Pandas 1.0

ÇfarĂ« na solli Pandas 1.0

9 janar është lëshuar Pandas 1.0.0rc. Versioni i mëparshëm i librit ishte 0.25.

Lëshimi i parë kryesor përmban shumë risi të mrekullueshme, duke përfshirë përmirësimin e automatizimit të përmbledhjes së dataframe-ve, më shumë formate të daljes, lloje të reja të të dhënave dhe madje një faqe të re dokumentacioni.

Të gjitha ndryshimet mund të shihen këtu, në këtë artikull do të kufizohemi në një përmbledhje të vogël, më pak teknike të më të rëndësishmëve.

Instalimi i librit mund të bëhet si zakonisht me anë të pip, por sepse në momentin e shkrimit të këtij artikulli, Pandas 1.0 ende release candidate, do t'ju duhet të specifikoni qartë versionin:

pip install --upgrade pandas==1.0.0rc0

Kujdes: pasi është një lëshim kryesor, përditësimi mund të prishë kodin e vjetër!

PĂ«rveç kĂ«saj, nga ky version mbĂ«shtetjeja pĂ«r Python 2 Ă«shtĂ« ndaluar plotĂ«sisht (qĂ« mund tĂ« jetĂ« njĂ« shkak i mirĂ« pĂ«r tu pĂ«rditĂ«suar — shĂ«n. pĂ«rk.). Pandas 1.0 kĂ«rkon tĂ« paktĂ«n Python 3.6+, ndaj nĂ«se nuk jeni tĂ« sigurt, kontrolloni se cili version Ă«shtĂ« instaluar tek ju:

$ pip --version
pip 19.3.1 nga /usr/local/lib/python3.7/site-packages/pip (python 3.7)

$ python --version
Python 3.7.5

Kontrollimi i versionit të Pandas është më e lehtë kështu:

>>> import pandas as pd
>>> pd.__version__
1.0.0rc0

Përmirësimi i automatizmit të përmbledhjes me DataFrame.info

Risia ime e preferuar është përmirësimi i metodës DataFrame.info. Funksioni është bërë shumë më i lexueshëm, çka e bën procesin e eksplorimit të të dhënave edhe më të lehtë:

>>> df = pd.DataFrame({
...:   'A': [1,2,3], 
...:   'B': ["goodbye", "cruel", "world"], 
...:   'C': [False, True, False]
...:})
>>> df.info()

RangeIndex: 3 entries, 0 to 2
Data columns (total 3 columns):
 #   Column  Non-null Count  Dtype
---  ------  --------------  -----
 0   A       3 non-null      int64
 1   B       3 non-null      object
 2   C       3 non-null      object
dtypes: int64(1), object(2)
memory usage: 200.0+ bytes

Shfaqja e tabelave në format Markdown

Një risi tjetër e këndshme ishte mundësia për të eksportuar datafrat në tabela Markdown përmes DataFrame.to_markdown.

>>> df.to_markdown()
|    |   A | B       | C     |
|---:|----:|:--------|:------|
|  0 |   1 | goodbye | False |
|  1 |   2 | cruel   | True  |
|  2 |   3 | world   | False |

Kjo e thjeshton shumë publikimin e tabelave në faqe si Medium duke përdorur github gists.

ÇfarĂ« na solli Pandas 1.0

Lloje të reja për vargje dhe vlera logjike

Në lëshimin e Pandas 1.0 gjithashtu janë shtuar eksperimentale lloje të reja. API i tyre ende mund të ndryshojë, ndaj përdoreni me kujdes. Por në përgjithësi, Pandas rekomandon përdorimin e llojeve të reja kudo që ka kuptim.

Për momentin, konvertimi duhet të bëhet eksplicite:

>>> B = pd.Series(["goodbye", "cruel", "world"], dtype="string")
>>> C = pd.Series([False, True, False], dtype="bool")
>>> df.B = B, df.C = C
>>> df.info()

RangeIndex: 3 entries, 0 to 2
Data columns (total 3 columns):
 #   Column  Non-null Count  Dtype
---  ------  --------------  -----
 0   A       3 non-null      int64
 1   B       3 non-null      string
 2   C       3 non-null      bool
dtypes: int64(1), object(1), string(1)
memory usage: 200.0+ bytes

Vini re se si kolona Dtype tregon llojet e reja — string dhe bool.

Karakteristika më e vlefshme e këtij lloji të ri të vargjeve është mundësia për të seleksionuar vetëm kolonat e vargjeve nga datafrat. Kjo mund të thjeshtojë ndjeshëm analizën e të dhënave tekstuale:

df.select_dtypes("string")

Më parë, kolonat e rreshtave nuk mund të zgjidheshin pa treguar emrat e tyre në mënyrë të qartë.

Lexoni më shumë rreth llojeve të reja. këtu.

Faleminderit që e lexuat deri në fund! Lista e plotë e ndryshimeve, siç u përmend, mund të shikohet. këtu.

Burimi: habr.com

Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Bleni hostim tĂ« besueshĂ«m pĂ«r faqe me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster