[解決済み】pandas dataframeの文字列エントリーを分割（explode）して別の行にする。

2022-04-15 16:05:26

質問

私は pandas dataframe には、カンマで区切られた値を含むテキスト文字列が1列あります。CSV の各フィールドを分割し、エントリごとに新しい行を作成したいと思います (CSV はきれいで、',' で分割する必要があるだけだと仮定します)。例えば a は次のようになります。 b :

In [7]: a
Out[7]: 
    var1  var2
0  a,b,c     1
1  d,e,f     2

In [8]: b
Out[8]: 
  var1  var2
0    a     1
1    b     1
2    c     1
3    d     2
4    e     2
5    f     2

これまで、いろいろと簡単な関数を試してみましたが .apply メソッドは、軸で使用した場合、戻り値として1行しか受け取らないようです。 .transform を動作させることができます。何か提案があれば、ぜひお願いします。

データ例です。

from pandas import DataFrame
import numpy as np
a = DataFrame([{'var1': 'a,b,c', 'var2': 1},
               {'var1': 'd,e,f', 'var2': 2}])
b = DataFrame([{'var1': 'a', 'var2': 1},
               {'var1': 'b', 'var2': 1},
               {'var1': 'c', 'var2': 1},
               {'var1': 'd', 'var2': 2},
               {'var1': 'e', 'var2': 2},
               {'var1': 'f', 'var2': 2}])

numpyを経由することでDataFrameのメタデータが失われるため、うまくいかないことは分かっていますが、私が何をしようとしたかを感じ取ってもらえるはずです。

def fun(row):
    letters = row['var1']
    letters = letters.split(',')
    out = np.array([row] * len(letters))
    out['var1'] = letters
a['idx'] = range(a.shape[0])
z = a.groupby('idx')
z.transform(fun)

解決方法は？

こんなのはどうでしょう。

In [55]: pd.concat([Series(row['var2'], row['var1'].split(','))              
                    for _, row in a.iterrows()]).reset_index()
Out[55]: 
  index  0
0     a  1
1     b  1
2     c  1
3     d  2
4     e  2
5     f  2

そして、カラムの名前を変更するだけです。

[解決済み】pandas dataframeの文字列エントリーを分割（explode）して別の行にする。

質問

解決方法は？

関連

[解決済み] PandasでDataFrameの行を反復処理する方法

[解決済み] 列の値に基づいてDataFrameから行を選択するにはどうすればよいですか？

[解決済み] Pandas DataFrameからカラムを削除する

[解決済み] Pandasのデータフレームで複数の列を選択する

[解決済み] Pandas DataFrameの行数を取得する方法は？

[解決済み] 既存のDataFrameに新しい列を追加する方法は？

[解決済み] 一行ずつ追加してPandas Dataframeを作成する

[解決済み] Pandas DataFrameの特定の列の値がNaNである行を削除する方法

[解決済み] Pandasのデータフレームから行を選択するために値のリストを使用する

[解決済み】Pandas DataFrameのカラムヘッダからリストを取得する。

最新

nginxです。[emerg] 0.0.0.0:80 への bind() に失敗しました (98: アドレスは既に使用中です)

htmlページでギリシャ文字を使うには

ピュアhtml+cssでの要素読み込み効果

純粋なhtml + cssで五輪を実現するサンプルコード

ナビゲーションバー・ドロップダウンメニューのHTML+CSSサンプルコード

タイピング効果を実現するピュアhtml+css

htmlの選択ボックスのプレースホルダー作成に関する質問

html css3 伸縮しない画像表示効果

トップナビゲーションバーメニュー作成用HTML+CSS

html+css 実装サイバーパンク風ボタン

おすすめ

Pythonによるjieba分割ライブラリ

python implement mysql add delete check change サンプルコード

[解決済み】TypeError: unhashable type: 'numpy.ndarray'.

[解決済み】お使いのCPUは、このTensorFlowバイナリが使用するようにコンパイルされていない命令をサポートしています。AVX AVX2

[解決済み】Pythonスクリプトで「Expected 2D array, got 1D array instead: 」というエラーが発生？

[解決済み】 AttributeError: モジュール 'matplotlib' には属性 'plot' がない。

[解決済み】Python elifの構文が無効です【終了しました

[解決済み】LogisticRegression: Pythonでsklearnを使用して、未知のラベルタイプ： '連続'を使用しています。

[解決済み】cアンダースコア式`c_`は、具体的に何をするのですか？

[解決済み】ValueError: xとyは同じサイズでなければならない