Python

pytest-speedup
981 views

pytest高速化の秘訣

以下の文章はこちらの記事を翻訳したものです。 https://github.com/zupo/awesome-pytest-speedup#awesome-pytest-speedup pytest スイートの実行速度を向上させるためのチェ...

python-newtype
549 views

PythonとNewType

この記事では、Pythonにおける NewType テクニックを紹介します。このテクニックを使用すると、型による値の確からしさを保証しながら、ランタイムにおけるオーバーヘッドを限りなくゼロに近づけることができます。 問題設定 アプリケーショ...

pandas-memo
63 views

pandasメモ

csvからの読み込み headerなし pandasでcsv/tsvファイル読み込み(readcsv, readtable) note.nkmk.me sqliteからの読み込み データの取得 column名(header)の取得 書き込み...

pyspark-dataframeメモ
401 views

PySpark DataFrameメモ

SparkSession#cresateDataFrameを使用する 作成元のデータは RDD list pandas.DataFrame のいずれか pyspark.sql module — PySpark 2.4.5 documenta...

pyspark-on-aws-glue
118 views

PySpark on AWS Glue

AWS Glueでは、transformationctxというオプション引数を使用して、ジョブのブックマークを制御することができます。ジョブのブックマークは、生データの重複処理を防ぐための仕組みです。詳細については理解できていないが、一般的...

dynamodb
334 views

DynamoDB色々

RDBとの相違点 RDBはクエリが柔軟なのでスキーマ定義時にクエリのことを考えなくていい Dyanamoでは最も重要なクエリのみ高速化するためのスキーマ設計が必要 設計手順 必要なクエリ=ビジネス要件・ユースケースが判明するまでスキーマを設...