# จับ small/mid dataframe frameworks มาชนกัน ว่าใครไวกว่า

**URL:** <https://discuss.dataengineercafe.io/t/small-mid-dataframe-frameworks/808>\
**Category:** พูดคุยเกี่ยวกับ Data Tools ต่าง ๆ\
**Tags:** duckdb\
**Created:** [July 26, 2025, 1:25pm UTC](https://discuss.dataengineercafe.io/t/small-mid-dataframe-frameworks/808 "2025-07-26T13:25:32Z")\
**Posts on this page:** 1\
**Page:** 1

<div class="post-metadata">

**Author:** ![kahnwong](https://yyz1.discourse-cdn.com/flex035/user_avatar/discuss.dataengineercafe.io/kahnwong/32/295_2.png) [@kahnwong](https://discuss.dataengineercafe.io/u/kahnwong)\
**Post date:** [July 26, 2025, 1:25pm UTC](https://discuss.dataengineercafe.io/t/small-mid-dataframe-frameworks/808/1 "2025-07-26T13:25:32Z")

</div>

ขอยก spark ออกจากกระดาน เพราะต่อให้ออกวิ่งช้าแค่ไหน แต่ถ้าเจอ big data หนักๆ ก็มีแต่ spark ที่เอาอยู่  
solution ที่เคลมว่าแทน spark ได้ เคยจับมา benchmark แล้วทำคอมค้างมาแล้วทุกอัน เพราะ RAM ไม่พอเลยไปออก disk จนเต็ม

ต้นเหตุจริงๆ คือ มีคนทักว่า เอา dataframe frameworks benchmark มารันใหม่ แล้วพบว่า duckdb ไวกว่า polars

แต่เรื่องนี้ต้องพิสูจน์ เลยได้ความว่า… duckdb ก็มีโอกาสที่จะไวกว่าและช้ากว่า polars ทั้งคู่ ขึ้นอยู่กับสถานการณ์

[Dataframe processing benchmarks](https://karnwong.me/posts/2025/07/dataframe-processing-benchmarks/) (มีภาษาไทยนะ)
