Ini adalah artikel yang bagus.
Saya berpikir akan bagus jika memiliki setidaknya satu DGX Spark, tetapi saya bertanya-tanya bagaimana rasanya memiliki dua DGX Spark.
Belakangan ini, harga layanan model Open Weight buatan Cina semakin murah, jadi saya mempertanyakan apakah benar-benar perlu membeli dan menggunakan peralatan mahal yang sulit diakses. Artikel ini ditulis dengan sangat baik dan mudah dipahami, menjawab pertanyaan-pertanyaan yang saya miliki. Sederhananya, saya pikir alasan mengapa panggilan API diproses lebih cepat adalah karena sumber daya komputasi terdistribusi skala besar tidak dipengaruhi oleh ukuran batch atau efisiensi.
Saya rasa menjalankan model besar dengan dua DGX Spark di rumah tidak cocok untuk orang-orang di Korea yang mudah tersinggung. Lebih baik menggunakan layanan komersial demi kesehatan mental kita. (Beginilah cara saya menang.)
▶ Sumber asli: https://seapy.com/deepseek-v4-flash-api-vs-2x-dgx-spark/