คำถามติดแท็ก python

Python เป็นภาษาการเขียนโปรแกรมแบบหลายกระบวนทัศน์แบบไดนามิกพิมพ์อเนกประสงค์ มันถูกออกแบบมาให้เรียนรู้เข้าใจและใช้งานได้อย่างรวดเร็วและบังคับใช้ไวยากรณ์ที่สะอาดและสม่ำเสมอ โปรดทราบว่า Python 2 สนับสนุนอย่างเป็นทางการตั้งแต่วันที่ 01-01-2020 สำหรับคำถาม Python เฉพาะรุ่นให้เพิ่มแท็ก [python-2.7] หรือ [python-3.x] เมื่อใช้ตัวแปรหรือไลบรารี Python (เช่น Jython, PyPy, Pandas, Numpy) โปรดรวมไว้ในแท็ก

30
วิธีที่ดีที่สุดในการค้นหาเดือนระหว่างวันที่สองวัน
ฉันจำเป็นต้องสามารถค้นหาเดือนระหว่างวันที่สองวันใน python ได้อย่างแม่นยำ ฉันมีวิธีแก้ปัญหาที่ใช้งานได้ แต่ไม่ดีมาก (อย่างสวยหรู) หรือเร็ว dateRange = [datetime.strptime(dateRanges[0], "%Y-%m-%d"), datetime.strptime(dateRanges[1], "%Y-%m-%d")] months = [] tmpTime = dateRange[0] oneWeek = timedelta(weeks=1) tmpTime = tmpTime.replace(day=1) dateRange[0] = tmpTime dateRange[1] = dateRange[1].replace(day=1) lastMonth = tmpTime.month months.append(tmpTime) while tmpTime < dateRange[1]: if lastMonth != 12: while tmpTime.month <= lastMonth: tmpTime += oneWeek …

6
DataFrame ขนาดใหญ่และถาวรในแพนด้า
ฉันกำลังสำรวจการเปลี่ยนไปใช้ python และ pandas ในฐานะผู้ใช้ SAS เป็นเวลานาน อย่างไรก็ตามเมื่อทำการทดสอบในวันนี้ฉันรู้สึกประหลาดใจที่ python มีหน่วยความจำpandas.read_csv()ไม่เพียงพอเมื่อพยายามใช้ไฟล์ csv ขนาด 128mb มีข้อมูลตัวเลขประมาณ 200,000 แถวและ 200 คอลัมน์ ด้วย SAS ฉันสามารถนำเข้าไฟล์ csv ไปยังชุดข้อมูล SAS และมีขนาดใหญ่พอ ๆ กับฮาร์ดไดรฟ์ของฉัน มีบางอย่างที่คล้ายคลึงกันpandasหรือไม่? ฉันทำงานกับไฟล์ขนาดใหญ่เป็นประจำและไม่มีสิทธิ์เข้าถึงเครือข่ายคอมพิวเตอร์แบบกระจาย
93 python  pandas  sas 

7
วิธีสร้างเวกเตอร์ R ว่างเพื่อเพิ่มรายการใหม่
ฉันต้องการใช้ R ใน Python ตามที่โมดูล Rpy2 ให้มา ฉันสังเกตเห็นว่า R มี[]การดำเนินการที่สะดวกมากซึ่งคุณสามารถแยกคอลัมน์หรือบรรทัดเฉพาะได้ ฉันจะบรรลุฟังก์ชันดังกล่าวโดยสคริปต์ Python ได้อย่างไร ความคิดของฉันคือการสร้างเวกเตอร์ R และเพิ่มองค์ประกอบที่ต้องการลงในเวกเตอร์นี้เพื่อให้เวกเตอร์สุดท้ายเหมือนกับใน R ฉันสร้าง a seq()แต่ดูเหมือนว่ามันจะมีตัวเลขเริ่มต้น 1 ดังนั้นผลลัพธ์สุดท้ายจะเสมอ เริ่มต้นด้วยหลัก 1 ซึ่งไม่ใช่สิ่งที่ฉันต้องการ แล้วมีวิธีที่ดีกว่านี้ไหม?
93 python  r  vector  rpy2 


5
พล็อต DataFrames ที่แตกต่างกันในรูปเดียวกัน
ฉันมีไฟล์อุณหภูมิที่มีบันทึกอุณหภูมิหลายปีในรูปแบบด้านล่าง: 2012-04-12,16:13:09,20.6 2012-04-12,17:13:09,20.9 2012-04-12,18:13:09,20.6 2007-05-12,19:13:09,5.4 2007-05-12,20:13:09,20.6 2007-05-12,20:13:09,20.6 2005-08-11,11:13:09,20.6 2005-08-11,11:13:09,17.5 2005-08-13,07:13:09,20.6 2006-04-13,01:13:09,20.6 ทุกปีจะมีตัวเลขเวลาที่บันทึกแตกต่างกันดังนั้นวันที่และเวลาของแพนด้าจึงแตกต่างกัน ฉันต้องการพล็อตข้อมูลของปีที่ต่างกันในรูปเดียวกันเพื่อเปรียบเทียบ แกน X คือ ม.ค. ถึง ธ.ค. แกน Y คืออุณหภูมิ ฉันควรทำอย่างไร

5
หัวและหางเป็นเส้นเดียว
มีวิธีการคลายแพ็กรายการในองค์ประกอบแรกและ "tail" ในคำสั่งเดียวหรือไม่? ตัวอย่างเช่น: >> head, tail = **some_magic applied to** [1, 1, 2, 3, 5, 8, 13, 21, 34, 55] >> head 1 >>> tail [1, 2, 3, 5, 8, 13, 21, 34, 55]
93 python  list  tail  head 

6
Python: tf-idf-cosine: เพื่อค้นหาความคล้ายคลึงกันของเอกสาร
ผมต่อไปกวดวิชาซึ่งเป็นใช้ได้ในส่วนที่ 1และส่วนที่ 2 น่าเสียดายที่ผู้เขียนไม่มีเวลาสำหรับส่วนสุดท้ายซึ่งเกี่ยวข้องกับการใช้ความคล้ายคลึงกันของโคไซน์เพื่อหาระยะห่างระหว่างเอกสารสองฉบับ ฉันติดตามตัวอย่างในบทความด้วยความช่วยเหลือของลิงค์ต่อไปนี้จากstackoverflowซึ่งรวมอยู่ในรหัสที่กล่าวถึงในลิงค์ด้านบน (เพื่อให้ชีวิตง่ายขึ้น) from sklearn.feature_extraction.text import CountVectorizer from sklearn.feature_extraction.text import TfidfTransformer from nltk.corpus import stopwords import numpy as np import numpy.linalg as LA train_set = ["The sky is blue.", "The sun is bright."] # Documents test_set = ["The sun in the sky is bright."] # Query stopWords …

3
การกำหนดว่า root logger ถูกตั้งค่าเป็นระดับ DEBUG ใน Python หรือไม่?
หากฉันตั้งค่าโมดูลการบันทึกเป็น DEBUG ด้วยพารามิเตอร์บรรทัดคำสั่งเช่นนี้: if (opt["log"] == "debug"): logging.basicConfig(level=logging.DEBUG) ฉันจะทราบได้อย่างไรในภายหลังว่าคนตัดไม้ถูกตั้งค่าเป็นดีบัก ฉันกำลังเขียนมัณฑนากรที่จะกำหนดเวลาของฟังก์ชันหาก True flag ถูกส่งผ่านไปและหากไม่มีการตั้งค่าสถานะจะใช้ค่าเริ่มต้นในการพิมพ์ข้อมูลเวลาเมื่อ root logger ตั้งค่าเป็น DEBUG

7
ค้นหาจำนวนที่มากที่สุดในรายการตัวเลข
มีวิธีหรือฟังก์ชันง่ายๆในการกำหนดจำนวนที่มากที่สุดในรายการ python หรือไม่? ฉันสามารถเขียนโค้ดได้เนื่องจากฉันมีตัวเลขเพียงสามตัว แต่มันจะทำให้รหัสซ้ำซ้อนน้อยลงมากหากฉันสามารถบอกสิ่งที่ยิ่งใหญ่ที่สุดด้วยฟังก์ชันในตัวหรือบางอย่าง
93 python  numbers  max 

6
วิธีอัปเดตพล็อตแบบไดนามิกในลูปในสมุดบันทึก Ipython (ภายในเซลล์เดียว)
สภาพแวดล้อม: Python 2.7, matplotlib 1.3, IPython notebook 1.1, linux, chrome รหัสอยู่ในเซลล์อินพุตเดียวโดยใช้--pylab=inline ฉันต้องการใช้สมุดบันทึก IPython และแพนด้าเพื่อใช้สตรีมและอัปเดตพล็อตแบบไดนามิกทุกๆ 5 วินาที เมื่อฉันใช้คำสั่งพิมพ์เพื่อพิมพ์ข้อมูลในรูปแบบข้อความมันทำงานได้ดีอย่างสมบูรณ์: เซลล์ผลลัพธ์จะเก็บข้อมูลการพิมพ์และเพิ่มแถวใหม่ แต่เมื่อฉันพยายามลงจุดข้อมูล (แล้วอัปเดตแบบวนซ้ำ) พล็อตจะไม่ปรากฏในเซลล์ผลลัพธ์ แต่ถ้าฉันลบลูปออกก็แค่ลงจุดครั้ง มันทำงานได้ดี จากนั้นฉันก็ทำการทดสอบง่ายๆ: i = pd.date_range('2013-1-1',periods=100,freq='s') while True: plot(pd.Series(data=np.random.randn(100), index=i)) #pd.Series(data=np.random.randn(100), index=i).plot() also tried this one time.sleep(5) ผลลัพธ์จะไม่แสดงอะไรเลยจนกว่าฉันจะขัดจังหวะกระบวนการด้วยตนเอง (ctrl + m + i) และหลังจากที่ฉันขัดจังหวะพล็อตจะแสดงเป็นเส้นที่ทับซ้อนกันหลายบรรทัดอย่างถูกต้อง แต่สิ่งที่ฉันต้องการจริงๆคือพล็อตที่แสดงและได้รับการอัปเดตทุก ๆ 5 วินาที (หรือเมื่อใดก็ตามที่มีplot()การเรียกใช้ฟังก์ชันเช่นเดียวกับผลลัพธ์ของคำสั่งพิมพ์ที่ฉันกล่าวถึงข้างต้นซึ่งทำงานได้ดี) …

3
การลบโมดูล python ที่ติดตั้งในโหมดพัฒนา
สวัสดีฉันกำลังทดลองใช้บรรจุภัณฑ์ python โดยใช้ setuptools และเพื่อทดสอบว่าฉันติดตั้งโมดูลในโหมดพัฒนา กล่าวคือ python setup.py develop สิ่งนี้ได้เพิ่มไดเร็กทอรีโมดูลของฉันไปยัง sys.path ตอนนี้ฉันต้องการลบโมดูลมีวิธีใดบ้างที่จะทำสิ่งนี้? ขอบคุณล่วงหน้า

2
Python Pandas: จัดกลุ่มตามกลุ่มและค่าเฉลี่ย?
ฉันมี dataframe แบบนี้: cluster org time 1 a 8 1 a 6 2 h 34 1 c 23 2 d 74 3 w 6 ฉันต้องการคำนวณเวลาเฉลี่ยต่อองค์กรต่อคลัสเตอร์ ผลลัพธ์ที่คาดหวัง: cluster mean(time) 1 15 ((8+6)/2+23)/2 2 54 (74+34)/2 3 6 ไม่รู้จะทำยังไงในนุ่นมีใครช่วยได้บ้าง
93 python  pandas  group-by  mean 

11
จะเพิ่มองค์ประกอบที่จุดเริ่มต้นของ OrderDict ได้อย่างไร?
ฉันมีสิ่งนี้: d1 = OrderedDict([('a', '1'), ('b', '2')]) ถ้าฉันทำสิ่งนี้: d1.update({'c':'3'}) จากนั้นฉันจะได้รับสิ่งนี้: OrderedDict([('a', '1'), ('b', '2'), ('c', '3')]) แต่ฉันต้องการสิ่งนี้: [('c', '3'), ('a', '1'), ('b', '2')] โดยไม่ต้องสร้างพจนานุกรมใหม่

2
คำเตือนผู้ใช้ Python Pandas: การเรียงลำดับเนื่องจากแกนที่ไม่ต่อกันไม่ได้อยู่ในแนวเดียวกัน
ฉันกำลังฝึกโค้ดและใช้การรวมเฟรมข้อมูลในขณะที่กำลังรับคำเตือนจากผู้ใช้ /usr/lib64/python2.7/site-packages/pandas/core/frame.py:6201: FutureWarning: การเรียงลำดับเนื่องจากแกนที่ไม่ต่อกันไม่ได้อยู่ในแนวเดียวกัน แพนด้าในอนาคตจะเปลี่ยนเป็นไม่จัดเรียงตามค่าเริ่มต้น หากต้องการยอมรับพฤติกรรมในอนาคตให้ส่ง 'sort = True' ในการรักษาพฤติกรรมปัจจุบันและปิดเสียงคำเตือนให้ส่ง sort = False ในบรรทัดโค้ดเหล่านี้: คุณช่วยหาวิธีแก้ไขคำเตือนนี้ได้ไหม placement_video = [self.read_sql_vdx_summary, self.read_sql_video_km] placement_video_summary = reduce(lambda left, right: pd.merge(left, right, on='PLACEMENT', sort=False), placement_video) placement_by_video = placement_video_summary.loc[:, ["PLACEMENT", "PLACEMENT_NAME", "COST_TYPE", "PRODUCT", "VIDEONAME", "VIEW0", "VIEW25", "VIEW50", "VIEW75", "VIEW100", "ENG0", "ENG25", "ENG50", "ENG75", "ENG100", "DPE0", "DPE25", "DPE50", …
93 python  pandas 


โดยการใช้ไซต์ของเรา หมายความว่าคุณได้อ่านและทำความเข้าใจนโยบายคุกกี้และนโยบายความเป็นส่วนตัวของเราแล้ว
Licensed under cc by-sa 3.0 with attribution required.