タグ付けされた質問 「python」

Pythonは、マルチパラダイム、動的型付け、多目的プログラミング言語です。これは、学習、理解、使用が迅速で、クリーンで統一された構文を適用できるように設計されています。Python 2は2020年1月1日をもって正式にサポートされなくなりました。それでも、バージョン固有のPythonの質問については、[python-2.7]または[python-3.x]タグを追加します。Pythonのバリアントまたはライブラリ(Jython、PyPy、Pandas、Numpyなど)を使用する場合は、タグに含めてください。


6
Scikit学習のランダム状態(疑似乱数)
scikit learnに機械学習アルゴリズムを実装したいのですが、このパラメーターのrandom_state機能がわかりません。なぜそれを使用する必要があるのですか? また、疑似乱数とは何なのか理解できませんでした。

5
Pythonでオペレーティングシステムを確認するにはどうすればよいですか?
(スクリプトが実行されるコンピューター上の)オペレーティングシステムを確認したい。 os.system('uname -o')Linuxで使用できることはわかっていますが、コンソールにメッセージが表示され、変数に書き込みたいのですが。 スクリプトがMac、Windows、Linuxのいずれであるかを判別できれば問題ありません。どうすれば確認できますか?

11
Pythonで最も効率的な文字列連結方法は何ですか?
(のようなPythonで任意の効率的な大量の文字列の連結方法があるのStringBuilder C#または中StringBufferの Javaでは)?私はここに以下の方法を見つけました: を使用した単純な連結 + 文字列リストとjoinメソッドの使用 モジュールUserStringからの使用MutableString 文字配列とarrayモジュールの使用 モジュールcStringIOからの使用StringIO しかし、専門家は何を使用または提案していますか、そしてその理由は何ですか? [ ここに関連する質問 ]
148 python  string 

6
名前付きタプルを辞書に変換する
私はPythonで名前付きタプルクラスを持っています class Town(collections.namedtuple('Town', [ 'name', 'population', 'coordinates', 'population', 'capital', 'state_bird'])): # ... Townのインスタンスを辞書に変換したいのですが。タウンのフィールドの名前や数に厳密に結び付けられたくありません。 フィールドを追加したり、まったく異なる名前のタプルを渡して辞書を取得したりする方法はありますか? 他の誰かのコードのように元のクラス定義を変更することはできません。だから私は町のインスタンスを取り、それを辞書に変換する必要があります。

7
リストの最後のアイテムを削除する方法は?
特定の質問に答えるのにかかる時間を計算し、答えが正しくない場合にwhileループを終了するこのプログラムがありますが、最後の計算を削除したいので、呼び出すことができますがmin()、それは間違った時間ではありません。これは紛らわしいです。 from time import time q = input('What do you want to type? ') a = ' ' record = [] while a != '': start = time() a = input('Type: ') end = time() v = end-start record.append(v) if a == q: print('Time taken to type name: {:.2f}'.format(v)) else: …
148 python  time  python-3.x 

6
複数のフィルターをpandas DataFrameまたはSeriesに適用する効率的な方法
ユーザーがPandas DataFrameまたはSeriesオブジェクトにいくつかのフィルターを適用したいというシナリオがあります。基本的に、実行時にユーザーが指定した一連のフィルタリング(比較操作)を効率的にチェーン化したいと考えています。 フィルターは付加的である必要があります(別名を適用すると結果が絞り込まれます)。 私は現在使用してreindex()いますが、これにより毎回新しいオブジェクトが作成され、基になるデータがコピーされます(ドキュメントを正しく理解している場合)。そのため、大きなSeriesまたはDataFrameをフィルタリングする場合、これは非常に非効率的です。 私が使用していることを考えているapply()、map()または類似した何かが良いかもしれません。私はパンダにかなり慣れていないので、すべてに頭を包み込もうとしています。 TL; DR 次の形式のディクショナリを取得して、各操作を特定のSeriesオブジェクトに適用し、「フィルター処理された」Seriesオブジェクトを返します。 relops = {'>=': [1], '<=': [1]} 長い例 私が現在持っているものの例から始めて、単一のSeriesオブジェクトをフィルタリングするだけです。以下は私が現在使用している関数です: def apply_relops(series, relops): """ Pass dictionary of relational operators to perform on given series object """ for op, vals in relops.iteritems(): op_func = ops[op] for val in vals: filtered = op_func(series, val) series = …
148 python  algorithm  pandas 

3
Asyncio.gatherとasyncio.wait
asyncio.gatherそして、asyncio.wait同様の用途を持っているように見える:私は(必ずしも次の開始前に終了するのを待っていない1)のために/待機を実行したいことを、私は非同期物事の束を持っています。それらは異なる構文を使用しており、一部の詳細は異なりますが、機能が非常に重複している2つの関数を使用することは、私には非常に不便です。何が欠けていますか?

14
パンダとグループの合計の割合
これは明らかに単純ですが、派手な初心者として私は行き詰まっています。 そのオフィスのState、Office ID、およびSalesの3つの列を含むCSVファイルがあります。 特定の州のオフィスごとの売上のパーセンテージを計算したい(各州のパーセンテージの合計が100%である)。 df = pd.DataFrame({'state': ['CA', 'WA', 'CO', 'AZ'] * 3, 'office_id': range(1, 7) * 2, 'sales': [np.random.randint(100000, 999999) for _ in range(12)]}) df.groupby(['state', 'office_id']).agg({'sales': 'sum'}) これは次を返します: sales state office_id AZ 2 839507 4 373917 6 347225 CA 1 798585 3 890850 5 454423 CO 1 819975 3 …
148 python  pandas 

7
ChromeでSelenium WebDriver Pythonバインディングを実行する
Seleniumで作業中に問題が発生しました。私のプロジェクトでは、Chromeを使用する必要があります。ただし、Seleniumで起動した後、そのブラウザに接続できません。 何らかの理由で、Seleniumはそれ自体ではChromeを見つけることができません。パスを含めずにChromeを起動しようとすると、次のようになります。 Traceback (most recent call last): File "./obp_pb_get_csv.py", line 73, in <module> browser = webdriver.Chrome() # Get local session of chrome File "/usr/lib64/python2.7/site-packages/selenium/webdriver/chrome/webdriver.py", line 46, in __init__ self.service.start() File "/usr/lib64/python2.7/site-packages/selenium/webdriver/chrome/service.py", line 58, in start and read up at http://code.google.com/p/selenium/wiki/ChromeDriver") selenium.common.exceptions.WebDriverException: Message: 'ChromeDriver executable needs to be available in the …

11
美しいスープとdivとそのコンテンツをIDで抽出
soup.find("tagName", { "id" : "articlebody" }) なぜこれは<div id="articlebody"> ... </div>タグとその間のものを返さないのですか?何も返しません。そして私はそれが存在するという事実を知っています。 soup.prettify() soup.find("div", { "id" : "articlebody" }) また動作しません。 (編集: BeautifulSoupがページを正しく解析していないことがわかりました。おそらく、解析しようとしたページがSGMLなどで正しくフォーマットされていないことを意味します)

6
正規表現の「\ d」は数字を意味しますか?
私はそれを123と\d一致しましたが、一致1し3ませんでした2。\dどのような要件を満たす数字と一致するか疑問に思っていましたか?私はPythonスタイルの正規表現について話している。 Geditの正規表現プラグインは、Pythonスタイルの正規表現を使用しています。私はその内容が含まれているテキストファイルを作成しました 123 正規表現のみ1と3一致し\dます。2ではありません。 一般に、間に他の文字がない数字のシーケンスの場合、奇数桁のみが一致し、偶数桁は一致しません。たとえばでは12345、マッチがある1、3と5。
147 python  regex  encoding  gedit 


12
関数Aが関数Bでのみ必要な場合、AをB内で定義する必要がありますか?[閉まっている]
休業。この質問は意見に基づいています。現在、回答を受け付けていません。 この質問を改善したいですか?この投稿を編集して、事実と引用で回答できるように質問を更新してください。 5か月前に閉鎖。 この質問を改善する 簡単な例。2つのメソッド、1つは別のメソッドから呼び出されます。 def method_a(arg): some_data = method_b(arg) def method_b(arg): return some_data Pythonでは、def別の内部で宣言できdefます。それで、にmethod_bのみ必要でありmethod_a、からのみ呼び出される場合、method_b内部で宣言する必要がありmethod_aますか?このような : def method_a(arg): def method_b(arg): return some_data some_data = method_b(arg) それとも私はこれを避けるべきですか?

2
os.walkのディレクトリを除外する
(os.walk()を使用して)ディレクトリツリーに降りてから、特定のファイル拡張子に一致する各ファイルにアクセスするスクリプトを作成しています。ただし、私のツールが使用される一部のディレクトリツリーにはサブディレクトリも含まれているため、LOTが含まれていますれているため、(このスクリプトの目的で)役に立たないものため、ユーザーが指定するオプションを追加すると考えました走査から除外するディレクトリのリスト。 これはos.walk()で十分簡単です。結局のところ、os.walk()によって生成されたそれぞれのファイル/ディレクトリに実際にアクセスするか、単にスキップするかは、私次第です。問題は、たとえば次のようなディレクトリツリーがある場合です。 root-- | --- dirA | --- dirB | --- uselessStuff -- | --- moreJunk | --- yetMoreJunk そして、私は除外するuselessStuffまだ全ての(潜在的に数千人)のサブディレクトリに降ります)とそのすべての子、os.walkを(uselessStuff、多くのダウン物事を遅く言うまでもないです、、。理想的な世界では、私はos.walk()に、役に立たないStuffの子をこれ以上生成しないように指示することができますが、私の知る限り、それを行う方法はありません(ありますか?)。 誰かがアイデアを持っていますか?たぶん、そのようなものを提供するサードパーティのライブラリはありますか?
147 python 

弊社のサイトを使用することにより、あなたは弊社のクッキーポリシーおよびプライバシーポリシーを読み、理解したものとみなされます。
Licensed under cc by-sa 3.0 with attribution required.