Questions tagged «python»

Python是一种多范式,动态类型的多用途编程语言。它旨在快速学习,理解和使用并强制使用干净统一的语法。请注意,Python 2自2020年1月1日起已不再受支持。不过,对于特定于版本的Python问题,请添加[python-2.7]或[python-3.x]标签。使用Python变体或库(例如Jython,PyPy,Pandas,Numpy)时,请将其包含在标签中。

2
通过列名称连接熊猫数据框
我有两个具有以下列名称的数据框: frame_1: event_id, date, time, county_ID frame_2: countyid, state 我想通过加入(左)on获得以下列的数据框county_ID = countyid: joined_dataframe event_id, date, time, county, state 如果我要连接的列不是索引,我无法弄清楚该怎么做。最简单的方法是什么?谢谢!

11
等同于Python中的Bash反引号[重复]
这个问题已经在这里有了答案: 运行shell命令并捕获输出 (18个答案) 4个月前关闭。 相当于在Ruby和Perl中使用Python的反引号是什么?也就是说,在Ruby中,我可以这样做: foo = `cat /tmp/baz` Python中的等效语句是什么样的?我已经尝试过了,os.system("cat /tmp/baz")但这会将结果放入标准输出,并向我返回该操作的错误代码。
84 python  backticks 

4
检查点是否在python中的多边形内的最快方法是什么
我发现了两种主要方法来查看点是否属于多边形内。一种是使用此处使用的光线跟踪方法,这是最推荐的答案,另一种是使用matplotlib path.contains_points(对我来说似乎有点晦涩)。我将不得不不断检查很多要点。有人知道这两个中的任何一个是否比另一个更可取,或者是否有更好的第三种选择? 更新: 我检查了这两种方法,matplotlib看起来更快。 from time import time import numpy as np import matplotlib.path as mpltPath # regular polygon for testing lenpoly = 100 polygon = [[np.sin(x)+0.5,np.cos(x)+0.5] for x in np.linspace(0,2*np.pi,lenpoly)[:-1]] # random points set of points to test N = 10000 points = zip(np.random.random(N),np.random.random(N)) # Ray tracing def ray_tracing_method(x,y,poly): …

8
Python 3.7数据类中的类继承
我目前正在尝试Python 3.7中引入的新数据类构造。我目前坚持尝试做一些父类的继承。看来参数的顺序已被我当前的方法所破坏,使得子类中的bool参数在其他参数之前传递。这导致类型错误。 from dataclasses import dataclass @dataclass class Parent: name: str age: int ugly: bool = False def print_name(self): print(self.name) def print_age(self): print(self.age) def print_id(self): print(f'The Name is {self.name} and {self.name} is {self.age} year old') @dataclass class Child(Parent): school: str ugly: bool = True jack = Parent('jack snr', 32, ugly=True) …

3
Python多处理:了解“块大小”背后的逻辑
哪些因素决定了此类chunksize方法的最佳论点multiprocessing.Pool.map()?该.map()方法似乎对其默认的块大小使用了任意启发式(如下所述);是什么激发了这种选择,并且基于某些特定的情况/设置,是否有一种更周到的方法? 示例-说我是: 传递iterable给的.map()元素大约有1500万; 24个核的机器上工作,使用默认processes = os.cpu_count()内multiprocessing.Pool()。 我天真的想法是给24名工人中的每人一个相等大小的块,即15_000_000 / 24625,000。大块应该在充分利用所有工人的同时减少营业额/间接费用。但这似乎没有为每个工人提供大批量生产的潜在弊端。这是一张不完整的图片,我想念什么? 我的问题的一部分源于if的默认逻辑chunksize=None:both.map()和.starmap()call .map_async(),看起来像这样: def _map_async(self, func, iterable, mapper, chunksize=None, callback=None, error_callback=None): # ... (materialize `iterable` to list if it's an iterator) if chunksize is None: chunksize, extra = divmod(len(iterable), len(self._pool) * 4) # ???? if extra: chunksize += 1 if len(iterable) == …



4
使用Fabric时连接到〜/ .ssh / config中列出的主机
我Fabric无法识别自己所在的主机时遇到了麻烦~/.ssh/config。 我fabfile.py的如下: from fabric.api import run, env env.hosts = ['lulu'] def whoami(): run('whoami') 运行$ fab whoami给出: [lulu]跑:whoami 致命错误:lulu的名称查找失败 名称lulu在my中~/.ssh/config,如下所示: Host lulu hostname 192.168.100.100 port 2100 IdentityFile ~/.ssh/lulu-key 我首先想到的解决,这是添加类似lulu.lulu以/etc/hosts(我在Mac),但后来我也必须通过在身份文件面料-我宁愿让我的认证(即~/.ssh/config)从我的部署分开(即fabfile.py)。 同样,顺便说一句,如果您尝试连接到hosts文件中的主机,fabric.contrib.projects.rsync_project似乎并不会在中确认“端口” hosts.env(即,如果您使用hosts.env = [lulu:2100]调用rsync_project似乎尝试连接到lulu:21)。 Fabric是否无法识别此lulu名称?
83 python  ssh  fabric 

4
面向初学者的Django vs web2py [关闭]
从目前的情况来看,这个问题不适合我们的问答形式。我们希望答案能得到事实,参考或专业知识的支持,但是这个问题可能会引起辩论,争论,民意调查或扩展讨论。如果您认为此问题可以解决并且可以重新提出,请访问帮助中心以获取指导。 8年前关闭。 这两个框架中的哪个更适合具有11个月经验的开发人员。我决定学习python进行服务器端编码,并想知道其中哪一个更适合我的技能水平的人。我刚刚花了几天时间在玩web2py并非常喜欢它,我想知道Django是否提供了我错过的更多功能? PS。更新:谢谢大家的精彩输入,在购买了三本django书籍并经历了django和web2py的一些小型项目/教程之后,我选择了web2py。这是一个很棒的框架,对于新手来说,Web开发真的很有趣。我建议所有新手学习此框架,因为它将在将来成为主流。Django也是一个很棒的框架,但以我有限的经验来看,web2py更好。
83 python  django  web2py 

2
Twisted有什么好玩的?[关闭]
已关闭。这个问题是基于观点的。它当前不接受答案。 想改善这个问题吗?更新问题,以便通过编辑此帖子以事实和引用的形式回答。 4年前关闭。 改善这个问题 我越来越多地听到,与之相比,Python的Twisted框架和其他框架显得苍白。 任何人都可以对此有所了解,并可以将Twisted与其他网络编程框架进行比较。

4
使用NLTK创建新的语料库
我认为标题的答案通常是去阅读文档,但是我浏览了NLTK书,但没有给出答案。我是Python的新手。 我有很多.txt文件,我希望能够使用NLTK为语料库提供的语料库功能nltk_data。 我已经尝试过,PlaintextCorpusReader但是我无法超越: >>>import nltk >>>from nltk.corpus import PlaintextCorpusReader >>>corpus_root = './' >>>newcorpus = PlaintextCorpusReader(corpus_root, '.*') >>>newcorpus.words() 如何newcorpus使用punkt分割句子?我尝试使用punkt函数,但punkt函数无法读取PlaintextCorpusReader类? 您还可以引导我介绍如何将分段数据写入文本文件吗?
83 python  nlp  nltk  corpus 

9
什么时候不是使用python生成器的好时机?
这与您可以使用Python生成器函数做什么相反呢?:python生成器,生成器表达式和itertools模块是这些天我最喜欢的python功能。当设置操作链以对大量数据执行时,它们特别有用-我在处理DSV文件时经常使用它们。 那么什么时候不是使用生成器,生成器表达式或itertools函数的好时机? 我什么时候应该更喜欢zip()了itertools.izip(),或者 range()在xrange()或 [x for x in foo]结束了(x for x in foo)? 显然,我们最终需要通常通过创建列表或使用非生成器循环对其进行迭代来将生成器“解析”为实际数据。有时我们只需要知道长度即可。这不是我要的 我们使用生成器,以便我们不会将新列表分配到内存中以存储临时数据。这对于大型数据集尤其有意义。小型数据集也有意义吗?是否存在明显的内存/ CPU权衡? 考虑到列表理解性能与map()和filter()的令人大开眼界的讨论,如果有人对此进行了分析,我尤其感兴趣。(alt链接)

6
在Python中创建对象列表
我正在尝试创建一个Python脚本,该脚本打开多个数据库并比较它们的内容。在创建该脚本的过程中,我遇到了创建列表的问题,该列表的内容是我创建的对象。 我已将该程序简化为该帖子的基本内容。首先,我创建一个新类,为其创建一个新实例,为其分配一个属性,然后将其写入列表。然后,我为实例分配一个新值,然后再次将其写入列表...一次又一次... 问题是,它始终是同一对象,因此我实际上只是在更改基础对象。当我阅读列表时,我一遍又一遍地得到相同对象的重复。 那么如何在循环中将对象写入列表? 这是我的简化代码 class SimpleClass(object): pass x = SimpleClass # Then create an empty list simpleList = [] #Then loop through from 0 to 3 adding an attribute to the instance 'x' of SimpleClass for count in range(0,4): # each iteration creates a slightly different attribute value, and …
83 python  list  object  loops 

6
如何使用Python找到Wally?
无耻地跳上了潮流:-) 受我如何通过Mathematica查找Waldo以及后续如何使用R查找Waldo的启发,作为一个新的python用户,我很想知道如何做到这一点。似乎python比R更适合于此,并且我们不必像Mathematica或Matlab那样担心许可证。 在下面的示例中,显然仅使用条纹将不起作用。如果可以使基于简单规则的方法适用于诸如此类的困难示例,那将很有趣。 我添加了[machine-learning]标签,因为我认为正确的答案必须使用ML技术,例如Gregory Klopper在原始线程中倡导的Restricted Boltzmann Machine(RBM)方法。有一些在python中RBM代码可能是一个不错的起点,但是显然该方法需要训练数据。 在2009 IEEE信号处理机器学习国际研讨会上(MLSP 2009),他们举办了数据分析竞赛:Wally在哪里?。训练数据以matlab格式提供。请注意,该网站上的链接已失效,但数据(以及Sean McLoone和同事采用的方法的来源都可以在此处找到(请参阅SCM链接)。似乎是一个起点。

14
如何从Windows完全删除anaconda?
我前一段时间安装了Anaconda,但最近决定将其卸载,而仅安装基本的python 2.7。 我删除了Anaconda并删除了所有目录并安装了python 2.7。 但是,当我去安装Windows的PyGTK时,它说它将安装到c:/users/.../Anaconda directory-甚至不存在。我想将其安装到c:/python-2.7目录中。为什么认为Anaconda仍在安装?我该如何改变呢?

By using our site, you acknowledge that you have read and understand our Cookie Policy and Privacy Policy.
Licensed under cc by-sa 3.0 with attribution required.