[SPARK-8670] [SQL] Nested columns can't be referenced in pyspark

This bug is caused by a wrong column-exist-check in `__getitem__` of pyspark dataframe. `DataFrame.apply` accepts not only top level column names, but also nested column name like `a.b`, so we should remove that check from `__getitem__`. Author: Wenchen Fan <cloud0fan@outlook.com> Closes #8202 from cloud-fan/nested.
author: Wenchen Fan <cloud0fan@outlook.com> 2015-08-14 14:09:46 -0700
committer: Michael Armbrust <michael@databricks.com> 2015-08-14 14:09:46 -0700
commit: 1150a19b188a075166899fdb1e107b2ba1e505d8 (patch)
tree: b5b45d3285002e3b276d47ac5d5b40c0b11f4ff8 /python/pyspark/sql/dataframe.py
parent: 2a6590e510aba3bfc6603d280023128b3f5ac702 (diff)
download: spark-1150a19b188a075166899fdb1e107b2ba1e505d8.tar.gz
spark-1150a19b188a075166899fdb1e107b2ba1e505d8.tar.bz2
spark-1150a19b188a075166899fdb1e107b2ba1e505d8.zip
1 files changed, 0 insertions, 2 deletions
diff --git a/python/pyspark/sql/dataframe.py b/python/pyspark/sql/dataframe.py
index 09647ff6d0..da742d7ce7 100644
--- a/python/pyspark/sql/dataframe.py
+++ b/python/pyspark/sql/dataframe.py
@@ -722,8 +722,6 @@ class DataFrame(object):
         [Row(age=5, name=u'Bob')]
         """
         if isinstance(item, basestring):
-            if item not in self.columns:
-                raise IndexError("no such column: %s" % item)
             jc = self._jdf.apply(item)
             return Column(jc)
         elif isinstance(item, Column):
author	Wenchen Fan <cloud0fan@outlook.com>	2015-08-14 14:09:46 -0700
committer	Michael Armbrust <michael@databricks.com>	2015-08-14 14:09:46 -0700
commit	1150a19b188a075166899fdb1e107b2ba1e505d8 (patch)
tree	b5b45d3285002e3b276d47ac5d5b40c0b11f4ff8 /python/pyspark/sql/dataframe.py
parent	2a6590e510aba3bfc6603d280023128b3f5ac702 (diff)
download	spark-1150a19b188a075166899fdb1e107b2ba1e505d8.tar.gz spark-1150a19b188a075166899fdb1e107b2ba1e505d8.tar.bz2 spark-1150a19b188a075166899fdb1e107b2ba1e505d8.zip