<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:taxo="http://purl.org/rss/1.0/modules/taxonomy/" version="2.0">
  <channel>
    <title>topic Re: Cannot convert numpy type object to spark type in Data Science</title>
    <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4633441#M699</link>
    <description>&lt;P&gt;&lt;a href="javascript:void(0)" data-lia-user-mentions="" data-lia-user-uid="751587" data-lia-user-login="MiSchroe" class="lia-mention lia-mention-user"&gt;MiSchroe&lt;/a&gt;&amp;nbsp;- Thanks for clarifying the cause of the error.&amp;nbsp; Pardon my ignorance, but could you explain how you would change the dtype from object to int64 in the context of this data science tutorial.&amp;nbsp; Any help would be greatly appreciated as I'd like to better understand how this all fits together and complete it.&lt;/P&gt;</description>
    <pubDate>Tue, 01 Apr 2025 13:49:41 GMT</pubDate>
    <dc:creator>jchAgAr</dc:creator>
    <dc:date>2025-04-01T13:49:41Z</dc:date>
    <item>
      <title>Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4340883#M573</link>
      <description>&lt;P&gt;I am new to MS fabric and trying to do a tutorial hands on -&amp;nbsp;&lt;A href="https://learn.microsoft.com/en-us/fabric/data-science/tutorial-data-science-batch-scoring" target="_blank" rel="noopener"&gt;https://learn.microsoft.com/en-us/fabric/data-science/tutorial-data-science-batch-scoring&lt;/A&gt;&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;I am running the following code to&amp;nbsp;Instantiate MLFlowTransformer object&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;&lt;SPAN class=""&gt;from&lt;/SPAN&gt;&lt;SPAN&gt; synapse.ml.predict &lt;/SPAN&gt;&lt;SPAN class=""&gt;import&lt;/SPAN&gt;&lt;SPAN&gt; MLFlowTransformer &lt;/SPAN&gt;&lt;/P&gt;&lt;P&gt;&lt;SPAN&gt;model = MLFlowTransformer( inputCols=list(df_test.columns), &lt;/SPAN&gt;&lt;/P&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp; &amp;nbsp; &amp;nbsp; &amp;nbsp; outputCol=&lt;/SPAN&gt;&lt;SPAN class=""&gt;'predictions'&lt;/SPAN&gt;&lt;SPAN&gt;, &lt;/SPAN&gt;&lt;/P&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp; &amp;nbsp; &amp;nbsp; &amp;nbsp;modelName=&lt;/SPAN&gt;&lt;SPAN class=""&gt;'lgbm_sm'&lt;/SPAN&gt;&lt;SPAN&gt;, &lt;/SPAN&gt;&lt;/P&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp; &amp;nbsp; &amp;nbsp; &amp;nbsp;modelVersion=&lt;/SPAN&gt;&lt;SPAN class=""&gt;1&lt;/SPAN&gt;&lt;SPAN&gt; )&lt;/SPAN&gt;&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;&lt;SPAN&gt;It is failing with following error&lt;/SPAN&gt;&lt;/P&gt;&lt;P&gt;&lt;SPAN&gt;&lt;SPAN class=""&gt;ValueError&lt;/SPAN&gt;: Cannot convert numpy type object to spark type&lt;/SPAN&gt;&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;&lt;SPAN&gt;How do I resolve this error? Is it something to do with list(df_test.columns)? Please advice.&lt;/SPAN&gt;&lt;/P&gt;</description>
      <pubDate>Mon, 23 Dec 2024 14:13:47 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4340883#M573</guid>
      <dc:creator>Anonymous</dc:creator>
      <dc:date>2024-12-23T14:13:47Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4341573#M574</link>
      <description>&lt;P&gt;Hi&amp;nbsp;Anonymous&lt;/a&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;I followed the tutorials without experiencing any error. Instead of entering codes manually, I downloaded and imported notebooks from&amp;nbsp;&lt;A href="https://github.com/microsoft/fabric-samples/tree/main/docs-samples/data-science/data-science-tutorial" target="_blank" rel="noopener"&gt;microsoft/fabric-samples · GitHub&lt;/A&gt;.&amp;nbsp;You can try running these notebooks and see if they work. Ensure that&amp;nbsp;&lt;SPAN&gt;you need to attach the same lakehouse you used in the other parts of this series.&lt;/SPAN&gt;&lt;/P&gt;
&lt;P&gt;&lt;img /&gt;&lt;/P&gt;
&lt;P&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;For the error you encountered, you can check the output of the previous code cell of the problem code. At the same time make sure that the attached lakehouse is correct. "&lt;SPAN&gt;df_test" is a table created in&amp;nbsp;&lt;/SPAN&gt;&lt;A href="https://learn.microsoft.com/en-us/fabric/data-science/tutorial-data-science-train-models" target="_blank" rel="noopener"&gt;Tutorial Part 3&lt;/A&gt;.&amp;nbsp;&lt;/P&gt;
&lt;P&gt;&lt;img /&gt;&lt;/P&gt;
&lt;P&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;Best Regards,&lt;BR /&gt;Jing&lt;BR /&gt;&lt;EM&gt;If this post helps, please Accept it as Solution to help other members find it. Appreciate your Kudos! &lt;/EM&gt;&lt;/P&gt;</description>
      <pubDate>Tue, 24 Dec 2024 05:38:33 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4341573#M574</guid>
      <dc:creator>Anonymous</dc:creator>
      <dc:date>2024-12-24T05:38:33Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4342039#M576</link>
      <description>&lt;P&gt;Thank you for taking time to reply to my question. I followed the same steps exactly as you mentioned in your reply. Downloaded the notebooks from GitHub, followed the sequence of steps as mentioned in tutorial, no changes to note book code, all steps ran absolutely fine until this particular cell as mentioned&amp;nbsp; in my initial question. Any more insights as to what is causing this error and how to resolve it?&lt;/P&gt;</description>
      <pubDate>Tue, 24 Dec 2024 10:55:29 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4342039#M576</guid>
      <dc:creator>Anonymous</dc:creator>
      <dc:date>2024-12-24T10:55:29Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4342990#M578</link>
      <description>&lt;P&gt;yes, me also getting same error. can any one please tell us. how to slove it&amp;nbsp;&lt;/P&gt;</description>
      <pubDate>Wed, 25 Dec 2024 17:53:05 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4342990#M578</guid>
      <dc:creator>Baludesineti</dc:creator>
      <dc:date>2024-12-25T17:53:05Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4344086#M581</link>
      <description>&lt;P&gt;Hi&amp;nbsp;Anonymous&lt;/a&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;I tested it again and it still worked at my end. I got nothing but a warning.&amp;nbsp;&lt;/P&gt;
&lt;P&gt;&lt;img /&gt;&lt;/P&gt;
&lt;P&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;I guess maybe our environment is a little different? I ran the notebook in Runtime 1.2. My service&amp;nbsp;&lt;SPAN class=""&gt;version is&amp;nbsp;&lt;SPAN class=""&gt;13.0.24766.49 and data region is&amp;nbsp;&lt;SPAN&gt;UK South (London).&amp;nbsp;Can you check your environment?&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/P&gt;
&lt;P&gt;&lt;img /&gt;&lt;img /&gt;&lt;/P&gt;
&lt;P&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;Best Regards,&lt;BR /&gt;Jing&lt;/P&gt;</description>
      <pubDate>Fri, 27 Dec 2024 03:22:56 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4344086#M581</guid>
      <dc:creator>Anonymous</dc:creator>
      <dc:date>2024-12-27T03:22:56Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4402161#M633</link>
      <description>&lt;P&gt;It seems like the issue might be related to the format of the DataFrame you're using. Make sure you're working with a valid Spark DataFrame, not a pandas one, as Spark expects a different structure.&lt;/P&gt;&lt;P&gt;Also, double-check that your model name and version are correct and compatible with your setup. It’s a good idea to ensure that your Spark and MLFlow versions are aligned with MS Fabric as well.&lt;/P&gt;</description>
      <pubDate>Mon, 10 Feb 2025 06:15:30 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4402161#M633</guid>
      <dc:creator>DrewAnderson</dc:creator>
      <dc:date>2025-02-10T06:15:30Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4586783#M645</link>
      <description>&lt;P&gt;Hi&amp;nbsp;Anonymous&lt;/a&gt;&amp;nbsp;&lt;BR /&gt;Thank you for your answers,&amp;nbsp; I followed your suggestion and switched to Runtime 1.2. I can ensure that I did upload and execute those notebooks without any modification, and I tried to run all the previous 3 notebooks and used the same Runtime 1.2.&lt;BR /&gt;Unfortunately, I'm facing this new error&amp;nbsp;&lt;BR /&gt;&lt;img /&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;BR /&gt;any idea how to fix this? Thanks.&lt;BR /&gt;&lt;BR /&gt;&lt;/P&gt;</description>
      <pubDate>Wed, 26 Feb 2025 22:04:03 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4586783#M645</guid>
      <dc:creator>Anonymous</dc:creator>
      <dc:date>2025-02-26T22:04:03Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4598339#M655</link>
      <description>&lt;P&gt;I ran into the same problem.&lt;/P&gt;&lt;P&gt;BTW, I used the notebook from Explore a sample in Fabric.&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;It turned out that the "Exited" column was converted into a string where the plot over the categorical columns was coded. Instead, the Exited column has to be of type integer before you feed it into the training.&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;You can check in your experiment in the MLmodel file:&lt;/P&gt;&lt;P&gt;&lt;img /&gt;&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;In line 34 the dtype should be int64, not object!&lt;/P&gt;&lt;P&gt;Don't forget to adapt the version number to your latest version of the model in the call to MLFlowTransformer.&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;Hope it helps!&lt;/P&gt;&lt;P&gt;Michael&lt;/P&gt;</description>
      <pubDate>Thu, 06 Mar 2025 10:35:46 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4598339#M655</guid>
      <dc:creator>MiSchroe</dc:creator>
      <dc:date>2025-03-06T10:35:46Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4633441#M699</link>
      <description>&lt;P&gt;&lt;a href="javascript:void(0)" data-lia-user-mentions="" data-lia-user-uid="751587" data-lia-user-login="MiSchroe" class="lia-mention lia-mention-user"&gt;MiSchroe&lt;/a&gt;&amp;nbsp;- Thanks for clarifying the cause of the error.&amp;nbsp; Pardon my ignorance, but could you explain how you would change the dtype from object to int64 in the context of this data science tutorial.&amp;nbsp; Any help would be greatly appreciated as I'd like to better understand how this all fits together and complete it.&lt;/P&gt;</description>
      <pubDate>Tue, 01 Apr 2025 13:49:41 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4633441#M699</guid>
      <dc:creator>jchAgAr</dc:creator>
      <dc:date>2025-04-01T13:49:41Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4634723#M700</link>
      <description>&lt;P&gt;In the notebook 3-train-evaluate I have changed the data type of the Exited column to int:&lt;/P&gt;&lt;P&gt;&lt;img /&gt;&lt;/P&gt;&lt;P&gt;NOTE: In row 3 I load the table dbo.df_clean, because I have used a Lakehouse with the new schema. In the original tutorial the schema has to be omitted.&lt;/P&gt;</description>
      <pubDate>Wed, 02 Apr 2025 09:26:37 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4634723#M700</guid>
      <dc:creator>MiSchroe</dc:creator>
      <dc:date>2025-04-02T09:26:37Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4687571#M754</link>
      <description>&lt;P&gt;The error you're seeing —&lt;BR /&gt;&lt;STRONG&gt;ValueError: Cannot convert numpy type object to spark type&lt;/STRONG&gt; — typically means that Spark is encountering a data type in your input that it doesn't know how to convert into its internal types, and it often relates to using numpy.object_ or dtype=object in your DataFrame columns.&lt;/P&gt;&lt;H3&gt;Root Cause:&lt;/H3&gt;&lt;P&gt;In your code:&lt;/P&gt;&lt;PRE&gt;model = MLFlowTransformer(
    inputCols=list(df_test.columns),
    outputCol='predictions',
    modelName='lgbm_sm',
    modelVersion=1
)&lt;/PRE&gt;&lt;P&gt;You're passing list(df_test.columns) as the inputCols. This itself is likely &lt;STRONG&gt;not&lt;/STRONG&gt; the problem.&lt;/P&gt;&lt;P&gt;The &lt;STRONG&gt;real issue&lt;/STRONG&gt; is most likely with the df_test DataFrame — it seems to be a &lt;STRONG&gt;Pandas DataFrame&lt;/STRONG&gt; (or a Spark DataFrame with some columns of ambiguous/numpy object type), and SynapseML expects a &lt;STRONG&gt;Spark DataFrame&lt;/STRONG&gt; with well-defined schema and no ambiguous types.&lt;/P&gt;&lt;HR /&gt;&lt;H3&gt;&lt;span class="lia-unicode-emoji" title=":white_heavy_check_mark:"&gt;✅&lt;/span&gt; How to Fix It:&lt;/H3&gt;&lt;OL&gt;&lt;LI&gt;&lt;P&gt;&lt;STRONG&gt;Ensure df_test is a Spark DataFrame&lt;/STRONG&gt;, not a Pandas one. If it's currently a Pandas DataFrame, convert it:&lt;/P&gt;&lt;/LI&gt;&lt;/OL&gt;&lt;PRE&gt;spark_df_test = spark.createDataFrame(df_test)&lt;/PRE&gt;&lt;P&gt;But even when converting, Spark sometimes can't infer schema properly from object dtype. So it’s safer to:&lt;/P&gt;&lt;OL&gt;&lt;LI&gt;&lt;P&gt;&lt;STRONG&gt;Make sure df_test has clear types&lt;/STRONG&gt; before conversion:&lt;/P&gt;&lt;/LI&gt;&lt;/OL&gt;&lt;PRE&gt;import pandas as pd

# Ensure all columns have concrete types (avoid object dtype)
df_test = df_test.astype({
    'col1': 'float64',
    'col2': 'int64',
    'col3': 'string',  # Replace with your actual column names/types
    # ...
})&lt;/PRE&gt;&lt;P&gt;Then convert:&lt;/P&gt;&lt;PRE&gt;spark_df_test = spark.createDataFrame(df_test)&lt;/PRE&gt;&lt;OL&gt;&lt;LI&gt;&lt;P&gt;&lt;STRONG&gt;Pass the Spark DataFrame to your pipeline&lt;/STRONG&gt;:&lt;/P&gt;&lt;/LI&gt;&lt;/OL&gt;&lt;PRE&gt;model = MLFlowTransformer(
    inputCols=spark_df_test.columns,
    outputCol='predictions',
    modelName='lgbm_sm',
    modelVersion=1
)

transformed = model.transform(spark_df_test)&lt;/PRE&gt;&lt;HR /&gt;&lt;H3&gt;&lt;span class="lia-unicode-emoji" title=":white_heavy_check_mark:"&gt;✅&lt;/span&gt; Summary&lt;/H3&gt;&lt;UL&gt;&lt;LI&gt;&lt;P&gt;Ensure you're using a &lt;STRONG&gt;Spark DataFrame&lt;/STRONG&gt;, not a Pandas one.&lt;/P&gt;&lt;/LI&gt;&lt;LI&gt;&lt;P&gt;Make sure all columns in your DataFrame have &lt;STRONG&gt;explicit types&lt;/STRONG&gt;, especially no object types.&lt;/P&gt;&lt;/LI&gt;&lt;LI&gt;&lt;P&gt;Use .astype() in Pandas before converting to Spark DataFrame.&lt;/P&gt;&lt;/LI&gt;&lt;LI&gt;&lt;P&gt;Use spark.createDataFrame() for conversion.&lt;/P&gt;&lt;/LI&gt;&lt;/UL&gt;&lt;P&gt;Would you like help inferring the correct schema for your DataFrame or code to automatically clean the column types?&lt;/P&gt;</description>
      <pubDate>Sat, 10 May 2025 17:56:40 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4687571#M754</guid>
      <dc:creator>fikakagyta</dc:creator>
      <dc:date>2025-05-10T17:56:40Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4907061#M1004</link>
      <description>&lt;P&gt;Great point. It solved my problem!&lt;BR /&gt;At first I went to convert all booleans to int, and of course it did not work. The problem was "Exited," as you mentioned already.&lt;/P&gt;</description>
      <pubDate>Mon, 22 Dec 2025 13:42:34 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4907061#M1004</guid>
      <dc:creator>Ali_Saghi</dc:creator>
      <dc:date>2025-12-22T13:42:34Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4907513#M1014</link>
      <description>&lt;P&gt;Hello&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;DIV&gt;&lt;P&gt;This error usually comes from a type mismatch between what MLFlowTransformer (and the underlying pandas UDF it uses) expects and what your DataFrame is actually providing.&lt;/P&gt;&lt;P&gt;ValueError: Cannot convert numpy type object to spark type typically means that somewhere in the pipeline Spark is seeing a NumPy object dtype (from pandas or an Arrow conversion) and doesn’t know how to map it to a Spark type. This often happens when:&lt;/P&gt;&lt;UL&gt;&lt;LI&gt;You pass a pandas DataFrame (or columns derived from pandas with object dtype) instead of a Spark DataFrame.&lt;/LI&gt;&lt;LI&gt;Your Spark columns contain arrays, maps, or mixed-type columns that Spark inferred as object (via Arrow/pandas), or they’re null-heavy and Spark guessed an ambiguous type.&lt;/LI&gt;&lt;LI&gt;The MLflow model signature expects certain columns/types (e.g., a single features vector) but you’re passing raw columns as inputCols that include non-primitive types or types that don’t match the model signature.&lt;/LI&gt;&lt;/UL&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;&lt;SPAN&gt;&lt;!--  ScriptorStartFragment  --&gt;&lt;/SPAN&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;# If you accidentally used pandas:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;import&lt;/SPAN&gt; &lt;SPAN&gt;pandas&lt;/SPAN&gt; &lt;SPAN&gt;as&lt;/SPAN&gt; &lt;SPAN&gt;pd&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;from&lt;/SPAN&gt; &lt;SPAN&gt;pyspark&lt;/SPAN&gt;&lt;SPAN&gt;.sql&lt;/SPAN&gt;&lt;SPAN&gt;.types&lt;/SPAN&gt; &lt;SPAN&gt;import&lt;/SPAN&gt; &lt;SPAN&gt;*&lt;/SPAN&gt;&lt;/DIV&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp;&lt;/SPAN&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;# Suppose you have a pandas DataFrame `pdf_test`&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;# Clean up pandas object dtypes to concrete types first&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;for&lt;/SPAN&gt; &lt;SPAN&gt;col&lt;/SPAN&gt; &lt;SPAN&gt;in&lt;/SPAN&gt; &lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;.columns&lt;/SPAN&gt;&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;if&lt;/SPAN&gt; &lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt;&lt;SPAN&gt;.dtype&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt;&lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;'object'&lt;/SPAN&gt;&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;# If it's actually numeric but stored as object&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;try&lt;/SPAN&gt;&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;pd&lt;/SPAN&gt;&lt;SPAN&gt;.to_numeric&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;except&lt;/SPAN&gt; &lt;SPAN&gt;Exception&lt;/SPAN&gt;&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;# Otherwise keep as string&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt;&lt;SPAN&gt;.astype&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;str&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp;&lt;/SPAN&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;# Then define a schema (recommended)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;schema&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;StructType&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;# Adjust types to match your data and your model signature&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;StructField&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;"col1"&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt; &lt;SPAN&gt;DoubleType&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;StructField&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;"col2"&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt; &lt;SPAN&gt;DoubleType&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;StructField&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;"cat1"&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt; &lt;SPAN&gt;StringType&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;# ...&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;]&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp;&lt;/SPAN&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;df_test&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;spark&lt;/SPAN&gt;&lt;SPAN&gt;.createDataFrame&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt; &lt;SPAN&gt;schema&lt;/SPAN&gt;&lt;SPAN&gt;=&lt;/SPAN&gt;&lt;SPAN&gt;schema&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;P&gt;&lt;SPAN&gt;&lt;!--  ScriptorEndFragment  --&gt;&lt;/SPAN&gt;&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;&lt;STRONG&gt;Accept as a solution if this helps!&amp;nbsp;&lt;/STRONG&gt;&lt;/P&gt;&lt;/DIV&gt;</description>
      <pubDate>Tue, 23 Dec 2025 12:19:14 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4907513#M1014</guid>
      <dc:creator>deborshi_nag</dc:creator>
      <dc:date>2025-12-23T12:19:14Z</dc:date>
    </item>
    <item>
      <title>Re: Cannot convert numpy type object to spark type</title>
      <link>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4907514#M1015</link>
      <description>&lt;P&gt;Hi,&amp;nbsp;&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;DIV&gt;&lt;H3&gt;It is quite possible that Model expects &lt;STRONG&gt;multiple raw columns (pyfunc/predict on a table of primitives)&lt;/STRONG&gt;&lt;/H3&gt;&lt;P&gt;Then all columns in inputCols must be &lt;STRONG&gt;Spark primitive types (e.g., DoubleType, IntegerType, StringType, BooleanType). Avoid object, mixed arrays, or Python objects.&lt;/STRONG&gt;&lt;/P&gt;&lt;P&gt;&lt;STRONG&gt;&amp;nbsp;&lt;/STRONG&gt;&lt;/P&gt;&lt;P&gt;&lt;STRONG&gt;&lt;SPAN&gt;&lt;!--       ScriptorStartFragment       --&gt;&lt;/SPAN&gt;&lt;/STRONG&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;STRONG&gt;&lt;STRONG&gt;&lt;SPAN&gt;from &lt;SPAN&gt;pyspark&lt;SPAN&gt;.sql &lt;SPAN&gt;import &lt;SPAN&gt;functions &lt;SPAN&gt;as &lt;SPAN&gt;F&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/STRONG&gt;&lt;/STRONG&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&lt;SPAN&gt;from &lt;SPAN&gt;pyspark&lt;SPAN&gt;.sql&lt;SPAN&gt;.types &lt;SPAN&gt;import &lt;SPAN&gt;DoubleType&lt;SPAN&gt;, &lt;SPAN&gt;IntegerType&lt;SPAN&gt;, &lt;SPAN&gt;StringType&lt;SPAN&gt;, &lt;SPAN&gt;BooleanType&lt;SPAN&gt;, &lt;SPAN&gt;FloatType&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp;&lt;/SPAN&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&lt;SPAN&gt;# Cast numerics to DoubleType (safer for Arrow/pandas UDFs)&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&lt;SPAN&gt;for &lt;SPAN&gt;c&lt;SPAN&gt;, &lt;SPAN&gt;t &lt;SPAN&gt;in &lt;SPAN&gt;df_test&lt;SPAN&gt;.dtypes&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;SPAN&gt;if &lt;SPAN&gt;t &lt;SPAN&gt;in &lt;SPAN&gt;(&lt;SPAN&gt;'tinyint'&lt;SPAN&gt;, &lt;SPAN&gt;'smallint'&lt;SPAN&gt;, &lt;SPAN&gt;'int'&lt;SPAN&gt;, &lt;SPAN&gt;'bigint'&lt;SPAN&gt;, &lt;SPAN&gt;'float'&lt;SPAN&gt;, &lt;SPAN&gt;'double'&lt;SPAN&gt;, &lt;SPAN&gt;'decimal'&lt;SPAN&gt;)&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;SPAN&gt;df_test &lt;SPAN&gt;= &lt;SPAN&gt;df_test&lt;SPAN&gt;.withColumn&lt;SPAN&gt;(&lt;SPAN&gt;c&lt;SPAN&gt;, &lt;SPAN&gt;F&lt;SPAN&gt;.col&lt;SPAN&gt;(&lt;SPAN&gt;c&lt;SPAN&gt;)&lt;SPAN&gt;.cast&lt;SPAN&gt;(&lt;SPAN&gt;DoubleType&lt;SPAN&gt;(&lt;SPAN&gt;)&lt;SPAN&gt;)&lt;!--       ScriptorEndFragment       --&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&amp;nbsp;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;&lt;SPAN&gt;It can also mean&amp;nbsp;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;SPAN&gt;that somewhere in the pipeline Spark is seeing a &lt;/SPAN&gt;&lt;STRONG&gt;NumPy object dtype&lt;/STRONG&gt;&lt;SPAN&gt; (from pandas or an Arrow conversion) and doesn’t know how to map it to a Spark type.&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&amp;nbsp;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;P&gt;&lt;SPAN&gt;&lt;!--    ScriptorStartFragment    --&gt;&lt;/SPAN&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;# If you accidentally used pandas:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;import&lt;/SPAN&gt; &lt;SPAN&gt;pandas&lt;/SPAN&gt; &lt;SPAN&gt;as&lt;/SPAN&gt; &lt;SPAN&gt;pd&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;from&lt;/SPAN&gt; &lt;SPAN&gt;pyspark&lt;/SPAN&gt;&lt;SPAN&gt;.sql&lt;/SPAN&gt;&lt;SPAN&gt;.types&lt;/SPAN&gt; &lt;SPAN&gt;import&lt;/SPAN&gt; &lt;SPAN&gt;*&lt;/SPAN&gt;&lt;/DIV&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp;&lt;/SPAN&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;# Suppose you have a pandas DataFrame `pdf_test`&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;# Clean up pandas object dtypes to concrete types first&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;for&lt;/SPAN&gt; &lt;SPAN&gt;col&lt;/SPAN&gt; &lt;SPAN&gt;in&lt;/SPAN&gt; &lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;.columns&lt;/SPAN&gt;&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;if&lt;/SPAN&gt; &lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt;&lt;SPAN&gt;.dtype&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt;&lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;'object'&lt;/SPAN&gt;&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;# If it's actually numeric but stored as object&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;try&lt;/SPAN&gt;&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;pd&lt;/SPAN&gt;&lt;SPAN&gt;.to_numeric&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;except&lt;/SPAN&gt; &lt;SPAN&gt;Exception&lt;/SPAN&gt;&lt;SPAN&gt;:&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;# Otherwise keep as string&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;SPAN&gt;col&lt;/SPAN&gt;&lt;SPAN&gt;]&lt;/SPAN&gt;&lt;SPAN&gt;.astype&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;str&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp;&lt;/SPAN&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;# Then define a schema (recommended)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;schema&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;StructType&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;[&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;# Adjust types to match your data and your model signature&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;StructField&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;"col1"&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt; &lt;SPAN&gt;DoubleType&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;StructField&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;"col2"&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt; &lt;SPAN&gt;DoubleType&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;StructField&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;"cat1"&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt; &lt;SPAN&gt;StringType&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;/SPAN&gt;&lt;SPAN&gt;# ...&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;]&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;P&gt;&lt;SPAN&gt;&amp;nbsp;&lt;/SPAN&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;SPAN&gt;df_test&lt;/SPAN&gt; &lt;SPAN&gt;=&lt;/SPAN&gt; &lt;SPAN&gt;spark&lt;/SPAN&gt;&lt;SPAN&gt;.createDataFrame&lt;/SPAN&gt;&lt;SPAN&gt;(&lt;/SPAN&gt;&lt;SPAN&gt;pdf_test&lt;/SPAN&gt;&lt;SPAN&gt;,&lt;/SPAN&gt; &lt;SPAN&gt;schema&lt;/SPAN&gt;&lt;SPAN&gt;=&lt;/SPAN&gt;&lt;SPAN&gt;schema&lt;/SPAN&gt;&lt;SPAN&gt;)&lt;/SPAN&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;&amp;nbsp;&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;STRONG&gt;Please accept it as a solution if it helped! &lt;/STRONG&gt;&lt;/DIV&gt;&lt;P&gt;&lt;SPAN&gt;&lt;!--    ScriptorEndFragment    --&gt;&lt;/SPAN&gt;&lt;/P&gt;&lt;/DIV&gt;&lt;/DIV&gt;&lt;/DIV&gt;&lt;/DIV&gt;&lt;/DIV&gt;&lt;/DIV&gt;&lt;/DIV&gt;</description>
      <pubDate>Tue, 23 Dec 2025 12:29:28 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/Data-Science/Cannot-convert-numpy-type-object-to-spark-type/m-p/4907514#M1015</guid>
      <dc:creator>deborshi_nag</dc:creator>
      <dc:date>2025-12-23T12:29:28Z</dc:date>
    </item>
  </channel>
</rss>

