<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:taxo="http://purl.org/rss/1.0/modules/taxonomy/" version="2.0">
  <channel>
    <title>topic Re: Traffic split behavior when traffic_percentage values across served entities sum to more than 10 in Machine Learning</title>
    <link>https://community.databricks.com/t5/machine-learning/traffic-split-behavior-when-traffic-percentage-values-across/m-p/164627#M4660</link>
    <description>&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Hi,&lt;/SPAN&gt;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&amp;nbsp;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Just been looking into this for you. All the docs I found suggested it would reject to I tried testing it myself. I tried setting &lt;/SPAN&gt;&lt;CODE spellcheck="false"&gt;&lt;SPAN class="doc-editor-code"&gt;traffic_config&lt;/SPAN&gt;&lt;/CODE&gt;&lt;SPAN&gt; with various percentage combinations that don't sum to 100, on both Azure and AWS:&lt;/SPAN&gt;&lt;/P&gt;
&lt;TABLE class="doc-editor-table"&gt;&lt;COLGROUP&gt;&lt;COL /&gt;&lt;COL /&gt;&lt;COL /&gt;&lt;/COLGROUP&gt;
&lt;TBODY&gt;
&lt;TR&gt;
&lt;TH class="doc-editor-table-cell doc-editor-table-cell-header"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Config (A / B)&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TH&gt;
&lt;TH class="doc-editor-table-cell doc-editor-table-cell-header"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Sum&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TH&gt;
&lt;TH class="doc-editor-table-cell doc-editor-table-cell-header"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Result&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TH&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;75 / 25&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;100&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Accepted (valid baseline)&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;100 / 100&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;200&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;150 / 50&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;200&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;60 / 20&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;80&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;200 / 50&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;250&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;90 / 30&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;120&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;/TBODY&gt;
&lt;/TABLE&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;In my case, every non-100% configuration was rejected with a validation error on both clouds. So I wasn't able to reproduce what you're describing.&lt;/SPAN&gt;&lt;/P&gt;
&lt;H3 class="doc-editor-heading1"&gt;&lt;SPAN&gt;What the docs say&lt;/SPAN&gt;&lt;/H3&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;The docs are consistent with what I saw:&lt;/SPAN&gt;&lt;/P&gt;
&lt;UL class="doc-editor-ul"&gt;
&lt;LI class="doc-editor-listitem" value="1"&gt;&lt;SPAN&gt;The &lt;/SPAN&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/machine-learning/model-serving/glossary/" target="_blank"&gt;&lt;SPAN&gt;Model Serving concepts&lt;/SPAN&gt;&lt;/A&gt;&lt;SPAN&gt; page shows all examples with percentages summing to exactly 100.&lt;/SPAN&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="2"&gt;&lt;SPAN&gt;The &lt;/SPAN&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/machine-learning/model-serving/serve-multiple-models-to-serving-endpoint/" target="_blank"&gt;&lt;SPAN&gt;Serve multiple models&lt;/SPAN&gt;&lt;/A&gt;&lt;SPAN&gt; page demonstrates traffic splits of 50/50 and 60/40.&lt;/SPAN&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="3"&gt;&lt;SPAN&gt;The &lt;/SPAN&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/ai-gateway/configure-traffic-splitting/" target="_blank"&gt;&lt;SPAN&gt;AI Gateway traffic splitting&lt;/SPAN&gt;&lt;/A&gt;&lt;SPAN&gt; docs explicitly state: "Percentages must sum to 100%."&lt;/SPAN&gt;&lt;/LI&gt;
&lt;/UL&gt;
&lt;H3 class="doc-editor-heading1"&gt;&lt;SPAN&gt;A few thoughts on why yours might have been accepted&lt;/SPAN&gt;&lt;/H3&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;I don't doubt you saw it work, but here are some things worth checking:&lt;/SPAN&gt;&lt;/P&gt;
&lt;UL class="doc-editor-ul"&gt;
&lt;LI class="doc-editor-listitem" value="1"&gt;&lt;SPAN&gt;Check what the API actually persisted. Use &lt;/SPAN&gt;&lt;CODE spellcheck="false"&gt;&lt;SPAN class="doc-editor-code"&gt;GET /api/2.0/serving-endpoints/{name}&lt;/SPAN&gt;&lt;/CODE&gt;&lt;SPAN&gt; and look at the &lt;/SPAN&gt;&lt;CODE spellcheck="false"&gt;&lt;SPAN class="doc-editor-code"&gt;traffic_config&lt;/SPAN&gt;&lt;/CODE&gt;&lt;SPAN&gt; in the response. It's possible the UI normalised the values before saving them (so it might show 50/50 even though you entered 100/100).&lt;/SPAN&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="2"&gt;&lt;SPAN&gt;It could be a timing thing. If you tested this a while back, validation may have been tightened since then. The current API (as of July 2026) rejects it consistently for me.&lt;/SPAN&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="3"&gt;&lt;SPAN&gt;If it genuinely is still being accepted in your environment, that sounds like a bug worth reporting. I'd suggest filing a support ticket with the workspace ID, endpoint name, and the exact config you used. That way the engineering team can check whether there's a validation gap specific to your region or workspace.&lt;/SPAN&gt;&lt;/LI&gt;
&lt;/UL&gt;
&lt;H3 class="doc-editor-heading1"&gt;&lt;SPAN&gt;On the 50/50 routing question&lt;/SPAN&gt;&lt;/H3&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Your observation of a 50/50 split from 100/100 does make sense if the values were being treated as relative weights (100/(100+100) = 50% each). That's a common pattern in load balancers. But since the API is supposed to reject the config outright, the routing behaviour is somewhat academic unless you can still reproduce the acceptance.&lt;/SPAN&gt;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;If you do manage to reproduce it, an asymmetric test like 150/50 would be the way to confirm whether it's true proportional normalisation (which would give 75/25) or just a fallback to equal distribution (which would give 50/50).&lt;/SPAN&gt;&lt;/P&gt;
&lt;H3 class="doc-editor-heading1"&gt;&lt;SPAN&gt;References&lt;/SPAN&gt;&lt;/H3&gt;
&lt;UL class="doc-editor-ul"&gt;
&lt;LI class="doc-editor-listitem" value="1"&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/machine-learning/model-serving/glossary/" target="_blank"&gt;&lt;SPAN&gt;Model Serving concepts&lt;/SPAN&gt;&lt;/A&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="2"&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/machine-learning/model-serving/serve-multiple-models-to-serving-endpoint/" target="_blank"&gt;&lt;SPAN&gt;Serve multiple models to a model serving endpoint&lt;/SPAN&gt;&lt;/A&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="3"&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/ai-gateway/configure-traffic-splitting/" target="_blank"&gt;&lt;SPAN&gt;Configure traffic splitting and fallbacks (AI Gateway)&lt;/SPAN&gt;&lt;/A&gt;&lt;/LI&gt;
&lt;/UL&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Hope that helps!&lt;/SPAN&gt;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;&lt;BR /&gt;Thanks,&lt;/SPAN&gt;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;&lt;BR /&gt;Emma&lt;/SPAN&gt;&lt;/P&gt;</description>
    <pubDate>Fri, 31 Jul 2026 16:48:07 GMT</pubDate>
    <dc:creator>emma_s</dc:creator>
    <dc:date>2026-07-31T16:48:07Z</dc:date>
    <item>
      <title>Traffic split behavior when traffic_percentage values across served entities sum to more than 100%</title>
      <link>https://community.databricks.com/t5/machine-learning/traffic-split-behavior-when-traffic-percentage-values-across/m-p/164381#M4659</link>
      <description>&lt;P class=""&gt;Hi all,&lt;/P&gt;&lt;P class=""&gt;I'm configuring a Model Serving endpoint with two served entities and ran into some unexpected behavior while testing different traffic_config splits.&lt;/P&gt;&lt;P class=""&gt;When I set traffic_percentage to 100 for &lt;STRONG&gt;each&lt;/STRONG&gt; of the two served entities (so the total sums to 200%, not 100%), the configuration is accepted and saves successfully — both through the Serving UI and the REST API. I expected this to be rejected, since traffic percentages across routes should normally sum to 100.&lt;/P&gt;&lt;P class=""&gt;&lt;STRONG&gt;Config used:&lt;/STRONG&gt;&lt;/P&gt;&lt;DIV class=""&gt;&lt;DIV class=""&gt;&lt;DIV class=""&gt;&amp;nbsp;&lt;/DIV&gt;&lt;/DIV&gt;&lt;DIV class=""&gt;json&lt;/DIV&gt;&lt;DIV class=""&gt;&lt;PRE&gt;&lt;SPAN&gt;&lt;SPAN class=""&gt;"traffic_config"&lt;/SPAN&gt;&lt;SPAN class=""&gt;:&lt;/SPAN&gt; &lt;SPAN class=""&gt;{&lt;/SPAN&gt;
&lt;/SPAN&gt;&lt;SPAN&gt;  &lt;SPAN class=""&gt;"routes"&lt;/SPAN&gt;&lt;SPAN class=""&gt;:&lt;/SPAN&gt; &lt;SPAN class=""&gt;[&lt;/SPAN&gt;
&lt;/SPAN&gt;&lt;SPAN&gt;    &lt;SPAN class=""&gt;{&lt;/SPAN&gt; &lt;SPAN class=""&gt;"served_model_name"&lt;/SPAN&gt;&lt;SPAN class=""&gt;:&lt;/SPAN&gt; &lt;SPAN class=""&gt;"model-A"&lt;/SPAN&gt;&lt;SPAN class=""&gt;,&lt;/SPAN&gt; &lt;SPAN class=""&gt;"traffic_percentage"&lt;/SPAN&gt;&lt;SPAN class=""&gt;:&lt;/SPAN&gt; &lt;SPAN class=""&gt;100&lt;/SPAN&gt; &lt;SPAN class=""&gt;}&lt;/SPAN&gt;&lt;SPAN class=""&gt;,&lt;/SPAN&gt;
&lt;/SPAN&gt;&lt;SPAN&gt;    &lt;SPAN class=""&gt;{&lt;/SPAN&gt; &lt;SPAN class=""&gt;"served_model_name"&lt;/SPAN&gt;&lt;SPAN class=""&gt;:&lt;/SPAN&gt; &lt;SPAN class=""&gt;"model-B"&lt;/SPAN&gt;&lt;SPAN class=""&gt;,&lt;/SPAN&gt; &lt;SPAN class=""&gt;"traffic_percentage"&lt;/SPAN&gt;&lt;SPAN class=""&gt;:&lt;/SPAN&gt; &lt;SPAN class=""&gt;100&lt;/SPAN&gt; &lt;SPAN class=""&gt;}&lt;/SPAN&gt;
&lt;/SPAN&gt;&lt;SPAN&gt;  &lt;SPAN class=""&gt;]&lt;/SPAN&gt;
&lt;/SPAN&gt;&lt;SPAN&gt;&lt;SPAN class=""&gt;}&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/PRE&gt;&lt;/DIV&gt;&lt;/DIV&gt;&lt;P class=""&gt;&lt;STRONG&gt;What I'm trying to understand:&lt;/STRONG&gt;&lt;/P&gt;&lt;UL class=""&gt;&lt;LI&gt;Is there backend validation that should reject a traffic_config where the values don't sum to 100? If so, why does this particular config get accepted?&lt;/LI&gt;&lt;LI&gt;If it &lt;EM&gt;is&lt;/EM&gt; accepted, how does routing actually work here — are the values treated as relative weights and normalized (e.g., 100/100 effectively becomes 50/50), or is there some other fallback logic?&lt;/LI&gt;&lt;LI&gt;Is this documented anywhere, or is it more of an edge case / bug that hasn't been addressed?&lt;/LI&gt;&lt;/UL&gt;&lt;P class=""&gt;I ran a batch of test requests afterward and saw roughly a 50/50 split across the two entities, which lines up with the "weights get normalized" theory — but I'd rather get confirmation from someone who knows the internal routing logic than rely purely on my own testing.&lt;/P&gt;&lt;P class=""&gt;&lt;STRONG&gt;Environment:&lt;/STRONG&gt; AWS Databricks&amp;nbsp;&lt;/P&gt;</description>
      <pubDate>Wed, 29 Jul 2026 10:02:33 GMT</pubDate>
      <guid>https://community.databricks.com/t5/machine-learning/traffic-split-behavior-when-traffic-percentage-values-across/m-p/164381#M4659</guid>
      <dc:creator>MageshS</dc:creator>
      <dc:date>2026-07-29T10:02:33Z</dc:date>
    </item>
    <item>
      <title>Re: Traffic split behavior when traffic_percentage values across served entities sum to more than 10</title>
      <link>https://community.databricks.com/t5/machine-learning/traffic-split-behavior-when-traffic-percentage-values-across/m-p/164627#M4660</link>
      <description>&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Hi,&lt;/SPAN&gt;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&amp;nbsp;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Just been looking into this for you. All the docs I found suggested it would reject to I tried testing it myself. I tried setting &lt;/SPAN&gt;&lt;CODE spellcheck="false"&gt;&lt;SPAN class="doc-editor-code"&gt;traffic_config&lt;/SPAN&gt;&lt;/CODE&gt;&lt;SPAN&gt; with various percentage combinations that don't sum to 100, on both Azure and AWS:&lt;/SPAN&gt;&lt;/P&gt;
&lt;TABLE class="doc-editor-table"&gt;&lt;COLGROUP&gt;&lt;COL /&gt;&lt;COL /&gt;&lt;COL /&gt;&lt;/COLGROUP&gt;
&lt;TBODY&gt;
&lt;TR&gt;
&lt;TH class="doc-editor-table-cell doc-editor-table-cell-header"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Config (A / B)&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TH&gt;
&lt;TH class="doc-editor-table-cell doc-editor-table-cell-header"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Sum&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TH&gt;
&lt;TH class="doc-editor-table-cell doc-editor-table-cell-header"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Result&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TH&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;75 / 25&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;100&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Accepted (valid baseline)&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;100 / 100&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;200&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;150 / 50&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;200&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;60 / 20&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;80&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;200 / 50&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;250&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;TR&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;90 / 30&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;120&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;TD class="doc-editor-table-cell"&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Rejected&lt;/SPAN&gt;&lt;/P&gt;
&lt;/TD&gt;
&lt;/TR&gt;
&lt;/TBODY&gt;
&lt;/TABLE&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;In my case, every non-100% configuration was rejected with a validation error on both clouds. So I wasn't able to reproduce what you're describing.&lt;/SPAN&gt;&lt;/P&gt;
&lt;H3 class="doc-editor-heading1"&gt;&lt;SPAN&gt;What the docs say&lt;/SPAN&gt;&lt;/H3&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;The docs are consistent with what I saw:&lt;/SPAN&gt;&lt;/P&gt;
&lt;UL class="doc-editor-ul"&gt;
&lt;LI class="doc-editor-listitem" value="1"&gt;&lt;SPAN&gt;The &lt;/SPAN&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/machine-learning/model-serving/glossary/" target="_blank"&gt;&lt;SPAN&gt;Model Serving concepts&lt;/SPAN&gt;&lt;/A&gt;&lt;SPAN&gt; page shows all examples with percentages summing to exactly 100.&lt;/SPAN&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="2"&gt;&lt;SPAN&gt;The &lt;/SPAN&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/machine-learning/model-serving/serve-multiple-models-to-serving-endpoint/" target="_blank"&gt;&lt;SPAN&gt;Serve multiple models&lt;/SPAN&gt;&lt;/A&gt;&lt;SPAN&gt; page demonstrates traffic splits of 50/50 and 60/40.&lt;/SPAN&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="3"&gt;&lt;SPAN&gt;The &lt;/SPAN&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/ai-gateway/configure-traffic-splitting/" target="_blank"&gt;&lt;SPAN&gt;AI Gateway traffic splitting&lt;/SPAN&gt;&lt;/A&gt;&lt;SPAN&gt; docs explicitly state: "Percentages must sum to 100%."&lt;/SPAN&gt;&lt;/LI&gt;
&lt;/UL&gt;
&lt;H3 class="doc-editor-heading1"&gt;&lt;SPAN&gt;A few thoughts on why yours might have been accepted&lt;/SPAN&gt;&lt;/H3&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;I don't doubt you saw it work, but here are some things worth checking:&lt;/SPAN&gt;&lt;/P&gt;
&lt;UL class="doc-editor-ul"&gt;
&lt;LI class="doc-editor-listitem" value="1"&gt;&lt;SPAN&gt;Check what the API actually persisted. Use &lt;/SPAN&gt;&lt;CODE spellcheck="false"&gt;&lt;SPAN class="doc-editor-code"&gt;GET /api/2.0/serving-endpoints/{name}&lt;/SPAN&gt;&lt;/CODE&gt;&lt;SPAN&gt; and look at the &lt;/SPAN&gt;&lt;CODE spellcheck="false"&gt;&lt;SPAN class="doc-editor-code"&gt;traffic_config&lt;/SPAN&gt;&lt;/CODE&gt;&lt;SPAN&gt; in the response. It's possible the UI normalised the values before saving them (so it might show 50/50 even though you entered 100/100).&lt;/SPAN&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="2"&gt;&lt;SPAN&gt;It could be a timing thing. If you tested this a while back, validation may have been tightened since then. The current API (as of July 2026) rejects it consistently for me.&lt;/SPAN&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="3"&gt;&lt;SPAN&gt;If it genuinely is still being accepted in your environment, that sounds like a bug worth reporting. I'd suggest filing a support ticket with the workspace ID, endpoint name, and the exact config you used. That way the engineering team can check whether there's a validation gap specific to your region or workspace.&lt;/SPAN&gt;&lt;/LI&gt;
&lt;/UL&gt;
&lt;H3 class="doc-editor-heading1"&gt;&lt;SPAN&gt;On the 50/50 routing question&lt;/SPAN&gt;&lt;/H3&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Your observation of a 50/50 split from 100/100 does make sense if the values were being treated as relative weights (100/(100+100) = 50% each). That's a common pattern in load balancers. But since the API is supposed to reject the config outright, the routing behaviour is somewhat academic unless you can still reproduce the acceptance.&lt;/SPAN&gt;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;If you do manage to reproduce it, an asymmetric test like 150/50 would be the way to confirm whether it's true proportional normalisation (which would give 75/25) or just a fallback to equal distribution (which would give 50/50).&lt;/SPAN&gt;&lt;/P&gt;
&lt;H3 class="doc-editor-heading1"&gt;&lt;SPAN&gt;References&lt;/SPAN&gt;&lt;/H3&gt;
&lt;UL class="doc-editor-ul"&gt;
&lt;LI class="doc-editor-listitem" value="1"&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/machine-learning/model-serving/glossary/" target="_blank"&gt;&lt;SPAN&gt;Model Serving concepts&lt;/SPAN&gt;&lt;/A&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="2"&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/machine-learning/model-serving/serve-multiple-models-to-serving-endpoint/" target="_blank"&gt;&lt;SPAN&gt;Serve multiple models to a model serving endpoint&lt;/SPAN&gt;&lt;/A&gt;&lt;/LI&gt;
&lt;LI class="doc-editor-listitem" value="3"&gt;&lt;A class="doc-editor-link" href="https://docs.databricks.com/en/ai-gateway/configure-traffic-splitting/" target="_blank"&gt;&lt;SPAN&gt;Configure traffic splitting and fallbacks (AI Gateway)&lt;/SPAN&gt;&lt;/A&gt;&lt;/LI&gt;
&lt;/UL&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;Hope that helps!&lt;/SPAN&gt;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;&lt;BR /&gt;Thanks,&lt;/SPAN&gt;&lt;/P&gt;
&lt;P class="doc-editor-paragraph"&gt;&lt;SPAN&gt;&lt;BR /&gt;Emma&lt;/SPAN&gt;&lt;/P&gt;</description>
      <pubDate>Fri, 31 Jul 2026 16:48:07 GMT</pubDate>
      <guid>https://community.databricks.com/t5/machine-learning/traffic-split-behavior-when-traffic-percentage-values-across/m-p/164627#M4660</guid>
      <dc:creator>emma_s</dc:creator>
      <dc:date>2026-07-31T16:48:07Z</dc:date>
    </item>
  </channel>
</rss>

