店裡忙起來,最花時間的往往不是打一段字,而是看完客人的需求、找齊活動規則,再把事情交代清楚。這次 GPT-6.1 Sol 更新,值得注意的就是:AI 更有機會把複雜工作做完整,也減少回答裡的事實錯誤。
OpenAI 在 9 月 29 日的官方公告介紹新版 Sol;NEXT X 隨即跟進,在台灣時間 9 月 30 日完成指定 AI 服務的模型接入。對店家來說,重點是新能力能逐步走進原本使用的工作流程,不必每次看到新模型,就重新摸索一套工具。
新版強在哪?三個數字看懂改變
第一,多個步驟比較能接著做。AutomationBench 測的是 AI 能不能正確完成一整串商業工作。GPT-6.1 Sol 在相同的中等推理設定下,比上一代 GPT-6 Sol 高 4.8 個百分點。可以把它想成:不只會寫活動文案,也更有能力依序理解條件、整理資料、完成交辦步驟。
第二,操作電腦軟體的表現更好。OSWorld 2.0 測的是跨軟體、需要多次操作的工作。在官方離線題組、最高推理設定下,新版比 GPT-6 Sol 高 7 個百分點。這反映模型處理操作流程的進步,但不代表店家的預約系統已能交給它全自動操作。
第三,困難題目的事實錯誤更少。在低推理設定下,回答含有事實錯誤的比例,從 11.4% 降到 7.7%,相對減少約 32%。題目特別挑自曾被使用者指出錯誤的困難對話,因此不能解讀成日常所有回答的錯誤率。
以上都是 OpenAI 官方測試,並非 NEXT X 的沙龍店務實測,也不是店內效率或營收提升保證。它們提供的訊號很清楚:新版更值得拿來處理需要連貫理解、仔細核對的工作。
對沙龍有什麼用?少漏條件,比多寫幾句更重要
例如把一份已確認的染護活動規則,整理成客人看得懂的說明與員工交接摘要;或面對客人的一長串問題,先找出真正要問的事情,再草擬回覆。這些是適合評估新版能力的店務情境,不是本次宣布全部上線的功能清單。
但如果活動資訊在一個檔案、客人訊息在另一個視窗,員工仍要反覆複製貼上,再好的模型也不能自動補齊缺少的資料。店家真正需要的,是讓「收到需求、取得正確資料、整理回覆、由人確認」接得順。
NEXT X 解決方案:第一時間接入,讓升級跟著工作走
新模型出了,自己的系統到底跟上了沒?NEXT X 在 9 月 30 日已完成指定 AI 服務的 GPT-6.1 Sol 接入,公開模型目錄也記錄了相容性測試與支援範圍。你可以在同一個入口看清模型擅長什麼、適用哪些產品,以及目前開放到哪一步。
「已接入」代表系統已加入這個模型;「全面開放」還需要各產品完成自己的測試。目前 GPT-6.1 Sol 與 GPT-6 Luna 在公開目錄仍屬 Preview,也就是還在測試、尚未全面開放;GPT-5.6 Terra 則已正式支援 Atlax 的指定流程。三款不是這次同一天推出的新版。
今天想知道這次更新跟自己的店有什麼關係,可以先看你使用的產品是否列在支援範圍,再挑一件經常要重抄、重講的工作,整理好正確資料與最後確認的人。先把這件事說清楚,才能讓下一次 AI 升級真正幫上忙。