按住按鈕,含糊地講你在猶豫什麼,有菜單就拍一張。WDYT 幫你整理出真正的問題和選項,先給你看、讓你改,確認之後才給答案——而且附上它有多確定的數字。
iPhone · 即將上架 App Store按住或點一下麥克風說話。英文走 Apple 辨識,中文用手機上跑的 SenseVoice。語音永遠不會離開裝置。
生成模型讀你的話和照片,寫出問題、選項、還有「它看到了什麼」——你從頭到尾不用填表。
沒看過之前什麼都不會決定。改問題、刪選項、加它漏掉的、修正它從照片讀錯的。然後才確認。
答案來自 TypeSafe 的 Jev——一個回傳帶校準機率的選擇、而不是一段文字的模型,半秒內完成。
五五波就說五五波。你什麼線索都沒給,它也會說,並讓你補一句再問一次。
兩個純文字檔——identity.md 和 soul.md——記你是誰、你怎麼做決定。預設關閉;開啟後每次回答完會修訂,你隨時可以改。
理解 → 確認 → 決定。決策模型只在你確認之後才被呼叫。
「我今天吃什麼……」加一張菜單照片。最多三張,送出前先在手機上縮圖。
一句話的問題、每個選項一行說明、還有從照片整理出的「我看到的」。有錯就改。這時什麼都還沒決定。
一個選擇、每個選項的機率、一個信心數字、一句為什麼。漏了什麼就補一句再問。
因為是兩件事。Gemini(Google)負責讀你的話和照片、寫出問題——要一把 Google AI Studio 的 Gemini 金鑰。Jev(TypeSafe)負責做決定——透過 OpenRouter 呼叫,所以要一把 OpenRouter 金鑰。兩邊都是你自己帳戶按量計費,一題通常遠低於一美分。WDYT 看不到任何一把金鑰。
Jev 是 TypeSafe 的「System One」模型:它不產生文字,只回傳有型別的答案——從你的清單選一個、一個是/否的機率、或量表上的一個位置——並附校準過的機率,大約 100–500 毫秒。信心數字之所以有意義、答案之所以瞬間出來,就是因為它。Gemini 負責 Jev 做不到的那半:聽懂模糊的話、看照片。
看不到——Jev 只收文字。Gemini 會把它看到的全部寫下來(菜單每一項和價格、衣服長什麼樣),Jev 判斷的就是這段文字。這段文字在確認畫面就叫「我看到的」,你可以改。
介面可選 English、繁體中文、简体中文,跟手機語言無關。語音:英文用 Apple;中文用 SenseVoice,第一次要下載約 230 MB。這個模型和你手機上其他 tautiu.dev 的 App 共用,下載一次就好。
identity.md 是你是誰——飲食、預算、習慣。soul.md 是你怎麼做決定——在意什麼、避免什麼。每次提問都會一起送出,讓答案貼近你。可以自己寫,也可以開啟「允許自動更新關於我的資訊」讓 Gemini 每次回答完幫你修訂。預設關閉。
全部留在你手機上:金鑰在 Keychain、兩個檔案、歷史紀錄。唯二的網路連線是你自己發起的那兩次,從你的手機直接到 Google 和 OpenRouter,受它們各自的隱私政策規範。