1. 這一頁在講什麼
寵物食品成分與營養標示查詢 查的是農業部「寵物食品資料」開放資料集裡的申報內容。這一頁寫的是 本平台如何將那些原文讀成結構化欄位、如何判斷「讀得出多少」、如何與同類申報比較, 以及每一種數字的邊界在哪。
寫出來的目的只有一個:讓任何人皆可核對我們的判讀。 規則、門檻與版本都在下面,每一筆判讀也都標著算它的規則版本。
2. 資料從哪裡來
資料提供機關是農業部,資料集頁面在 https://data.gov.tw/dataset/93696, 依政府資料開放授權條款第 1 版再利用。 授權允許再利用,不代表機關背書本平台的判讀。
收錄的是申報筆數,不是市售品項數:同一款產品可能有多筆申報, 也會有申報之後沒有上市或已經停售的。所以這個工具回答得了「這一筆申報寫了什麼」, 回答不了「市面上有幾款產品」。
我們不修改官方原文。每一筆都保留抓取當下的原始快照, 畫面上「官方申報原文」該區就是它。
3. 不涵蓋什麼
本平台未收錄官方查核與檢驗紀錄。 未收錄不代表該產品沒有相關紀錄,也不代表它有。查核資訊請看農業部的 寵物食品查核專區。
這一點值得單獨講,因為「查不到」很容易被讀成「沒有異常」——而我們手上根本 沒有那個資料集。同理,本平台不提供價格、通路、評價或適口性資訊。
依個人資料保護,以【個人】名義申報的廠商名稱不顯示。
4. 本平台從原文讀出了什麼
官方的營養標示是一段自由文字,不是欄位。本平台用一支指定版本的解析器 (目前是 v3)從那段文字裡抽出 5 個營養素:粗蛋白、粗脂肪、水分、粗纖維、粗灰分。
抽出來的每一個值都會連同單位與限定詞一起存。 限定詞決定那個數字是什麼意思:
- 下限(以上、最低、最少、至少、高於、大於、多於、超過、不低於、不少於、不得低於、不得少於、>=、≥、≧、>、min)——保證最少有多少
- 上限(以下、最高、最多、低於、小於、少於、不超過、不高於、不多於、不得高於、不得多於、<=、≤、≦、<、max)——保證最多不超過多少
- 來源未註明——申報裡沒有寫。那個數字是保證值還是實測值,無從得知
最後一種不是少數。所以本平台不把未註明的值跟明確標了上下限的值 放在一起比較——那是在比較兩個定義不同的數值。
為什麼要指定唯一一支解析器:同一份資料用不同的解析器量,光是水分的可解析率 就相差近二十個百分點。差異來自解析器,不是資料。沒有指定版本之前, 任何百分比都不該被寫進文件或當成驗收條件——包括這一句刻意不寫出的 那幾個數字。
5. 可解析度分數如何計算
每一筆申報會得到一個 0–100 的分數與四段分級。 它量的是「這筆公開資料能不能被讀成結構化欄位」,不是食品的品質、 安全或營養。也不是農業部的結論。
- 大部分可解析(80 分以上)——營養、原料與適用對象大多能抽成結構化數值,跨欄位也對得起來。
- 多數可解析(70 分以上)——主要欄位讀得出來,有一部分數值缺少單位或上下限,比較時要留意。
- 部分可解析(50 分以上)——有一部分欄位本平台抽不出可比較的數值,只能看原文。
- 少數可解析(0 分以上)——多數欄位本平台抽不出可比較的數值,建議直接看下方的官方原始資料。
分數旁邊會獨立標出判讀信心(高/中/低/不適用),不會把信心 藏進總分裡。
有些情況直接不予評分,而不是扣幾分:認不出產品身分、來源欄位 互相衝突而判不出現行版本、解析結果低於最低門檻、適用寵物欄位讀不出物種。 不予評分與產品品質無關——它只表示我們讀不到足以評分的公開資料, 那時官方原文與來源連結照樣完整列出。
規則版本目前是 v2。每一筆判讀都標著算它的規則版本與 解析器版本,兩個是各自獨立的數字。
6. 同類比較如何分群
「與同類相比」比的是官方申報值之間的位置。要能比,兩筆資料的 基準必須一致,所以同一組(cohort)必須同時符合:
- 正規化後的適用寵物完全相同(犬貓通用自己一組,不併進犬用或貓用)
- 官方種類完全相同
- 申報格式相同(保證分析、營養標示等)
- 同一個營養素、同一個限定詞方向、同一個比較基準
一組至少要有 50 筆申報才會顯示位置; 不足就直接說「目前沒有足夠且基準一致的同類資料可比較」, 不會為了湊數而放寬分群。命中判讀閘門或人工審核中的那些整筆不進統計。
顯示的是樣本數與三個分位數(P25、中位數、P75),加上一句位置: 低於同類常見範圍、在同類常見範圍內、高於同類常見範圍。分位數用 線性插值(R-7,與 numpy 及 Excel 的預設一致)計算——分位數有九種 定義,說得出用哪一種才有辦法被核對。
界線是四分位而不是標準差(申報值的分布不是常態的):低於 P25、高於 P75, 中間算接近中位數。若整組的 P25、中位數與 P75 是同一個數字,就直接說 「這個位置分不出差別」——那時講「接近中位數」什麼都沒說。
統計是離線算好再整份發布的,不在每次查詢時重算;重算期間新舊 兩版不會混用。分群規則版本目前是 v2, 與解析器或規則版本對不上時,同類位置整段不顯示。
同類位置依農業部公開申報資料與本平台解析規則計算,只表示申報數值的位置,不代表食品品質、安全性或是否適合特定毛孩。
7. 乾物基準如何換算
乾濕型態不同的產品不能直接比原態百分比:一罐 78% 水的罐頭,它的蛋白質 看起來一定比乾糧低。扣除水分後的比例叫乾物基準:
乾物比例 = 100 − 水分
乾物基準值 = 原態申報值 ÷ 乾物比例 × 100顯示換算值時,本平台一定同時附上原始申報值、單位、水分值與 「本平台依申報值換算」這個主詞——少了主詞,換算出來的數字會被讀成官方也是 這樣申報的。沒有可用的水分值就不換算,不會拿一個猜的水分去補。
同一種型態的產品直接看申報值即可,乾物基準是跨型態比較才需要的。
8. 原料如何被解析
官方申報的原料是一整段文字。本平台先照分隔符切成一項一項, 再用一份固定的詞彙表把每一項對到一個原料家族(雞、鮭魚、玉米、 維生素…)。這份詞彙表是人工維護的,不是 AI 當場判斷——同一段 原文在任何時候都會得到同一個結果。
比對規則只有兩條:
- 最長的詞條贏。「玉米」勝過「米」、「魚油」勝過「魚」、 「大豆蛋白」勝過「蛋」、「乳酸菌」勝過「乳」
- 認不出來就是認不出來,不猜最接近的那一個。認不出的原文會 原樣列在「本平台未分類的原料」裡
第二條是刻意的。全庫有 77,221 個不同的原料寫法,前 200 個常見的 只涵蓋四成出現次數——長尾很長,而猜錯比不認得嚴重:少認的那一筆 你看得到也回報得了,多認的那一筆(把黃豆算成雞肉)永遠不會有人來說。
每一筆產品的解析信心看的是「這一款自己有幾成的原料被認出來」, 不是全庫的辨識率。所以只寫一項原料的凍乾雞胸不會因為「項目少」被降信心。 信心不足時,「配方一眼看懂」的分組整段不顯示,官方原文照樣列出。
從公開資料可以看出列了哪些原料,看不出各自用了多少。原料名稱本身不能證明 原料的品質、消化率或新鮮度。
9. 同類原料出現率
「雞來源出現在約 60% 的犬用凍乾食品申報中」講的是有多少同類產品在 公開申報裡列出了這項原料——不是含量,也不是品質。公開資料沒有各原料 的比例,所以這個數字只能回答「有沒有列出來」。
- 分群沿用與營養比較同一把鍵——一頁上不會有兩種「同類」
- 一組至少 50 筆才算
- 分母是本平台讀得懂原料的那些:讀不懂的算進去會讓每一項的 出現率一律偏低,而那個偏低看起來就像「這個原料比較少見」
- 照原料家族算,不照寫法——雞肉、雞肉粉、雞肝、雞油是同一種動物
- 四捨五入到 5%,並且最多顯示兩項
只講這一款自己列出來的原料。「同類有六成列出雞而這款沒有」是一句 正確但危險的話——它把「沒列出」講成缺點,而公開資料未看到不等於不含。
10. 你設定的條件如何判定
設定條件之後,每一款產品會逐條得到三種答案之一: 符合、不符合、無法確認。 「無法確認」是本平台讀不懂那一筆的原料欄,不是產品的問題。
條件分三類,處理方式完全不同:
- 適用寵物、生命階段、主食/零食是官方本來就有的欄位,走篩選 ——不符合的產品不會出現在結果裡,也不會出現「符合度 60%」這類數值
- 避開某項原料命中就是不符合,不會折算成分數。而且原料欄讀不懂 時一律排除:那時我們沒有立場說它不含那項原料
- 其餘(單一動物來源、指定來源、來源寫得具體)只有你主動選了才計分
畫面上的「已確認符合 2 / 3 項」,分母只算第三類。主詞是已確認—— 「無法確認」算在分母裡但不算進分子,寫成「符合 2 / 3」會被讀成另外那一項不符合。
結果清單底下的兩行計數也是分開的:出現了你要避開的原料與 原料資料不足、無法確認是兩件事,合成一個數字就是把後者講成前者。
判定依公開申報的原料文字。公開資料未看到某項原料,不等於產品不含; 這不是過敏或疾病的用藥建議。
11. 相近產品如何找
「和這款相近的產品」比的是五項營養申報數字(粗蛋白、粗脂肪、 水分、粗纖維、粗灰分),不是配方、不是品質、也不是適合度。
- 只在同一個分群裡找(同物種、同官方種類、同製程)
- 每一項都先用該分群自己的分布正規化,再算平均差距——否則相似度會實質上 只由蛋白與脂肪決定
- 共同可比至少四項才算候選。只比得了一兩項而剛好相同的配對, 說「營養數字一樣」是一句不成立的話
- 同款不同包裝整族排除,不會把同一款的另一個容量當成「相近產品」
- 大量產品數字完全相同時(實測最深一組 55 筆),不假裝那是排名 ——直接說出有幾筆、分布於幾個廠商,並且同分的那一群每個廠商最多一個代表
「五項營養數字一樣」只在五項都比得了時才會出現。只有四項可比時 寫的是「可比較的四項數字一樣,另有一項資料不足」——不講的話會被讀成兩款申報 得一模一樣。
不提供相似度百分比,也不做方向型推薦(脂肪較低、蛋白較高): 半數申報的限定詞是「以上」,「脂肪較低」的意思實際上是保證下限訂得比較低。 零食、潔牙骨、補助食品與特殊健康需求食品不端出自動推薦; 沒有推薦時只留一行出口,你仍然可以自己勾選產品比較。
12. 這些數字可以、不可以告訴你什麼
申報數字能支持的結論很少,能被誤讀成的結論很多。下表把兩邊分開寫。
| 欄位 | 可以說 | 不能據此說 |
|---|---|---|
| 粗蛋白 | 申報值相對同類的位置、限定詞是不是下限 | 蛋白質的來源品質、胺基酸完整性、消化吸收率,或適不適合特定疾病 |
| 粗脂肪 | 申報值相對同類的位置 | 一定比較肥、一定適合增重或減重;公開資料沒有熱量,不能替它推算 |
| 水分 | 它會影響原態百分比如何解讀;資料完整時可以換算成乾物基準 | 只因為水分較高就說比較補水或比較好 |
| 粗纖維 | 申報值相對同類的位置 | 腸胃、排便、飽足或減重的效果;粗纖維不等於完整的膳食纖維資訊 |
| 粗灰分 | 申報值相對同類的位置 | 礦物質比例、鈣磷平衡,或腎臟與泌尿相關的風險;來源沒有個別礦物的資料 |
這一段看的是官方申報寫了什麼、哪裡沒寫清楚,不代表食品品質、安全性或是否適合特定毛孩。
13. 我們刻意不做的判斷
下面這些說法不會被寫成本平台的規則,因為它們是民間流傳的判準, 而官方申報資料裡沒有任何欄位支持它們:
- 無穀一定比較好
- 肉排第一位一定比較好
- 副產品一定比較差
- 蛋白質越高越好
- 進口一定比較好
本平台也不對腎臟、泌尿、過敏、減重或處方情境做個別適用判斷, 不提供醫療或營養建議。毛孩的實際需求請諮詢獸醫師。
這一頁刻意不寫一般性的營養知識。要寫那種內容,必須引用可核對的 主管機關或獸醫營養專業組織來源並附查閱日期;沒有來源就寫,等於本平台自己 變成那個權威。
14. 版本、重算與更正
三個版本各自獨立,畫面上每一筆判讀都標得出自己算在哪一組上:
- 解析器 v3——決定「從原文抽出什麼」
- 判讀規則 v2——決定「抽出來之後如何判定」
- 分群規則 v2——決定「跟哪一群比」
官方資料更新後,本平台會重新抓取並重算;判讀落後於最新一版官方資料時, 那一筆會標出來。我們不改官方原文——判讀有誤時改的是規則, 然後整批重算,而規則版本會跟著變。
申報內容與實際包裝不符,改得動它的是主管機關,不是本平台——那要走上面第 2 節 的官方資料集與第 3 節的查核專區。
如果是本平台讀錯了(抽錯欄位、判讀與官方原文對不起來), 請寄信到 [email protected], 附上食品序號與有爭議的欄位。我們會比對當時的官方原文快照與規則版本; 錯的是規則就改規則、整批重算,而規則版本會跟著變。 本平台不會修改官方原文,也不要求你公開回覆才受理。