資料來源與方法
TinBoker 的摘要怎麼產生、看多看空怎麼判定、聲量與週報怎麼統計,以及這些數字的限制。
TinBoker 做的事情只有一件:把財經 Podcast 裡「誰、在哪一天、對哪一檔股票、說了什麼」記下來,再和公開的市場資料放在一起看。這一頁說明每個步驟怎麼做,以及哪些地方會出錯。
資料來源
節目
目前追蹤的節目列在所有節目。我們只處理節目公開發布的集數,並在每一頁標明節目名稱、集數與發布日期,附上回到原節目的連結。
股價與成交資料
臺股的日線、成交值與三大法人買賣超,來自臺灣證券交易所與證券櫃檯買賣中心的公開資料及 FinMind;美股報價來自授權的行情服務商。價格可能延遲,一律以交易所公告為準。
產業與題材分類
個股屬於哪個產業或題材,以櫃買中心「產業價值鏈資訊平台」與證交所產業分類為骨幹,再逐檔寫下納入的理由;每個題材頁都列出成分股與理由,可以逐一檢查。
摘要怎麼產生
逐字稿
每一集先由語音辨識模型轉成逐字稿。逐字稿長度明顯短於音檔的集數會被擋下,不會進入摘要。
結構化摘要
大型語言模型依逐字稿整理出重點、分段章節與時間點。摘要只能使用該集實際講到的內容,章節標題附的時間可以直接跳到節目的那一段對照。
摘要不是逐字引述
摘要是整理與改寫,不是節目的逐字內容,也不代表主持人或來賓的完整立場。要引用請回到原節目。
個股觀點與看多、看空
一則觀點是什麼
節目談到某檔個股並表達了看法時,我們記下一則觀點:日期、節目、個股、一句話的論點、提到的理由與風險,以及談的是短期、中期還是長期。只是順口提到公司名稱、沒有看法的不算。
看多、中立、看空
標籤反映的是「講者在那一集對這檔個股的態度」,由模型依逐字稿判定:明確看好為看多,明確看壞為看空,條件式、觀望或正反並陳為中立。這是對一段話的分類,不是 TinBoker 對這檔股票的評等。
同一集、同一檔只算一次
一集節目對同一檔個股不論提到幾次,都只計為一則觀點,所以「提及集數」不會因為某一集講得久而膨脹。
統計怎麼算
提及集數與多空分布
個股頁的「近 30 天 N 集提及:幾看多、幾中立、幾看空」,是把那 30 天內所有節目對該檔個股的觀點逐則相加。
聲量水位
把某檔個股近期被提及的熱度(越近的提及權重越高),放回它自己過去一年的分布裡,看落在第幾個百分位。拿自己跟自己比,是因為大型權值股天天有人講,絕對次數高不代表現在特別熱;資料還不滿約 60 個交易日的個股不顯示水位。
升溫與降溫
首頁「升溫最快」與週報的排序,看的是提及次數相較前一期的變化量,不是總次數;依總次數排名每週都是同一批大型股,沒有資訊。
其他節目怎麼看
單集頁會列出這一集談到的個股,在該集發布前 30 天內被幾個其他節目談到、多空如何分布,以及本集的態度和其他節目相同、相反或比較保留。其他節目的提及有六成以上偏向同一邊,才算有共同方向,否則記為看法不一。這是公開說法之間的比較,不涉及股價。
週報
每週一頁,統計該週所有節目談到的個股、題材與多空變化,見Podcast 週報。
限制與更正
會出錯的地方
語音辨識會聽錯公司名稱與數字,模型可能把反話或轉述別人的看法判成講者自己的立場,同名或簡稱相近的公司也可能配錯代號。我們持續抽查並修正,但不保證每一則都正確。
提及不是推薦
節目提到某檔股票,不代表節目或 TinBoker 建議買賣;被很多節目談到,也不代表之後會漲。本站所有統計都是對已發生之公開言論的整理,不預測價格。
最近七天的觀點
個股頁最近七天的逐則觀點為會員內容;七天以前的觀點與所有集數摘要對所有人開放。
更正
發現摘要、標籤或個股配對有誤,請來信 [email protected] 並附上頁面網址,我們確認後會更正。其他說明見免責聲明。