基礎對話與多模態輸入
核心問題:除了打字聊天,Gemini 應用程式還能接收什麼?教學上該怎麼用多模態輸入?
Gemini 應用程式(gemini.google.com)是生態系的日常入口。它的教學價值來自三個能力的組合:多模態輸入(拍照上傳學生作業、丟 PDF、貼網址)、即時生成(草稿、改寫、翻譯、出題),以及 Workspace 連結(直接查詢自己的 Gmail、Drive、Calendar)。搭配 Deep Research 可以做較深的資料調查,產出還能一鍵轉入 Canvas 變成互動內容。本章聚焦「把它用成備課前處理器」的實戰模式。
學習成果:能靈活使用圖片、檔案、Workspace 資料作為對話輸入,完成備課素材的快速前處理。
核心概念
多模態輸入
支援上傳圖片、PDF、簡報、音訊。教學高頻用法:拍學生手寫作業請它整理常見錯誤、上傳課文 PDF 抽取生詞與語法點、丟講義照片轉成文字大綱。
Workspace 連結(Connected Apps)
開啟後可以直接問「上週家長會相關的信件重點」「找出我 Drive 裡關於課程計畫的文件並摘要」。學校帳號需要管理員啟用;個人帳號需開啟 Gmail 智慧功能。
Deep Research
針對需要多來源調查的主題(如「台灣國中 AI 素養教學的現有框架」),Deep Research 會自動搜尋、閱讀、整理成報告,且可上傳自己的檔案作為研究來源之一。產出的報告可轉入 Canvas 做成互動內容。
Canvas
對話旁的協作畫布:文件與程式碼可以在裡面持續編修,不會被對話沖走。可以直接生成互動測驗、小遊戲、網頁原型並分享。適合「一份內容要反覆修」與「想要互動成品」兩種情境。
Nano Banana 2 圖像生成
Gemini 內建的圖像生成與編輯模型:輸入文字描述(或上傳一張圖再要求修改)即可產出教學圖卡、情境示意圖、角色設計。適合「教材需要視覺化,但找不到合適的真實圖片」的情境——例如歷史場景示意、抽象概念圖解、寓言故事插畫。
備課前處理的三段式用法
來自華語文教學講座驗證的模式,適用所有科目:
- 找素材:瀏覽時遇到適合的文章,用 Gemini(或 Chrome 側欄)判斷難度與可教點
- 改素材:抽生詞、標語法點/概念點、調整難度、產出理解問題
- 轉任務:把整理結果變成字卡、測驗、討論題——或匯入 NotebookLM 長期累積
圖像輸入的教學妙用
多模態最被低估的是「拍照即輸入」:
- 學生作業拍照 → 「整理這批作業最常見的三類錯誤,各給一個教學建議」
- 板書拍照 → 「把這面板書整理成課堂筆記大綱」
- 教科書頁面拍照 → 「依這頁內容出三題不同認知層次的問題」
- 注意:上傳學生作業前先遮蔽姓名座號(見安全與政策章)
生成圖像 vs. 使用真實素材:怎麼選
「拍照上傳」是把真實世界的東西讀進來,「生成圖像」是請 AI 憑空畫一張——兩者用途不同,判斷準則:
- 教材需要「真實存在的東西」(這位作者、這張古蹟照片)→ 用真實素材,不要生成,避免以假亂真
- 教材需要「不存在或難以取得的畫面」(歷史場景想像、抽象概念圖解、寓言角色)→ 適合用 Nano Banana 2 生成
- 生成的圖像可能重現訓練資料裡的刻板印象(性別、職業、族群),發給學生前自己先檢查一次
- 凡是生成圖像用於教材或發布,標注「AI 生成示意圖」,讓學生清楚知道這不是史實照片或真實影像
操作步驟
- 1
確認帳號資格
個人帳號需年滿 13 歲;學校帳號依管理員設定開放(教育核心服務通常對全年齡開放),詳見安全與政策章。
- 2
開啟 Gemini
前往 gemini.google.com,確認右上角是你要使用的帳號(學校帳號功能由管理員控制)。
- 3
上傳素材
點擊輸入框的「+」上傳圖片或檔案,或直接貼上網址、長文字。
- 4
套五欄位公式提問
角色×任務×輸入×輸出×限制(見提示詞設計章)。
- 5
追問精修
對輸出不滿意的部分具體指出,例如「第 3 題太難,改成七年級程度」。
- 6
決定去向
一次性使用就複製帶走;會重複用就存成 Gem 或匯入 NotebookLM。
常見誤解
誤解:要先把圖片或 PDF 自己轉成文字,AI 才讀得懂。
實際:Gemini 原生多模態,直接上傳即可。先自己轉文字反而丟失版面與圖表資訊。