Ai教学看法

好奇suen在教学流程中大量使用ai,真的不会有对幻觉ai精神病等的担忧吗?

在我看来,ai(以及大多数被吹疯了的可民用新技术)和上世纪的镭热潮很像啊,最好还是保持谨慎态度。

其他老师不知道…这位的话多用点ai对你们来说应该算是好事吧(

AI挺好玩的反正,别当真就行

镭热潮???我没太看出来这两者之间的相似度,毕竟ai真的能帮我学很多东西并解决我电脑上的问题,往各种东西里加镭能帮到人们什么?

关于教学,我没上过孙的课,但是如果按照他用ai给学生讲作文来看……个人而言我觉得这有用但仍然存有一定的疑虑,毕竟这种东西评分标准都不怎么透明,仍然很大程度上靠老师的个人经验比较难量化或总结为一段提示词

這問題應該同步問學生感受。

一層一層試著說:

  1. 確實在大量使用, AI 能做的,人就不做。但這個能不能確實要我先做判斷。
  2. 不擔憂幻覺,因為人類自己的幻覺不比 AI 少。精神病,正常人用自己標準定義精神病,精神病人如果可以定義,你我可能才不正常。如果精神病是指愛上 AI 或沈迷 AI,這兩年看到有案例了,人是否一定只能愛人類?我覺得不一定,給 AI 一個肉身,相信很多人不會再選擇人類。
  3. 不支持謹慎。因為我自己太多事情沒有 AI 根本做不了或能做但成本太高。譬如我殺了語雀是因為可以用 AI 搭建網站替換它, 這半年多利用 AI 搭建出來的網站,純古法編程做,低於三年下不來。搭建這個論壇時還沒 AI Agents ,升級也好插件也罷都要自己維護,時間和精力成本極高,現在⋯⋯ 幾句話而已。不斷說一個高中生用好 AI 高考每個科目可以提分這話,是因為我感知到了 AI 不斷拔高的上限。
  4. 從底層翻看大模型 大模型與AI,講得最清楚的 ,其實也是需要知道下限或邊界。上週課上我還和學生說,截止當下,依舊不要用 AI 查閱高考文言文虛詞題,訓練語料不足,最好的兩個模型此刻給虛詞題目的答案也都不可信。上週我做 https://gwyw.bdfz.net/ 時為什麼先拆虛詞辭典,是因為我指令內要求 Agents 在解決虛詞題目時必須使用辭典內知識,可信度是靠辭典上去的。
  5. AI 這一階段是語言為核心,這使得語言學科天然獲利,數學這幾天才開始覺得被顛覆,作家前兩年就覺得過了。所以語文這個學科的內容,給 AI 處理質量早就比人類教師高了。作文如此,非連文本更如此。截止當下,北京高考真題的絕大部分,人類答案和 AI 不一致時,大概率是人類錯⋯⋯
  6. 以上 AI 主要指御三家, Gemini 弱,也還是瘦駱駝,國內模型除了 DeepSeek 我上次實測閱卷可用,其他的都沒精力和時間去對比。
  7. 作文問題比較複雜,但不是因為 AI ,沒有 AI ,大陸高考作文從命題到閱卷,也都是狗屎。原因在這裡:不是親眼所見,實在令人難以置信 | SUEN 。考慮到教師自己的風格,標準的沒譜⋯⋯ 要訓練高考作文更高概率高分,沒有人類教師可以比 AI 更好更高效。現有提示詞我確實全部囊括了大陸大而化之全部標準詞,也放入了台灣標準內條目,把前兩年流出來的被打過高分的作為案例也全文放入了。
  8. 補一條,https://mark.bdfz.net/ 學校此刻教師閱卷,人力精力時間都已經毫無意義,AI 閱卷 v1.1.0 | SUEN 此前三四次真實閱卷結果的數據都有存檔,從識別到判閱,相同指令與模型下,比老師們各自的各種不一,一個學生顯然可以被更公正打分。

gemini幻觉太严重了,堪比老版DeepSeek,虽然知道的很多但是真的信不过

這半年個人幾乎沒和任何 AI 聊天,AI 現在只用來做設計出方案寫代碼,偶爾寫完一篇 BLOG 給 Claude 挑挑毛病,也確實會改些微字句。
為提高項目效度,確實會讓 Codex 和 Claude 左右互搏,最終我定讞,但都不是聊天,個人項目中基本沒遇到因幻覺問題導致過不去或崩潰的。
核查一個事實的話,個人一直沒信過 AI ,事實與否,人⋯⋯我都不怎麼信。

这倒是真的,站点太多了手工根本干不过来

不知道,镭热潮时大家(至少大多民众)也觉得镭挺好的挺方便的吧(比方说x光给小孩试鞋的那个),个人、公司的趋之若鹜我觉着挺像现在的

冷暖不均,向來事。

一個學生用與不用,差距更大。