AI 崗位 FDE 走紅:月薪 5 萬,海外年薪中位 134 萬
FDE(前線部署工程師)成為當下最火的 AI 崗位,國內大廠開出月薪三五萬,海外公開薪資中位數約 20 萬美元(約 134 萬元人民幣)。Anthropic 計劃投資 1 億美元到 2027 年底培訓 1 萬名 FDE,OpenAI 投 40 億美元成立部署公司,AWS 拿出 10 億美元組建 FDE 部門。從業者稱溝通需求佔工作時間七成以上,開發僅約三成,核心工作是把企業業務梳理成 Ontology 再開發應用。
FDE(前線部署工程師)成為當下最火的 AI 崗位,國內大廠開出月薪三五萬,海外公開薪資中位數約 20 萬美元(約 134 萬元人民幣)。Anthropic 計劃投資 1 億美元到 2027 年底培訓 1 萬名 FDE,OpenAI 投 40 億美元成立部署公司,AWS 拿出 10 億美元組建 FDE 部門。從業者稱溝通需求佔工作時間七成以上,開發僅約三成,核心工作是把企業業務梳理成 Ontology 再開發應用。
德國 Aleph Alpha 於 2026 年 10 月 3 日發布開源權重模型 Kolibri,Apache 2.0 許可,權重已上 Hugging Face。它是 78.1B 引數的 MoE 模型,每 token 僅啟用 3.46B,支援德語和英語,原生上下文 262,144 token,FP8 權重約 78 GB,知識截止 2026 年 6 月 18 日。
Google 開始取消 Gemini Flash 和 Pro 模型的免費使用,使用者需付費訂閱才能繼續使用。Flash-Lite 仍免費,但被指能力有限,Android 預設助手、AI Mode 與 AI Overview 均依賴該模型。社群反應強烈,不少人表示將轉向 ChatGPT、Claude 或 DeepSeek。
有使用者用 GPT-6 Astra 處理 10 萬字元以上素材生成 70 多頁文件時,任務跑 30 到 40 分鐘、消耗大量算力後,直接報 5 小時用量上限錯誤,一個字都沒輸出。使用者只能新開對話、縮小任務重試,反覆多次。按 ChatGPT 與 Gemini 估算,這類大規模執行每次 API 等效算力成本約 3 到 5 美元。
一名大學生在 Reddit 發帖,稱自己每天用 Claude Pro 和 Claude Code,但感覺只發揮了其能力的一小部分。他列舉了當前用法:用 Claude Code 無程式設計背景搭建 DuckDB 分析資料庫、連線 Gmail/Calendar/GitHub/Drive/Notion、用 Otter 錄音後讓 Claude 提取要點,同時抱怨反覆重述上下文、未用 Claude Projects、Cowork、定時任務和 Chrome 擴充套件。
Google 9 月發布新前沿模型 Gemini 4 Argon,擁有業界領先的 100 萬 token 輸出上限,面向編碼、網路安全防禦、金融研究與法律起草等重負載任務;目前僅通過 Fairwind Program 向受信任的網路安全防禦者開放,尚未放開給開發者、企業和消費者。
Pi 1.0 與 Pi Durable 同日發布並登上 Hacker News 首頁,Pi 已加入 Earendil。Pi 1.0 新增 Codemode(原生支援 MCP、Jev 和影像模型)、虛擬模型擴充套件、延遲工具載入、Anthropic 模型快取預熱、對話中途系統訊息、新 TUI 主題與預設全屏。Pi Durable 把 Pi 移植到 TypeScript 並外接全部有狀態元件:每步記錄為檢查點任務,程序失敗或重啟後 agent 與子 agent 自動恢復;
美國聯邦法官 Amit Mehta 駁回了 Chegg 和 Penske Media 對 Google AI 搜尋業務提起的反壟斷訴訟,認定 Google 的行為不違反反壟斷法。兩起訴訟均於 2025 年提起,Google 今年早些時候申請駁回。Chegg 稱 Google 非法抓取其教育內容、使 Gemini 得以復現內容並導致其流量下滑;Penske(旗下有 Rolling Stone、Variety)則稱被索引用於自然搜尋的網站內容同時被拿去生成 AI 回答且無法選擇退出。
Google 於 2026 年 10 月 1 日發布 Gemini 4 Argon,在 DeepSWE v1.1 長期軟體工程任務得 77.9%,高於 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%,並以 68.90% 登頂 Vals Index。定價為每百萬輸入 Token 2 美元、輸出 Token 10 美元,優惠期單題成本比 Astra 低約四成,輸出上限達百萬 Token。
Google DeepMind 發布 Gemini 4 Argon,首次支援最高 100 萬 token 輸出,但目前僅在 Fairwind 計劃下對政府使用者與受信任網路安全人員開放預覽,開發者、企業與消費者開放時間未定。標準價 $4/$20 每百萬輸入/輸出 token,首推五折 $2/$10,快取輸入 95% 折扣;19 項公開基準中拿下 13 項第一。100 萬輸出靠新 API 功能 Long Decode Continuation 實現,長回覆會暫停並跨呼叫續寫;
Google 於 2026 年 9 月 30 日發布新前沿模型 Gemini 4 Argon,先通過 Fairwind Program 向受信任的網路安全防禦方開放,之後再逐步提供給開發者、企業和消費者。它的輸出上限從 64K 提升到業界領先的 1M token,介紹價輸入每百萬 token 2 美元、輸出 10 美元,快取輸入享 95% 折扣。
OpenCode 發布 v1.18.33:Cloudflare AI Gateway 上的模型現在會遵循 provider 的回應與流超時,Gemini 的 thinking 預設值與 effort 選項也與各代模型支援的控制對齊。同版本還讓 MCP 瀏覽器啟動失敗在啟動器立即退出時被報告,並讓除錯配置輸出遮蔽憑據與敏感 header。
Google 於 9 月 24 日發布 Gemini 3.8 Live with Live Avatar,把近即時影片生成與語音結合,為企業的對話 AI 加上唇形同步、表情與流暢輪替的視覺形象,即日起在 Gemini Enterprise 提供。它支援非同步工具呼叫,可在對話不中斷的情況下後臺取數;原生語音到語音同步可跨 97 種語言切換,且不降低影片品質、不產生畫面漂移。
Google 推出 Gemini 3.8 Flash TTS 與 Gemini 3.8 Flash-Lite TTS 兩款文字轉語音模型,是 Gemini 迄今最有表現力的音訊生成模型,已在 Google AI Studio、Gemini API、Gemini Enterprise、Gemini Notebook 和 Google Vids 上線。
Google 在 2026 年 9 月 22 日的 Gemini API 更新中,將 Gemini 3.8 Flash TTS 與 Gemini 3.8 Flash-Lite TTS 兩款文字轉語音模型正式 GA,並新增 /v1beta/voices 端點。旗艦款 gemini-3.8-flash-tts 主打錄音棚級音質、細膩表演、地區口音與長時多輪穩定;
OpenRouter 上線 Batch API:把大量請求打包提交,由供應商在 24 小時視窗內自行選擇完成時間,換取通常為按 token 正常價 50%(有時更低)的折扣,現支援 70 多個模型。兩週 beta 期內 23 萬多個批次的中位完成時間是 7 分鐘,90% 在一小時內,太平洋時間 5 點到中午提交明顯更慢。支援 chat completions、responses、messages 和 embeddings,結果逐條獨立返回,輸入與結果保留 30 天;
Gemini API 在 2026 年 9 月 18 日的更新中把 Gemini 2.5 系列模型的存取權限限制為過去曾實際使用過它們的使用者。2.5 並未被棄用,仍會繼續通過 API 提供服務,直至另行通知。新專案官方建議改用最新的 3.5 Flash-Lite 或 3.8 Flash,官方稱這是為了給舊工作流和新應用都保留足夠容量。
Gemini API 於 9 月 17 日發布 antigravity-preview-09-2026,取代並棄用 antigravity-preview-05-2026,舊版將在 2026 年 10 月 5 日關停。若在遠端沙箱(environment: "remote")且只讀 output_text 或 model_output 步驟,只需更新 agent 字串,其他不變。
Gemini API 於 2026 年 9 月 15 日讓兩款音訊到音訊模型正式可用(GA):gemini-3.8-live 與 gemini-3.8-live-extended-thinking,均通過 Live API 服務即時語音應用。前者是低延遲語音代理與即時對話的預設選擇,無推理延遲,支援交錯推理、預設非同步函式呼叫和完整會話客戶端內容更新。後者是高推理模型,可在即時音訊互動中做後臺推理,適合需要更強後臺推理的場景。
Google 於 2026 年 9 月 3 日把下一代音樂生成模型 lyria-3.5 轉為正式可用(GA)。它支援文字與影像輸入,可生成整首歌曲,音樂連貫性與人聲自然度提升,並支援對時長和結構的細粒度控制,輸出 44.1 kHz 立體聲。開發者可在 Gemini API 的 Music generation 指南中檢視詳情與程式碼範例。
Awni Hannun 指出,蘋果每年向 Google 支付約十億美元使用 Gemini,而他認為可以免費獲得更好的模型,即 GLM 5.2 以及即將發布的 Kimi K3。這條推文只對比了付費與免費模型,未說明蘋果為何選擇 Gemini,也未給出效能資料或發布時間。