大模型時代
2020年代—現在 · 大型語言模型與代理系統
2020年以來,大型語言模型(LLM)如 GPT、Claude 等快速發展,AI Agent、MCP 等技術也陸續出現。這些進展擴大了 AI 在內容生成、程式設計與工具使用方面的應用範圍。
Claude Code、Agent 與 MCP 等技術,讓模型能在授權範圍內參與檔案編輯、命令執行與外部工具連線。它們的能力與風險取決於模型、宿主環境、權限設定及具體版本。
這一時期的代表性特徵包括模型規模擴大、多模態輸入輸出、代理式工作流程,以及連接 AI 與外部系統的標準協定。相關能力仍在快速變動,應以可驗證的產品文件與研究資料為準。
重要里程碑
GPT-3 發布
OpenAI 發布了 GPT-3,這是一個擁有1750億參數的大型語言模型。GPT-3 展示了令人驚訝的語言生成能力,能夠進行對話、寫作、程式設計等複雜任務,引發了對通用人工智慧可能性的廣泛討論。
OpenAI
Codex 與 GitHub Copilot
OpenAI 發布了 Codex,這是一個能夠理解和生成程式碼的 AI 模型。基於 Codex 的 GitHub Copilot 成為第一個大規模使用的 AI 程式設計助手,標誌著 AI 輔助開發時代的到來。
OpenAI Codex
ChatGPT 發布
2022年11月,OpenAI 發布了 ChatGPT,這是第一個面向大眾市場的生成式 AI 對話助手。ChatGPT 在兩個月內突破1億使用者,成為歷史上增長最快的消費產品,徹底改變了人們對 AI 的認知。
OpenAI ChatGPT
Stable Diffusion 開源
Stability AI 發布了 Stable Diffusion,這是一個開源的圖像生成模型。開源社群的活躍使得圖像生成技術迅速普及。
Stability AI
LLaMA 開源
Meta 發布了 LLaMA(Large Language Model Meta AI),這是一個採用非商業研究許可的大語言模型。LLaMA 的參數規模相對較小但性能優秀,推動了開源大模型的發展。
Meta
Gemini 1.5 與長上下文
2024年2月,Google 發布採用混合專家架構的 Gemini 1.5,並在研究預覽中提供最長 100 萬 token 的上下文視窗。
Google DeepMind
Claude 3 系列
Anthropic 發布了 Claude 3 系列,包括 Opus、Sonnet 和 Haiku 三個版本。Claude 3 Opus 在包括 MMLU 和 GPQA 在內的多個基準上與 GPT-4 表現相當,在其他一些基準上略遜於 GPT-4。
Anthropic
Llama 3 開源
Meta 發布了 Llama 3 系列開放權重模型,包括80億和700億引數版本。後來的 Llama 3.1 405B 是首個在常見基準上與前沿閉源模型相匹配的開放權重模型。
Meta
Claude 電腦操作公開測試
2024年10月,Anthropic 為升級版 Claude 3.5 Sonnet 推出電腦操作公開測試。開發者可以讓 Claude 查看螢幕、移動游標、點擊和輸入。
Anthropic Claude
智能體生態成熟
到2025年,AI 智能體從研究演示走向生產工具。程式設計智能體、瀏覽器智能體、多步任務智能體成為標準產品,OpenAI、Anthropic、Google 以及開源專案均推出了能力成熟的系統。
AI 行業
DeepSeek R1 發布
中國 AI 實驗室 DeepSeek 發布了 R1——一個效能可與 OpenAI o1 比肩的開源推理模型。這次發布證明,前沿能力可以在美國 AI 體系之外實現,引發了全球對 AI 競爭格局的重新評估。
DeepSeek
Stargate 計劃啟動
OpenAI、Oracle、SoftBank 與阿聯酋 MGX 聯合宣布投入 5000 億美元在美國建設 AI 基礎設施。該項目計劃在未來四年內建設多座大型資料中心,是 AI 史上規模最大的私營部門投資。
OpenAI / Oracle / SoftBank
Claude 3.7 Sonnet 發布
Anthropic 發布 Claude 3.7 Sonnet——這是首個支援「混合推理」的模型,使用者可在同一個模型中切換即時回答與深度思考兩種模式。Claude 3.7 標誌著 AI 推理產品形態開始整合。
Anthropic
Anthropic 完成 35 億美元融資
Anthropic 在2025年3月宣布完成 35 億美元融資,估值達 615 億美元。這輪融資使 Anthropic 成為全球估值最高的 AI 創初公司之一,反映了 AI 行業的資本進一步集中。
Anthropic
Llama 4 Scout 與 Maverick 發布
Meta 發布原生多模態的開放權重模型 Scout 與 Maverick,並預覽仍在訓練的教師模型 Behemoth;Behemoth 當時並未發布。
Meta
Claude 4 發布
Anthropic 發布 Claude 4 系列模型(Opus 4 與 Sonnet 4),引入了「擴展思考」(Extended Thinking)能力,在程式設計、推理與長任務上大幅提升。Claude 4 鞏固了 Anthropic 在企業 AI 市場的地位。
Anthropic
歐盟 AI 法案 GPAI 義務開始適用
2025年8月2日,《歐盟人工智慧法案》中針對通用人工智慧模型的治理規則與義務開始適用。其他條款依不同時間表分階段適用,不能把該日期籠統稱為「全面執法啟動」。
歐盟 AI 辦公室
OpenAI 完成資本重組
OpenAI 完成公司資本重組。營利業務轉為公益公司,名為 OpenAI Group PBC;非營利的 OpenAI Foundation 繼續控制該業務,兩者使命一致。OpenAI 表示,此次重組是在與加州和德拉瓦州總檢察長辦公室歷時近一年的溝通之後完成的。
OpenAI
Nature 發表 Co-Scientist 多智能體系統
Nature 發表了 Co-Scientist,一套基於 Gemini 的多智能體系統,能夠提出可供實驗驗證的新研究假設。論文報告了三個生物醫學場景下的驗證:藥物重新定位、新標靶發現,以及抗微生物抗藥性機制的解釋。作者將其定位為研究者的助手而非替代者。這使它成為經同儕審查的證據,說明 AI 已參與假設生成,而不只是資料分析。
科學界
Meta 開始拆分 Manus 收購整合
據2026年6月11日的報導,Meta 開始解除與 AI 智能體公司 Manus 的收購整合,停止雙方資料共享並拆分營運。報導將此舉與中國監管要求連結;交易後續的法律與營運狀態仍應以最新披露為準。
Meta / Manus
Claude Fable 5 與 Mythos 5 暫停後恢復提供
Anthropic 於2026年6月9日發布面向一般使用者、帶安全防護的 Fable 5,並向經審核的 Project Glasswing 夥伴提供限制較少的 Mythos 5。6月12日美國出口管制要求限制外國人士存取;因無法即時核驗國籍,Anthropic 暫停兩款模型的全球服務。管制於6月30日解除,Fable 5 於7月1日恢復全球提供,Mythos 5 則先向獲准的美國機構恢復。
Anthropic
OpenAI 遭美國州檢察長聯合調查
2026年6月13日,由紐約州檢察長牽頭的美國多州檢察長聯盟對 OpenAI 發起調查,並向其發出傳票。傳票要求提供與廣告投放、用戶參與度與留存、模型諂媚傾向、消費者與健康資料處理、以及對未成年人和老年人保護相關的文件。OpenAI 表示將配合各州檢察長的工作,並強調 ChatGPT 已為未成年人建構更嚴格的保護機制。這是美國州級執法機構首次針對頭部 AI 公司發起的系統性調查。
美國州檢察長聯盟
GPT-5.6 應政府要求先行有限預覽
2026年6月26日,OpenAI 應美國政府要求向少數可信合作夥伴開放 GPT-5.6 Sol、Terra 與 Luna 的有限預覽;7月9日,GPT-5.6 系列轉為全面可用。OpenAI 表示這種受限流程不應成為長期預設方式。
OpenAI
三星與 SK 海力士公布大規模多年期記憶體投資計畫
2026年6月29日,三星與 SK 海力士公布合計 800 兆韓圜的多年期半導體投資計畫,涉及韓國西南部的四座記憶體晶圓廠。美元換算會隨匯率變動,專案範圍、核准與執行進度仍需持續核驗。
三星 / SK 海力士
Gemini Spark 桌面代理助手上線 Mac
Google 全天候代理助手 Gemini Spark 正式登陸 macOS,支援即時追蹤與更多應用接入。Gemini Spark 可在使用者數位生活的多個面向提供持續代理服務,標誌著 Google 將代理 AI 推向消費者桌面端。
Google DeepMind
Moonshot 發布 Kimi K3 開放權重
2026年7月,Moonshot AI 在 Hugging Face 發布了 Kimi K3 的開放權重。模型卡記載總參數 2.8 兆、啟用參數 1040 億,脈絡窗口 1,048,576 個 token,授權條款為 Kimi K3 License。這是迄今公開可下載的最大語言模型,也顯示亞洲實驗室已進入開放權重發布的前沿。
Moonshot AI
Cloudflare 將 AI 爬蟲按用途分類管理
2026年7月1日,Cloudflare 宣布按 Search、Agent 與 Training 三類用途管理 AI 流量。自9月15日起,新加入 Cloudflare 的網域將在含廣告頁面預設阻擋 Training 與 Agent 類爬蟲,同時預設允許 Search 類爬蟲;網站擁有者可調整設定,多用途爬蟲依最嚴格的適用規則處理。
Cloudflare
微軟成立 25 億美元 AI 部署公司
2026年7月2日,微軟宣布成立新事業部「Microsoft Frontier Company」,專注企業 AI 部署。該項目將獲得微軟 25 億美元投資,並由 6000 名產業與工程專家組成。這是繼 Amazon、OpenAI 之後,又一主要廠商成立專門 AI 部署組織。
Microsoft
歐盟 AI 法案全面適用
2026年8月2日,歐盟 AI 法案進入全面適用階段,AI 辦公室與成員國主管機關開始承擔實施、監督與執法職責。同一次修訂推遲了負擔最重的高風險義務:附件三所列獨立系統自2027年12月2日適用,嵌入受監管產品的 AI 自2028年8月2日適用。禁止性條款自2025年2月2日起已經適用,通用模型義務自2025年8月2日起適用。
OECD / G7
Agent 進入企業產品交付
2026年上半年,Agent 能力從展示走向企業產品交付:程式設計、客服與辦公自動化 Agent 成為有文件記載的功能,工具呼叫與多 Agent 協作的基礎設施也隨之成熟。但採用程度究竟到了哪一步並無定論。各家調查對「什麼算一個 Agent」口徑不一,得出的投產比例差異很大,因此本條只記錄方向,不給出水平。
AI 行業
開放權重模型達到前沿規模
2026年上半年,DeepSeek、阿里 Qwen、Moonshot、智譜與 Meta 的開放權重發布達到了此前只見於閉源系統的規模,權重與模型卡可直接下載,而非僅有描述。它們是否已經追平閉源前沿,取決於採用哪一套基準指數以及如何加權,因此本條只記錄發布了什麼、以何種授權發布,不給出排名。
DeepSeek / Meta / 阿里
重要人物
山姆·奧特曼
OpenAI 執行長
奧特曼領導 OpenAI 推動了大語言模型的發展。ChatGPT 的發布讓他成為 AI 時代最具影響力的人物之一。他正在推動通用人工智慧(AGI)的發展,同時也在思考 AI 對社會的影響。
達里奧·阿莫代伊
Anthropic 執行長
阿莫代伊曾是 OpenAI 的研究副總裁,後來創立了 Anthropic。他強調 AI 安全性和有益性,Claude 的設計理念體現了這一價值觀——AI 應該是有用、無害、誠實的。
馬克·扎克伯格
Meta 執行長
扎克伯格決定開源 LLaMA 模型,推動了 AI 技術的民主化。他認為開源有利於 AI 的安全和發展,這一決策對 AI 生態系統產生了深遠影響。
伊利亞·蘇茨凱弗
OpenAI 共同創辦人、Safe Superintelligence Inc. 創辦人
蘇茨凱弗共同創辦了 OpenAI 並擔任首席科學家。他領導了 GPT-4 時代的模型團隊,是2023年後規模化範式的主要架構師。2024年他創立了 Safe Superintelligence Inc.——一家專注於安全超級智慧的實驗室。
戴密斯·哈薩比斯
DeepMind 共同創辦人兼執行長、2024年諾貝爾化學獎得主
哈薩比斯共同創辦 DeepMind,並率領團隊在 AlphaGo、AlphaFold 及前沿 AI 研究上取得突破。2024年,他因 AlphaFold 在蛋白質結構預測上的貢獻與他人共同獲得諾貝爾化學獎。他持續主張,AI 最深的貢獻將是在科學發現上。
艾蜜莉·本德
計算語言學家
本德是華盛頓大學語言學教授,也是2021年 FAccT 會議論文《On the Dangers of Stochastic Parrots》的第一作者。該文提出語言模型只是把語言形式的序列縫合起來,並不指向意義,同時指出不斷做大模型在環境、資料與問責上的代價。它至今仍是這個時代被引用最多的批評性論述,也是對能力敘事的持續制衡。
梁文鋒
DeepSeek 創辦人
梁文鋒畢業於浙江大學,早年將機器學習方法用於量化投資,並於2015年創辦對沖基金幻方量化。那裡建起的算力基礎設施後來支撐了他在2023年創辦的 DeepSeek。2025年以 MIT 授權發布的 R1,是首個展現前沿級推理能力的開放權重系統,改變了人們對西方頭部公司之外的實驗室能夠發布什麼的預設。
經典語錄
我們現在有信心知道如何按照傳統理解的方式構建通用人工智慧。
我認為在五年內,它很可能能夠比我們推理得更好。
我相信開源對於一個積極的人工智慧未來是必要的。
我認為它可能在2026年就到來,儘管也有可能需要更長的時間。
這些 AI 模型最為突出的能力可能帶來嚴重乃至災難性的危害,無論這種危害是蓄意造成還是無意造成。