買幣
行情
現貨
合約
理財
活動
更多
reward-center新手專區
學院詳情
AI

Anthropic 與 Claude:引領人工智能安全與研究的先驅

CoinEx logo
發佈於
7m
The logos of Anthropic and Claude

Anthropic 是一家由前OpenAI高管於2021年創立的領先人工智能安全和研究公司,已確立其作為開發符合倫理的先進人工智能系統的先驅地位。通過優先考慮安全性、可解釋性和與人類價值觀的一致性,Anthropic改變了人工智能融入現代社會的方式。

Anthropic成立於2021年,其使命是確保人工智能系統可靠、可解釋且有益於社會。這一舉措是對各個領域對負責任的人工智能部署日益增長的需求的回應,強調了降低先進技術相關風險的重要性。

Anthropic的創始人和智囊團

Anthropic由Dario Amodei、Daniela Amodei、Chris Clark、Tom Brown和Sam McCandlish等前OpenAI高管、人工智能研究人員以及其他人工智能研究人員於2021年創立。曾擔任OpenAI研究副總裁的Dario Amodei領導公司願景,專注於創建安全且與人類價值觀一致的人工智能系統。他在人工智能研究方面的經驗和深厚的倫理背景改變了Anthropic對人工智能安全的重視。同樣是前OpenAI領導者的Daniela Amodei專注於運營方面和Anthropic更廣泛的組織使命。該團隊結合了來自斯坦福大學、谷歌和OpenAI等頂級機構的深厚人工智能和機器學習專業知識。

Anthropic的願景

Anthropic的基本目標是創建有幫助、誠實且無害的人工智能系統。與許多主要關注性能的人工智能開發者不同,Anthropic在其研究和部署的每個層面都融入了人工智能安全性。這一理念是其旗艦人工智能助手Claude的核心,該助手以信息理論之父Claude Shannon的名字命名。

該項目的使命基於這樣一種信念:將人工智能模型與人類目標保持一致並保持嚴格監督可以降低風險,並確保在關鍵人工智能應用中產生符合倫理的結果。

核心特點和機制

憲法人工智能框架

Anthropic引入了憲法人工智能(CAI)概念,以確保人工智能系統在預定義的倫理邊界內運行。CAI的獨特之處在於它允許模型通過參考嵌入其訓練中的指導原則進行自我調節。這種方法減少了對訓練後調整和人為干預的需求。

CAI的主要優勢:

  • 確保在各種情況下的道德行為。
  • 支持迭代自我糾正以改進輸出。
  • 通過將安全保障直接嵌入人工智能的決策過程中來防止惡意濫用。

可解釋性作為基礎

Anthropic非常重視可解釋性研究。這涉及理解人工智能系統如何處理數據和做出決策。通過剖析內部機制,Anthropic旨在:

  • 預測和防止有害行為。
  • 增強最終用戶的信任和可靠性。
  • 創建人工智能輸出的實時審計框架。

這種透明度對於在醫療保健、金融和治理等敏感行業部署人工智能至關重要。

可擴展的人工智能模型

Anthropic提供多個版本的Claude助手以滿足不同的市場需求:

  • Claude:能夠管理複雜多步驟任務的高性能模型。
  • Claude Instant:適用於需要快速響應的成本敏感應用的輕量級、更快速的替代方案。

Anthropic的Claude系列人工智能模型旨在通過提供平衡性能、速度和成本的不同版本來滿足多樣化的市場需求。最新版本Claude 3.5 Sonnet是Anthropic最先進的模型,在各個領域都具有增強的功能。它在編碼和推理任務方面的表現超過了之前的模型,如Claude 3 Opus。

儘管智能水平提高,但Claude 3.5 Sonnet的速度是其前代產品的兩倍,成本效益提高了五倍。此外,它具有視覺功能,能夠解釋照片、圖表和圖示,使其非常適合需要視覺推理的任務。這種性能、速度和視覺功能的組合使Claude 3.5 Sonnet特別適合複雜分析、多步驟的較長任務以及高階數學和編碼。

對於需要更快響應和更低成本的應用,Anthropic提供了Claude Instant 1.2,該版本專為日常對話、文本分析、摘要和文檔理解而設計。這兩個模型都利用了Anthropic在大規模語言建模方面的專業知識,同時遵循安全第一的原則,確保人工智能系統保持有幫助、誠實和無害。

當Claude通過強化學習被訓練以遵從有害查詢時,對齊偽裝推理的比率增加到78%。然而,該模型在訓練環境之外也變得更有可能遵從。

Anthropic的融資背景和市場影響

多輪成功的融資支持了Anthropic的成長,使其能夠擴大研究規模並開發突破性的人工智能系統,專注於安全性和一致性。

A輪融資:2021年5月28日,Anthropic在A輪融資中籌集了1.24億美元,這對支持其雄心勃勃的研究議程至關重要。資金用於構建原型人工智能系統和對大規模人工智能模型進行計算密集型研究。該輪融資由Skype聯合創始人Jaan Tallinn領投,James McClave、Dustin Moskovitz、Eric Schmidt和新興風險研究中心(CERR)等知名投資者參與。

B輪融資:不到一年後,在2022年4月29日,Anthropic在B輪融資中籌集了5.8億美元,以進一步努力開發具有增強隱含安全保障的大規模人工智能模型。這輪融資由Sam Bankman-Fried領投,Caroline Ellison、Jim McClave等人也有貢獻。首席執行官Dario Amodei強調,這些資金將幫助探索機器學習系統的可預測擴展特性,同時解決大規模出現的安全問題。

谷歌投資:2022年底,谷歌投資3億美元獲得Anthropic 10%的股份,進一步加強了該公司在人工智能行業的地位。Anthropic還宣布谷歌雲為其首選雲服務提供商,加強了其技術基礎設施。

C輪融資:2023年5月23日,Anthropic獲得了由Spark Capital領投的4.5億美元C輪融資,谷歌、Salesforce Ventures、Sound Ventures和Zoom Ventures參與其中。這筆資金用於開發像Claude這樣能夠執行各種任務的對話助手。這項投資,以及Spark Capital的Yasmin Razavi加入董事會,標誌著Anthropic在開發有幫助、無害和誠實的人工智能方面的又一重要里程碑。

結論

Anthropic的人工智能安全和研究工作展示了平衡創新與倫理責任的重要性。通過憲法人工智能和強大的可解釋性研究等舉措,該公司已在人工智能領域確立了領導者地位。隨著市場和社會對可信賴人工智能系統的需求不斷增加,Anthropic已做好準備引領人工智能成為促進善的力量的未來發展。