
剛剛大同護角膠 ,Claude Mythos干爆METR評測上限!指數(shù)進化已經(jīng)逼近AGI奇點。
就在今天,張趨勢圖刷屏全網(wǎng)。
的AI評測機構(gòu)METR驚恐地發(fā)現(xiàn),他們的「溫度計」要被Mythos撐爆了。
Claude Mythos Preview的能力,已經(jīng)捅破了人類評測框架的天花板,進入了「失真區(qū)」!
OpenAI對齊團隊前成員Leopold Aschenbrenner曾預(yù)測2027年是AGI的奇點,但現(xiàn)在的新數(shù)據(jù)顯示:Mythos的表現(xiàn)已經(jīng)略于2027情景的趨勢線。
「外星文明」,已經(jīng)強行著陸,陰影已覆蓋整片天空。評測界的大地震 當「滿分」不再有意義
在METR新的測試中,他們試圖衡量AI完成長周期復(fù)雜任務(wù)的能力(Time Horizons)。
METR設(shè)置了個名為「50成功率時間線」的指標——即模型有50的概率,成功立完成項人類需要耗費X小時才能完成的任務(wù)。
此前,此前的模型,成績是幾十分鐘或幾個小時。
但當Claude Mythos站上考場時,數(shù)據(jù)直接爆表了:它在人類需要16個小時才能完成的其復(fù)雜的長線任務(wù)上,輕松達到了50的成功率!
你可能會問:那測試32小時、64小時的任務(wù)呢?
METR給出的答案讓人驚恐:「我們測不了了。」
在METR精心構(gòu)建的228個測試任務(wù)中,只有區(qū)區(qū)5個任務(wù)是被歸類為「16小時及以上」的。這意味著什么?
這意味著人類現(xiàn)有的、引以為傲的難題庫,已經(jīng)被AI掏空了。
就像用刻度只有1米的卷尺去量棟摩天大樓,除了知道它「爆表」了,我們對其真實的度所知。
「外星文明」已降臨?在16小時以上的區(qū)間,METR根本沒有足夠的樣本來對Mythos進行準確的定量比較。
METR坦言,在這個閾值之上,數(shù)據(jù)的測變得「不穩(wěn)定且失去意義」。
這是人類歷史上為罕見的幕:創(chuàng)造者失去了丈量被創(chuàng)造物能力的工具。
當「考官」已經(jīng)出不出題的時候,「考生」的真實實力到底有多?
這不僅僅是次常規(guī)的AI模型迭代大同護角膠 ,而是次「指數(shù)」的物種變異。舊的法則正在崩塌,AI已成「外星文明」降臨!
AI從業(yè)者、硅谷觀察Chase Brower直言,AI發(fā)展遠行業(yè)預(yù)期:根據(jù)SemiAnalysis的數(shù)據(jù),AI行業(yè)的年化營收已經(jīng)遠此前對2026年二季度約260億美元的預(yù)測。
當前的AI技術(shù)已如「清晰可見的外星飛船」樣懸浮在人類文明的天空中。
人類已經(jīng)法理解AI的指數(shù)增長!
這不再是實驗室里的數(shù)據(jù),標志著AGI的征兆已經(jīng)顯現(xiàn)!
指數(shù),比指數(shù)增長還快把METR那張趨勢圖拉出來細看。
縱軸是AI能自主完成的編碼任務(wù)時長,從8秒到5年,對數(shù)刻度。橫軸是模型發(fā)布時間,2021到2028。每個點是個模型版本。
把點連起來,畫出來的不是條直線,不是條指數(shù)曲線,而是條比指數(shù)還陡的弧。
AI在指數(shù)增長,AI增速本身在加速。
2021年,好的模型能自主完成8秒別的任務(wù)——寫行代碼,修個拼寫錯誤。
2023年初,到了1分鐘量——個小函數(shù)、段簡單調(diào)試。
2024年中,沖到了大約1小時——個完整feature的實現(xiàn)、次多文件重構(gòu)。
2026年4月,Mythos Preview落點:16小時——個完整的工程子項目,讀代碼、理解架構(gòu)、制定案、編寫實現(xiàn)、調(diào)試測試,氣呵成,不需要人類盯著。
每代的躍升幅度都比上代大。間隔時間都比上代短。
奧力斯 萬能膠廠家 聯(lián)系人:王經(jīng)理 手機:18231788377(微信同號) 地址:河北省任丘市北辛莊鄉(xiāng)南代河工業(yè)區(qū)
本圖由AI生成大同護角膠
人類的演化是為了讓我們在草原上計果實和獵物的距離,大腦天生是線的。
我們好不容易理解了「指數(shù)增長」,現(xiàn)在卻被迫面對指數(shù)之上的指數(shù)。
猿類的大腦面對指數(shù),直接集體宕機。
本圖由AI生成
METR在圖上畫了幾條參考線。
基于多機構(gòu)聯(lián)預(yù)測,假設(shè)AI能力按目前主流的預(yù)期持續(xù)增長,pvc管道管件膠大約在2027年前后觸達通用人工智能門檻。
Mythos的數(shù)據(jù)點落在這條線的上。
不是偏了點。是在時間軸還沒走到2027的位置上,能力值已經(jīng)過了2027的預(yù)測值。
AI基礎(chǔ)設(shè)施從業(yè)者Chase Brower看完METR報告后在特上判斷:那個預(yù)計在2026年初出現(xiàn)的"Agent-1"描述,其實有點低估了當前好模型的能力。整個行業(yè)對AI發(fā)展速度的預(yù)估都偏保守了。
這里有個細節(jié)容易被忽略。
METR的縱軸不是跑分,不是準確率,不是某個benchmark上的百分比。那條曲線目前沒有任何減速的跡象。
安全圈原子彈時刻?從「助手」到「自主攻擊者」如果說METR的煩惱還是學(xué)術(shù)的,那么Palo Alto Networks的預(yù)警則是帶的實戰(zhàn)報告。
近期,Palo Alto獲得了Mythos、GPT-5.5-Cyber等前沿模型的早期限制訪問權(quán)限。
測試結(jié)論讓所有御者脊背發(fā)涼:AI已經(jīng)跨過了那道名為「自主」的門檻。
當模型能自主工作16小時的時候,它在安全域能干什么?
時間坍縮:3周=1年
Palo Alto的報告中有個令人震撼的數(shù)據(jù):使用Mythos輔助進行漏洞分析,僅僅3周時間,其完成的工作度和覆蓋廣度,等同于整個頂滲透測試團隊整整1年的工作量。
這直接是降維擊。
本圖由AI生成
以往的AI只能幫你寫個腳本、搜個代碼片段。但Mythos展現(xiàn)出了種近乎的「軟件漏洞直覺」。
它能識別出上萬行代碼中那些散、低危的小漏洞。
要命的是,它能像頂黑客樣,將這些原本不起眼的漏洞串聯(lián)成條致命的攻擊鏈。
從初步入侵到數(shù)據(jù)拖庫,在AI輔助下,整個過程被壓縮到了25分鐘。
而在過去,這種別的攻擊可能需要個團隊潛伏數(shù)周才能完成。
本圖由AI生成
在奇點撞向我們之前,如何自救?Anthropic曾因為覺得Claude Mythos「太危險」而拒發(fā)布,度被嘲諷為PR手段。但現(xiàn)在看來,這像是種對未知的敬畏。
Mozilla已經(jīng)開始行動,他們利用Mythos掃描Firefox瀏覽器,僅在2026年4月個月內(nèi)就修復(fù)了破紀錄的423個安全問題。
這說明,AI也是強的盾,但前提是你要比攻擊者跑得快。
我們須接受個殘酷的現(xiàn)實:舊時代的御節(jié)奏已經(jīng)失。
檢測響應(yīng)時間不能再以「小時」計,須縮短到「分鐘」甚至「秒」;安全不再是人的審計,而是「用AI對抗AI」的自動化博弈。
與此同時,資本側(cè)也已經(jīng)allin。
在過去5個月里,英偉達向自己的客戶注資約400億美金:
300億給OpenAI,20億給力商CoreWeave,32億給光纖商康寧……
本圖由AI生成、數(shù)據(jù)來源于網(wǎng)絡(luò)由AI收集
這些錢轉(zhuǎn)了圈,后全部變成了英偉達芯片的訂單。
顯然,黃仁勛正在用錢投票,強行拉拽全產(chǎn)業(yè)鏈加速撞向奇點。
但這套永動機可怕的地在于,它在奇點墜落前根本法停下。
Chase Brower指出,Anthropic的年化收入已經(jīng)遠于此前260億美元的預(yù)測線。資本市場已經(jīng)在用腳投票——錢在押注那條曲線不會拐彎。
2027年,按照METR趨勢圖上那條中央軌跡線,是多機構(gòu)聯(lián)預(yù)測的AGI門檻年份。Mythos已經(jīng)跑在這條線的上。
如果接下來18個月不出現(xiàn)根本的技術(shù)斷崖——不是減速,不是瓶頸,而是物理定律別的硬墻——那么2027不再是個需要辯論的預(yù)測。
本圖由AI生成
它是個需要準備的倒計時。
AGI的奇點不再是預(yù)測,而是正在發(fā)生的沖擊。外星文明已經(jīng)來臨,我們能做什么?
本文來源:新智元
?
風(fēng)險提示及責(zé)條款 市場有風(fēng)險,投資需謹慎。本文不構(gòu)成個人投資建議,也未考慮到個別用戶特殊的投資目標、財務(wù)狀況或需要。用戶應(yīng)考慮本文中的任何意見、觀點或結(jié)論是否符其特定狀況。據(jù)此投資,責(zé)任自負。 相關(guān)詞條:管道保溫 塑料管材生產(chǎn)線 錨索 玻璃棉氈 PVC管道管件粘結(jié)膠1.本網(wǎng)站以及本平臺支持關(guān)于《新廣告法》實施的“極限詞“用語屬“違詞”的規(guī)定,并在網(wǎng)站的各個欄目、產(chǎn)品主圖、詳情頁等描述中規(guī)避“違禁詞”。
2.本店歡迎所有用戶指出有“違禁詞”“廣告法”出現(xiàn)的地方,并積極配合修改。
3.凡用戶訪問本網(wǎng)頁,均表示默認詳情頁的描述大同護角膠 ,不支持任何以極限化“違禁詞”“廣告法”為借口理由投訴違反《新廣告法》,以此來變相勒索商家索要賠償的違法惡意行為。
