#圖片
【香港大火】大埔宏福苑大火|圖片記錄這一刻
26日,大埔宏福苑五級火造成重大人員傷亡,火焰無情地吞噬建築與生命,但在火場內外,消防員、警務人員、醫護人員以及每一位救災人員均不分晝夜地投入救援,甚至有消防員在救援過程中殉職,他的犧牲令人痛心卻也令人敬仰。曙光初現。香港文匯報記者萬霜靈 攝除了專業救援人員,民間組織與普通市民也展現了無比的善心,有人捐贈食物與衣物,有人製作報平安尋人資訊網,有人自發組織志願隊伍協助分發物資與安撫受災者,社區的凝聚力在災難中迅即被強烈喚醒。更令人動容的是,市民不僅關心人們的安危,還為寵物提供庇護,寵物們的寶貴生命也不會被遺忘。火災是一場殘酷的考驗,它奪走了生命與財產,留下無數傷痛,然而正是這場災難,讓人們看見了人性最光輝的一面:消防員的英勇、警務人員的守護、醫護人員的堅持、民間組織與市民的善心,交織成一幅溫暖的畫面。人們在哀悼死難者與殉職英雄的同時,也在彼此的陪伴與支援中找到力量。願逝者安息,願生者堅強,願香江在災難後更加團結,讓人性光輝持續照亮前行的道路!●火場終於受控,消防員將沉重的消防喉一圈圈收起。香港文匯報記者萬霜靈 攝●警方的「災難遇害者辨認組」進入火場調查。香港文匯報記者曾興偉 攝●「災難遇害者辨認組」到場,象徵著救援工作進入另一個環節。 香港文匯報記者萬霜靈 攝●大埔宏福苑宏昌閣近地下棚架起火,火勢失控蔓延至另外6廈,由三級火升級為五級火。香港文匯報記者鄧偉明 攝●消防隊將大火大致救熄,死亡人數持續上升。香港文匯報記者鄧偉明 攝●眼看一個屋苑變成滿目瘡痍的廢墟,讓人百感交集。 香港文匯報記者曾興偉 攝●當消防員將受困者救出後,救護員立即接手,迅速檢查傷勢、給予初步處理,並在最短時間內安排送往醫院。 香港文匯報記者鄺福強 攝●位於大埔的過渡性房屋「樂善村」為災民提供暫住服務。香港文匯報記者北山彥 攝●不少寵物從災場中被救出,廣福邨平台義工分派寵物所需的物資。香港文匯報記者北山彥 攝●人員抱著從火場救出的毛孩。 警方供圖民眾悼念●有市民雙手合十祈望罹難者安息。香港文匯報記者萬霜靈 攝●小孩獻花悼念罹難者。 香港文匯報記者田至靭 攝●市民獻上鮮花致哀。 香港文匯報記者曾興偉 攝●市民簽署弔唁冊悼念罹難者。香港文匯報記者北山彥 攝●有市民跪下為受災民眾祈禱。香港文匯報記者楊帆 攝救災英雄●消防員的英勇精神讓人敬佩。 香港文匯報記者萬霜靈 攝●消防員在救災後雖然面露疲態,但眼神中依然透出堅毅與責任感。 香港文匯報記者劉友光 攝●消防員與「災難遇害者辨認組」的職責相互銜接。 香港文匯報記者萬霜靈 攝(香港文匯報)
Google死磕爆款AI服務
「 Google什麼都想要 」Google可以說是當下GenAI大模型服務最多的公司,別家有的他也有,別家沒有的他還有。但是到目前為止,真正有口碑的,也就一個NotebookLM。對大模型AI產品的定位再模糊點,也只能再加入一個Colab。這導致每次Google官方牟足勁宣傳新產品的時候,AI頓悟湧現時總會緊張:不會又不好用吧!5月21日,Google I/O 2025全球開發者大會準時炸場。這次與以往一樣,又發不了大量大模型產品,特別是面向開發者服務的AI產品全家桶更新,更是讓人感動到雙眼噙滿淚花。首先是小模型Gemma3n,參數量有5B和8B兩個版本,讓人最心動的是,其能在2GB記憶體的裝置上運行,低配智慧型手機甚至是物聯網裝置都能跑!還有文生視訊模型Flow,全新的圖片生成模型Imagen 4,Google搜尋即將全面升級的AI模式,Gemini也直接整合進Chrome瀏覽器!還有會前公佈的AI Coding產品Jules。最後一項比OpenAI還誇張的訂閱服務,Google AI Ultra直接將價格拉到了249.99美金每月!不太理解這個服務的意義。賣不出去該多尷尬!除此之外,再看開發者服務,Google將自己對標Anthropic MCP的A2A協議,升級到了v0.2版本。新版本著重最佳化了智能體間的通訊驗證,大幅減少了冗餘互動。聽起來,有了這個基礎,普通API就有動力升級為A2A協議,方便智能體呼叫。實用性不評價,還是要看後續是否好用。說不定未來會成為AI智能體開發者重要的交付手段。接下來還有ADK開發工具包,Google不僅升級推出了Python ADK v1.0.0,還誠意滿滿的拿出了Java ADK v0.1.0,惠及更多開發者。簡單總結下來,新服務就這麼多。不過每項仔細盤下來,更新著實不少。這次Google開發者大會,可以明顯看出:Google在用盡一切心思打造好用的小功能,然後意圖依賴這些小功能贏得市場口碑。大即便是當下市場正朝著多模態融合方向狂奔,Google也更願意將不同模態垂直模型分開發展,而不是打造驚豔世人的大而全產品。究其核心,還是Google的使用者體量實在是太大了!Google搜尋長期霸佔全球搜尋市場份額90%以上,Gemini AI應用剛剛公佈的月活資料已經來到4億!GenAI大模型服務極其消耗算力,在沒有明確商業模式的情況下,貿貿然將服務全量投放市場,這麼大的使用者量Google真吃不消。與OpenAI不同,Google作為上市公司要為投資人負責,算力成本必須嚴格控制。特別是GenAI大模型第一個要顛覆的目標,就是搜尋引擎市場,Google更是要謹慎行事,算好帳。畢竟創企有可能通過花小錢服務好一小撮使用者贏得口碑,而Google想扭轉口碑投入成本就要上萬倍!這或許是每次Google大模型服務的宣傳和實際體驗不同的核心原因。近半年,隨著Cursor、MCP的爆火,給了Google四兩撥千斤的啟發:研發出一個個被市場認可的小功能,投入所帶來的市場口碑更加高效。而現在,249.99美金每月的訂閱服務推出,也是Google主動對使用者和服務進行主動分層,管控投入成本的舉措。另一方面,也是Google對自家服務有了自信,只有服務足夠豐富、能力足夠強,才能能賣出這種高價訂閱會員。你看,Google剛發佈的AI程式設計服務Jules,為了狙擊OpenAI Codex就只能直接免會員,每日給5次免費任務。現在的Google,急需挖掘出大量大模型爆款小功能,靠差異化拉高付費資料,度過AI搜尋難關。你看現在Google都開始宣傳AI購物了,接下來應該是要將Amazon一軍,把資本市場的目光從AI搜尋轉移到AI電商。 (AI頓悟湧現時)
馬斯克“後悔了”……
美國白宮4日在社交媒體上發佈美國總統川普手持光劍的《星球大戰》風格AI圖片。巧合的是,美國企業家馬斯克同日在社交媒體上發佈了相似風格的圖片。不過,兩人手持的紅色光劍在電影《星球大戰》中代表著反派,引發網友熱議。紅色光劍引網友熱議5月4日被《星球大戰》影迷們稱為“星球大戰日”,因為電影中有一句著名台詞“May the Force be with you”(願原力與你同在),其英文發音與“May the 4th be with you(願5月4日與你同在)”一致。美國白宮和馬斯克同日在社交媒體上發圖時均配文:“願5月4日與你同在(願原力與你同在)。”巧合的是,兩人手持的紅色光劍代表著電影中的邪惡勢力,引發網友熱議。帖文翻譯:怎麼就沒有一個懂行的員工來告訴你們那種顏色的光劍代表著好、那種顏色的光劍代表著壞???帖文翻譯:從字面上承認他正在為黑暗勢力而戰……是否後悔支援川普?馬斯克回應最近一段時間,馬斯克在川普政府中的地位和作用備受關注。美國媒體報導,馬斯克與川普政府高官發生爭執,比如他在總統辦公室外與財政部長貝森特“大聲爭吵”,以及他在社交媒體稱川普貿易顧問納瓦羅為“白痴”。馬斯克4月下旬公開表示,他將從5月開始“大幅”減少管理政府效率部的時間,“把更多時間投入到特斯拉”。英國《金融時報》報導,馬斯克大多數情況下不在位於白宮附近的辦公室辦公,而是遠端指揮政府效率部。美國《華盛頓郵報》報導,馬斯克開始“厭倦”政治。馬斯剋日前接受川普的兒媳拉拉·川普採訪,被問到是否對自己支援川普感到“後悔”時,他脫口而出:“是的。”不過,馬斯克隨即笑著改口“沒有”,並要求“這段掐了別播”。《星球大戰:星際戰機》會被加征關稅?5月4日當天,川普在社交媒體“真實社交”上發文稱,美國電影業“正在迅速衰亡”,其他國家正通過各種激勵措施“吸引美國電影製作人和工作室離開美國”。川普說,好萊塢因此“遭受重創”,這對美國構成“國家安全威脅”。川普說,他將授權美國商務部和美國貿易代表立即啟動程序,對所有進入美國、在外國製作的電影徵收100%關稅。《星球大戰:星際戰機》今年將在英國開拍,預計2027年上映。有網友問道:“按照川普電影關稅政策,這部電影會被視為在外國製作的電影加征關稅吧?” (環球雜誌)
OpenAI急徵10萬張高階顯示卡應付大量圖片生成 AI主題再次席捲?
OpenAI 最近推出的 ChatGPT GPT-4o 強大圖像生成功能在網路上引發了一股病毒式 AI 繪圖熱潮,尤其是那些仿吉卜力(動畫大師宮崎駿的工作室)風格的生成圖像,更是令用戶嘆為觀止。付費用戶不滿圖像生成無限開放給大眾然而,激增的使用者需求讓 OpenAI 的 GPU 系統捉襟見肘,面臨算力短缺的危機。上週,OpenAI 執行長 Sam Altman 在 X 平台上直言:「我們的 GPU 快燒熔了!」並宣布對免費用戶實行圖像生成限制,同時懇請大家冷靜,暫時別再生成圖像,因為團隊也需要休息…而言此舉受到大量用戶批評,尤其是付費用戶,皆因免費開放該功能令算力不足影響了他們的使用,質疑OpenAI沒有預算清算算力,同時出現問題時不馬上限制修正。Sam Altman:急徵 10 萬張高階顯示卡4 月 1 日,Sam Altman 宣布將 ChatGPT 圖像生成功能向所有免費用戶開放,隨後於今日(2 日)在 X 上坦誠地透露當前面臨的嚴峻挑戰:“我們正努力控制局面,但由於算力緊張,請預期 OpenAI 的新功能發布可能會延遲、服務可能出錯,甚至有時運行緩慢。”https://x.com/sama/status/1907098207467032632他甚至緊急求救道:“我們正在全力讓一切順暢運作;如果有人能立即提供 10 萬張 GPU 的算力,請馬上聯繫我!”Sam Altman 這項罕見的求助行動表明,這家全球領先的 AI 巨頭正遭遇嚴重的算力瓶頸,規模之大,已迫使執行長親自出面向全球公開徵集高階 AI 顯示卡資源。業界普遍認為,「十萬張」很可能指的是 Nvidia H100 或 B200 等用於 AI 訓練和推理的高階 GPU 顯示卡。而此事件可以看出,AI的需求和敘事並未完結,且熱度可隨時再臨,及早佈局有潛力的AI概念幣可能獲得巨大收益,而AI代理主題​​在上一波爆發後隨宏觀經濟拖累而平淡,現在或是重新關注的好時機。加密AI代理MIND of Pepe預售中籌集750萬美元MIND of Pepe($MIND)自啟動以來,僅用兩個月時間便成功籌集了750萬美元預售資金。在實現這一里程碑後,專案方最近分享了有關MIND of Pepe的語言大模型(LLM)、增強檢索生成(RAG)結構以及所經過的人工智慧(AI)訓練的最新進展。這些新更新標誌著該專案在精細調整終極加密交易工具方面取得了進展,旨在為$MIND持有者提供市場洞察,幫助他們抓住機會,無論市場是上漲還是下跌。投資人可以在預售階段以$0.003566的價格購買$MIND,距離價格上漲不到兩天。MIND of Pepe的新進展MIND of Pepe是具有自主能力的加密AI代理,能夠獨立掃描、分析並與區塊鏈網路、去中心化應用程式(dApps)及社群媒體平台互動。它為$MIND持有者提供可操作的市場洞察,幫助他們在市場中獲利。https://x.com/MINDofPepe/status/19027675792420868163月21日,MIND of Pepe發布了關於其技術的最新更新,揭示其正在精細調整語言模型,以提高互動性和直覺性。這些優化包括:實現與使用者的無縫互動,確保所有回應保持一致的語氣,並融入一定的個性。增強的智能,使其更加智能化。此外,MIND of Pepe已更新,增加了即時市場感知能力,提升了其追蹤加密趨勢、新聞、情緒變化和價格波動的能力。擁有一個不斷監測即時數據的AI代理具有強大優勢,尤其是對於那些尋求與當前市場狀況相匹配的及時交易建議的用戶。該項目還將增加一個強大的儀錶盤,作為$MIND持有者的指揮中心,讓他們可以一目了然地查看關鍵信息,如市場洞察和分析、代幣互動指標以及新興市場趨勢。最後,專案的AI訓練也取得了顯著進展,已分析了60,000條來自頂級加密聲音的推文,並精心挑選了3,000條有價值的洞察,以優化其智能水平。https://x.com/MINDofPepe/status/1902767603959075034結合即時向量資料庫和營運資料檢索系統,MIND of Pepe如今更接近成為加密交易者的全能工具,為用戶提供更智慧的市場洞察、增強的市場感知能力,並在漲跌市場中提供更銳利的優勢。迷因幣產業如今與人工智慧緊密相連 MIND of Pepe巧妙地結合兩者迷因幣產業無疑已遠離2024年的巔峰,整個產業的市值已降至低於500億美元,較去年年底創下的1,370億美元估值大幅下滑。來源:CoinMarketCap儘管市場下行,但有一件事保持不變:迷因幣領域的前三大資產,已經成為迷因幣的“拉什莫爾山”,只不過少了一尊雕像。這些主導資產是狗狗幣($DOGE)、柴犬幣($SHIB)和Pepe($PEPE)。然而,我們也必須承認,Official Trump($TRUMP)曾一度從Pepe手中奪走了第三的位置,證明了它是一位強有力的競爭者。川普的存在無疑是個異類,不僅在政治上,在加密貨幣領域也是如此。推出一個迅速達到十億美元市值的代幣,暗示川普可能具備某種「金手指」般的能力。不過,業界一些前10名的代幣已經消失,而來自Pump.fun的最新現像也逐漸嶄露頭角,成為這些傳統大牌代幣的潛在挑戰者。如果要總結該產業的演變,顯然加密市場鍾愛狗狗和Pepe,但也願意接納新的創新專案。正如以太坊在比特幣崛起後推出突破性的智慧合約功能,Solana透過提供更快的交易和更好的擴展性獲得了動力,加密投資者一直願意採納推動技術邊界的創新。如今,顯然加密產業的下一步進化將涉及人工智慧。更具體地說,在迷因幣的領域,沒有人比MIND of Pepe更好地將AI與迷因幣文化結合。簡而言之,迷因幣的未來可能不再僅僅依賴幽默和錢包裝飾。那些提供實際效用的代幣必將成為焦點,現在正是進入這項變革的最佳時機。$MIND vs. $PEPEMIND of Pepe仍有很長的路要走,才能在所謂的「迷因幣界的拉什莫爾山」中佔有一席之地。然而,一旦其技術推出,代幣上線交易所後,$MIND的市值將可能大幅上升。根據CoinGecko數據,加密AI代理產業的市值為44.1億美元,六大資產的市值均超過1億美元,其中一個(人工超智慧聯盟 – $FET)超過了10億美元。同時,青蛙主題代幣的總市值也達到了40億美元,其中三個代幣市值超過1億美元,而$PEPE的市值獨佔30億美元。預計這兩個產業在2024年將超越其先前的最高點,如果這一趨勢繼續發展,MIND of Pepe將位於這兩個繁榮敘事的交匯點。這個獨特位置提高了$MIND吸引迷因幣愛好者和AI驅動的加密投資者的支持的可能性。鑑於其技術極有可能獲得關注並證明其在加密交易中的重要性,它將進一步強化像Crypto Nautic這樣的知名影響者所分享的前景。這位YouTuber最近告訴他的10.2萬名訂閱者,MIND of Pepe有望成為下一個十億美元AI代幣。如何在MIND of Pepe中領先一步在加密貨幣領域,機會青睞勇者──那些早期行動的人往往能獲得最大的回報。為了搶先一步,你可以訪問MIND of Pepe的官網,連接你的錢包(如Best Wallet),並使用ETH、USDT或銀行卡購買$MIND代幣。Best Wallet是一款領先的非託管多鏈錢包,已將MIND of Pepe列為其「即將上線的代幣」專區——這是一個專門展示有潛力進行重大變動的資產的功能。透過Best Wallet,用戶可以在官方認領日期前方便地查看自己的$MIND代幣。該應用程式可在Google Play 或 Apple App Store下載。別忘了加入MIND of Pepe的X 和 Telegram社區,保持更新。按此瀏覽原文免責聲明:本內容為通訊社發布的新聞稿,僅供參考。我們未對其中的資訊進行獨立驗證,亦不對其準確性或所述服務承擔任何責任。本內容不構成投資建議或推薦,亦不應被視為此類建議。我們強烈建議您在參與任何金融活動或投資決策之前,請諮詢合格且受監管的專業財務顧問,以確保自身權益。
OpenAI在圖片領域站起來了!
26日凌晨,OpenAI推出了GPT4o圖像生成,可以說解決了此前Midjourney等擴散模型很難解決的問題,業內為之大為讚歎。這是用手機拍攝的玻璃白板的廣角圖像,拍攝地點是一間俯瞰海灣大橋的房間。視野中可以看到一位女士正在寫字,她身穿一件印有大型 OpenAI 標誌的 T 恤。筆跡看起來很自然,但有點凌亂,我們可以看到攝影師的倒影。現在,使用者建立和自訂圖像就像使用 GPT‑4o 聊天一樣簡單 - 只需描述需求,包括任何細節,例如縱橫比、使用十六進制程式碼的精確顏色或透明背景。攝影師的自拍照,她轉身和他擊掌不過,OpenAI表示,由於此模型可以建立更詳細的圖片,因此圖像渲染時間更長,通常長達一分鐘。有用的圖像生成當今的生成模型可以呈現超現實、令人驚嘆的場景,但卻無法處理人們用來分享和建立資訊的主要圖像。從徽標到圖表,圖像在加入指代共同語言和經驗的符號後,可以傳達精確的含義。GPT‑4o 圖像生成擅長精準渲染文字、精確遵循提示以及利用 4o 固有的知識庫和聊天上下文(包括轉換上傳的圖像或將其用作視覺靈感)。這些功能讓您可以更輕鬆地建立您設想的圖像,幫助您通過視覺效果更有效地進行交流,並將圖像生成推進為一種精確而強大的實用工具。增強功能:一圖勝千言生成精準的文字,可程式碼編輯,強大的情景感知據OpenAI官網介紹,根據在線圖像和文字的聯合分佈訓練模型,不僅學習圖像與語言之間的關係,還學習圖像與語言之間的關係。結合積極的後期訓練,生成的模型具有令人驚訝的視覺流暢性,能夠生成有用、一致且具有情境感知能力的圖像。文字渲染一張圖片勝過千言萬語,但有時在正確的位置生成幾個文字可以提升圖像的含義。4o 將精確的符號與圖像融合的能力將圖像生成轉變為視覺交流的工具。多輪生成由於圖像生成現在是 GPT-4o 的原生功能,您可以通過自然對話來最佳化圖像。GPT-4o 可以在聊天環境中基於圖像和文字進行建構,從而確保始終保持一致性。例如,如果您正在設計視訊遊戲角色,那麼在您進行最佳化和實驗的過程中,該角色的外觀在多次迭代中保持一致。原始圖像給這隻貓一頂偵探帽和一副單片眼鏡將其變成使用 4k 遊戲引擎製作的 3A 視訊遊戲,並加入一些使用者介面作為神秘 RPG 的覆蓋,我們可以在頂部看到健康欄和小地圖,在底部看到具有一致圖像的咒語更新為 16:9 比例的橫向圖像,在 UI 中加入更多咒語,並縮小視覺效果,以便我們以第三人稱視角看到貓穿過蒸汽朋克曼哈頓,創造出美麗的對比度和燈光,就像在最好的三 A 遊戲中一樣,配以冷色調當玩家打開菜單時建立介面,我們會看到貓的角色資料及其裝備以及另一頁顯示活躍任務(並且它應該與我們在圖像中描述的宇宙世界建構有關係)遵循指令GPT‑4o 的圖像生成遵循詳細的提示,注重細節。其他系統在處理約 5-8 個對象時會遇到困難,而 GPT‑4o 可以處理多達 10-20 個不同的對象。對象與其特徵和關係的更緊密繫結可以實現更好的控制。一張正方形圖片,包含一個 4 行 4 列的網格,網格上有 16 個對象,背景為白色。從左到右,從上到下。列表如下:1. 一顆藍色的星星2. 紅色三角形3. 綠色正方形4. 粉色圓圈5. 橙色沙漏6. 紫色無限符號7. 黑白圓點領結8. 扎染“42”9. 一隻戴著黑色棒球帽的橙色貓10. 一張帶有寶箱的地圖11. 一雙活動眼珠12. 一個豎起大拇指的表情符號13. 一把剪刀14. 一隻藍白相間的長頸鹿15. 用草書寫的“OpenAI”一詞16. 一道彩虹色的閃電情境學習GPT‑4o 可以分析和學習使用者上傳的圖像,將其細節無縫整合到其上下文中以指導圖像生成。使用這些圖像作為參考,繪製帶有三角形車輪的車輛的設計圖。標記前輪、後輪,並在圖表上寫上(小寫)三角輪車輛。英文專利。2025. OPENAI。現在把它放到一張在紐約市拍攝的照片中。世界知識原生圖像生成使 4o 能夠將其知識連結到文字和圖像之間,從而產生一個感覺更智能、更高效的模型。示例:可以通過程式碼來修改圖像。照片寫實主義和風格通過對反映各種圖像風格的圖像進行訓練,模型可以令人信服地建立或轉換圖像。一種新型的圖片生成方式一位hackernews使用者表示:關於這種新型圖像生成方式,它通過代token而不是擴散來實現,重要的是它實際上是在像素空間中進行推理。例如:讓它畫一個帶有空白井字棋格的記事本,然後告訴它先走一步,接著你走一步,如此循環。你還可以進行一些非常令人印象深刻的、保留資訊的轉換,比如改變繪畫風格,或者像“將白天變為夜晚”,或者“給他戴上一頂帽子”之類的操作。“我感覺這些模型在解析度方面相當受限,但在這個領域進一步的研究將讓我們能夠做出一些真正瘋狂的事情,比如讓模型分步驟完全用圖像建立一個應用程式,本質上是用文字設計整個應用程式,包括文字內容等,然後生成程式碼來重現它。這也意味著一個模型可以接替一個優秀的擴散模型,即使最初的生成效果不佳,它也可以在外部圖像上繼續“推理”。”最後,一旦這些模型的速度提升,你可以想像一個真正的生成式使用者介面,模型根據傳送給LLM的事件生成你正在使用的應用程式的下一幀(LLM可以像平時一樣使用工具、思考等)。然而,我也相信擴散模型可以以更快的方式完成其中的一些任務。甚至有網友曬出了一張被倒滿的酒杯的生成圖像來證明OpenAI攻克了很多業界不能突破的難題。今日即可訪問和可用性從今天開始,4o 圖像生成將作為 ChatGPT 中的默認圖像生成器向 Plus、Pro、Team 和 Free 使用者推出,Enterprise 和 Edu 即將推出。它也可以在 Sora 中使用。對於那些對 DALL·E 情有獨鍾的人來說,仍然可以通過專用的 DALL·E GPT 訪問它。沒錯,免費使用者也可以用,小編也嘗鮮了一把。同時,開發人員很快就能通過 API 使用 GPT-4o 生成圖像,並將在未來幾周內推出存取權。OpenAI在圖片生成領域不是最早的,前有StableDifussion,後有Midjourney,但大模型的世界就是這麼變幻莫測,OpenAI在圖片領域這次可以說是成功逆襲了。 (51CTO技術堆疊)