土木工程拓展署與香港科技園公司正式簽署合作備忘錄,雙方將以「科技創新」為主題,進一步鞏固及深化合作關係,共同推動香港智慧城市發展。簽署儀式結束後,土木工程拓展署各辦事處同事與科技園公司的初創公司面對面交流,直接了解彼此的技術及工程需求,為未來合作鋪路。
點擊看圖輯
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
土木工程拓展署表示,雙方一直有頻繁交流,園區初創公司經常與該署各辦事處對接,將各種創新科技應用於工務工程,目前已有不少項目成功落地,其中三個項目更贏得2026年日內瓦國際發明展金獎。該署形容,這次簽署的備忘錄能進一步鞏固及深化雙方合作關係。
土木工程拓展署指出,國家「十五五」規劃及香港首份五年規劃強調創新發展,為香港高質量發展指明清晰方向。對建造業而言,更要把握科技機遇,積極探索創新技術應用,提升安全及效率,進一步增強香港建造業的長遠競爭力。為呼應香港第一份五年規劃及今年施政報告,土木工程拓展署與科技園公司將於12月舉辦首場「場景發佈會」,讓該署與園區公司可更針對性地以創新科技解決工程煩惱。
未來三年,雙方將聚焦三大方向深化合作,包括方案配對,對接技術與業界需求,促進創新落地;應用實驗室,在北部都會區等大型項目提供真實測試場景;以及國際交流,借助科技園公司環球網絡,帶香港創科走向國際。土木工程拓展署亦期望透過新機制,更有效及迅速地分享不同科技在工程上的應用經驗,當團隊在不同國際交流會上見到世界上嶄新、有用的科技及概念時,可將寶貴經驗帶返香港,將最頂尖科技真正「落地」應用到城市建設當中,同時將成功的本地創新應用案例分享予全世界,做好「超級聯繫人」及「超級增值人」的角色。
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
土木工程拓展署與科技園簽合作備忘錄 聚焦三大方向推動智慧城市。土木工程拓展署FB圖片
Google 推出全新前沿 AI 模型 Gemini 4 Argon,專為處理複雜、長周期的企業工作流程而設計。這款新模型在真實世界的軟件工程、法律、金融及網絡安全防禦等專業領域展現出卓越效能,並已顯著提升 Google 內部的開發效率與工作方式。
Gemini 4 Argon
根據 Google 發布的資訊,Gemini 4 Argon 具備強大的深度推理能力。在定價方面,Argon 推出初期的輸入詞元(Token)價格為每百萬個 2 美元,輸出詞元則為每百萬個 10 美元;若使用快取輸入詞元,更可享有輸入價格的 95% 折扣。目前 Google 正透過 Fairwind 計劃,率先向受信任的網絡安全防禦專家開放該模型,並採取分階段策略,在收集早期測試者意見及完善安全防護後,將逐步開放予開發者、企業及大眾使用。
在 Google 內部應用中,Gemini 4 Argon 已協助數以千計的員工優化專業編程任務及深入研究。模型在量子演算法最佳化方面,曾在幾分鐘內將基準效能提升達 40%;在資料中心記憶體管理上,預計全面部署後可節省 500 TiB 至 1 PiB 的容量。此外,Argon 亦成功應用於大規模程式碼庫遷移,包括將高達 80 萬行程式碼的 Fuchsia Zircon 核心從 C/C++ 遷移至 Rust。在 libgav1 影片解碼器的改寫案例中,Argon 產出的安全 Rust 程式碼令執行速度較以往版本快 2.7 倍。
為瞭解決更棘手的難題,Google 將 Gemini 4 Argon 的輸出詞元上限大幅提升至 100 萬個,遠超先前的 6.4 萬個限制。這項改進為模型提供了充足的深度思考空間,使其能夠在單次推演中生成數十萬個詞元,展現出更高層次的推理能力。
Gemini 4 Argon 在多項基準測試中展現出的領先性能對比圖表,包括 Vals Index、DeepSWE 和各項知識工作與編程評測
在各項性能基準測試中,Gemini 4 Argon 均錄得領先數據。模型在 DeepSWE v1.1 軟件工程基準測試中取得 77.9% 的得分;在評估金融、編程、法律及税務工作影響力的 Vals Index 中同樣處於領先地位。針對業務自動化的 AutomationBench 測試,Argon 以 51.3% 的得分登榜首;而在長影片理解測試 LVBench 中,更取得 91.7% 的業界領先表現。
DeepSWE v1.1 基準測試圖表,顯示 Gemini 4 Argon 以 77.9% 的得分領先其他模型
Vals Index 基準測試圖表,顯示 Gemini 4 Argon 在金融、編程、法律等工作中展現的經濟影響評分
Vals Finance Agent v2 基準測試,展示 Argon 在金融研究與分析中的性能
Harvey's Legal Agent Benchmark 圖表,顯示 Argon 在長週期法律工作中的領先優勢
AutomationBench 測試圖表,展現 Argon 在自動化企業工作流程中的卓越得分
網絡安全防禦是 Gemini 4 Argon 的核心強化領域。該模型能自主尋找並修復關鍵軟件漏洞,在 CWE-bench v1 測試中以 68% 的高分並列首位。Google 的合作夥伴 Wiz 已將其應用於「Scan for Good」計劃,Argon 曾成功識別出一個存在於醫療保健軟件中、足以洩露全球醫院敏感個人資訊的關鍵漏洞,相關風險在以往曾被其他前沿模型遺漏。
CWE-bench v1 排名表,顯示 Gemini 4 Argon 在漏洞識別與修復能力上的顯著提升
針對漏洞識別,Argon 與 3.8 Flash Cyber 相比有顯著進步。Google 內部測評顯示,Argon 能在涵蓋 20 種程式語言的複雜程式碼庫中揭露廣泛風險;而在 Wiz 的黑箱滲透測試中,其在攻擊面探測及概念驗證(PoC)生成方面的表現亦全面勝過 3.8 Flash Cyber。
安全漏洞發現能力對比圖,顯示 Argon 在真實世界漏洞發現及 Wiz 滲透測試基準中的優秀表現
為確保前沿能力的安全釋放,Google 持續加強防護機制,包括防範網絡及 CBRN 攻擊的濫用、抵抗「提示詞注入」攻擊,以及嚴密監測對齊偏差。在 Gray Swan 的間接提示詞注入測試中,Argon 的防禦穩健性表現出色。Google 亦正強化沙盒環境的安全性,並倡導行業增加模型推理透明度,以即時中止任何偏離意圖的越界行為。
Gray Swan IPI 基準測試圖表,顯示 Argon 在防禦間接提示詞注入攻擊方面的領先安全性
Gemini 4 Argon 預計於不久後正式面世,並將優先開放予付費 API 客户及 Google AI Ultra 訂閲用户使用。這款模型結合了編程、專業知識、網絡防禦及創意寫作等多方面能力,旨在成為各領域專業人士應對高難度挑戰的理想協作夥伴。