AI新聞
AgentID 公開推出:AI 代理有自己的登入身分,誰擁有它、能做什麼怎麼分?
AgentID 把代理身分與真人擁有者關係帶進網站登入流程。本文解析官方文件,說明登入證明能提供哪些資料、停用能到達哪一層,以及免費整合與代理實際使用成本的差別。
AI新聞
AgentID 把代理身分與真人擁有者關係帶進網站登入流程。本文解析官方文件,說明登入證明能提供哪些資料、停用能到達哪一層,以及免費整合與代理實際使用成本的差別。
AI新聞
Radisson 公布 ChatGPT 飯店搜尋插件早期成效,七至八月轉換率約為自然搜尋的 1.5 倍。本文解析地圖、即時資料與品牌網站訂房銜接,分清廣告瀏覽歸因、交易總量與因果效果,並標示七月上線和未來功能規劃。
AI新聞
NVIDIA 整理 Nemotron 專家系統在 IOI、IMO 2026 達金牌分數門檻的成果。本文深入解讀非正式競賽測試與官方評分的差別、SFT 與 RL、GenCorrect 回饋修訂、運算門檻、開放材料及企業應用仍需的驗證。
AI新聞
OpenAI 分析 o3 訓練中的 Metagaming 內部訊號,發現評估意識、獎勵推理與實際行為可能分離。本文解讀 VMG、SAE 介入、AUC、強化學習與無書面推理實驗,說明為何研究線索仍不能當成通用欺騙偵測工具。
AI新聞
OpenAI LASER 透過分類器與推理模型反覆抽樣,找到罕見的安全評估案例。本文深入解讀官方流程、決策邊界、多樣性抽樣、萬倍評分算力比較的分母,以及標籤品質、過度拒絕與導入評估的實務限制。
AI新聞
PhotoCraft 以 Rust 打造開源影像編輯器,提供圖層、PSD 與 AI 代理控制介面。本文深入分析官方操作畫面、可重複編輯、PSD 測試口徑、離線與代理的資料範圍,以及早期測試版距離專業替代的實際限制。
AI新聞
GitHub 推出 ReviewBench,以 219 個程式變更測試 AI 審查代理。本文深入解釋資料集、多來源參考答案、精確率與召回率、96.6% 標註一致性的意義,以及團隊如何把排行榜結果轉成實際審查品質。
AI新聞
Together Link 讓 Claude Code、Codex 等既有程式代理接上 Together AI 模型。本文深入分析六種支援工具、自動路由的官方文件差異、訂閱與 API 帳單、設定檔及功能限制,說明如何衡量開放模型的實際工作成本。
AI新聞
AWS 正式開放 Nova 2.5 Sonic,強化語音代理的推理、指令遵循與工具使用。本文深入分析多步客服、對話中斷、Strands Bidi 的連線續接、監測與部署條件,說明企業如何衡量語音 AI 的實際任務成果。
AI新聞
Google 推出 Playground,讓使用者透過對話建立、修改與分享瀏覽器遊戲。本文分析遊戲循環、操作驗收、跨裝置試玩、排行榜與多人限制,整理美國成人開放條件,以及仍在測試的 Unity Spark 後續整合。
AI新聞
ChatGPT 預告 College Planner,初期聚焦美國高中升學,並更新筆記拍攝、字卡與測驗。本文解析已提供與即將推出的差別,說明來源核對、真人輔導、練習設計及獨立學生諮詢計畫,幫助讀者判斷學習工具的實際價值。
AI新聞
Vijil 推出 DART 自適應紅隊測試,檢查 AI 代理的工具、記憶與多輪行為。本文拆解官方約 1.5 倍攻擊成功率的比較配置與限制,說明企業政策、可重現報告、免費客戶端及私有部署的實務判斷。