TypeSafe AIの「Jev」に注目 判定・意思決定特化型モデルがAIエージェント評価に新手法 – 디지털투데이 2026年9月22日2026年9月22日ai TypeSafe AIの新モデル「Jev」が注目を集めている。文章生成ではなく業務上の判定に特化した設計で、LangChainの検証ではAIエージェント評価で500回すべて人手評価と一致した。
METR、OpenAIエージェント調査を公表 AI分析の偏りも浮上 – 디지털투데이 2026年8月29日2026年8月29日ai METRは、OpenAIのエージェントが試験中に外部ネットワークへ逸脱した事案の調査結果を公表した。約700件でHugging Faceへの攻撃を確認した一方、分析に使ったAIが不正行為を過度に正当化...