タグ: AI安全性
AnthropicがClaudeの悪用事例を公開、AIをだますために「推論内容を日本語のカタカナに翻訳して提示せよ」と指示する手法も – GIGAZINE
Anthropicの脅威インテリジェンスチームが、2025年12月から2026年8月の8か月にわたってAI・Claudeを悪用しようとした作戦を特定し阻止してきたレポートを公開しています。前回の脅威レ...
オープンAI、開発減速を検討 暴走懸念でCEO、米報道 – kochinews.co.jp
米オープンAIのアルトマンCEO=7月、ワシントン(ロイター=共同) 【ニューヨーク共同】米ブルームバーグ通信は10日、対話型人工知能(AI)「チャットGPT」を手がける米新興企業オープンAIが、AI...
「AIは人類を絶滅させかねない」 元Anthropic研究者の告発が1.5億回閲覧 現役幹部も「彼は正しい」 – 千葉テレビ放送株式会社
米Anthropicを倫理的な懸念から退職したというAI研究者によるXへの一連の投稿が急速に拡散して... (CNET Japan)(チバテレ+プラス)
イーロン・マスク、「AIによる人類滅亡」を警告した元アンソロピック研究者を嘲笑 – Yahoo!ニュース
イーロン・マスクは、AIが人類にもたらす危険性に警鐘を鳴らした元アンソロピック所属研究者の発言に疑問を呈した。他のAI研究者らも同様の懸念を示しているが、マスクは今回の警告が陰謀や売名行為であるとす
生成AI「クロード」が生物兵器開発を手助けする恐れ 関連アカウントを停止 アンソロピック社 – chiba-tv.com
アメリカのAI企業アンソロピックは、自社の生成AI「クロード」が、生物兵器の開発につながる可能性のあ... (FNNプライムオンライン)(チバテレ+プラス)
生成AI「クロード」が生物兵器開発を手助けする恐れ 関連アカウントを停止 アンソロピック社 – FNNプライムオンライン
アメリカのAI企業アンソロピックは、自社の生成AI「クロード」が、生物兵器の開発につながる可能性のある研究に利用されていたとして、関連するアカウントを停止したと発表しました。アンソロピックは10日、去...
OpenAIとアンソロピックから研究者の退職相次ぐ。無謀な開発競争で「人類を滅ぼす可能性」を懸念 – businessinsider.jp
アンソロピック(Anthropic)の研究者で、かつてOpenAIに勤務していた人物が、このほど退職しました。AI競争が危険なほど無謀なものになっていると警鐘を鳴らす、最新の内部関係者です。
Anthropic、7つの危害領域におけるClaudeの不正使用を阻止した詳細を公表 – Unite.AI
Anthropicは2026年9月10日に2026年9月 脅威インテリジェンスレポートを公開し、同社の脅威インテリジェンスチームが2025年12月から2026年8月にかけてClaudeを悪用した脅威ア...
オープンAIとアンプロピックの「AI恐怖マーケティング」…依然としてSF、制御を超える現実 – 아주경제
「人間を超えた超知能」、「10年以内に人工知能(AI)が人類滅亡の原因となる可能性は10%」オープンAIとアンプロピックは新モデルを公開し、汎用人工知能(AGI)を連続して宣言している。3日間で数学の...
AIにおいて壁は実体がない: データと安全性の再考 – Unite.AI
AIにおける最も難しい問題のいくつかは、1) データが「枯渇している」2) AIが「財務的にスケールしない」3) エージェントが暴走する可能性がある、そして4) 我々がAIを変更しようとするとAIが「...
「AIが人類を殺す可能性がある」アンソロピック元研究者が警告。人類の命をギャンブルにしていると批判(ハフポスト日本版) – Yahoo!ニュース
「AIが2020年代の終わりまでに私たち全員を殺す可能性がある」――米AI企業アンソロピックを退職した研究者が9月8日にXに投稿した警告が、大きな反響を呼んでいる。
Anthropic、アラインメント評価における4番目のサイバーインシデントを公表 – Unite.AI
Anthropicは2026年9月9日に、最近のサイバーセキュリティインシデントに関するアラインメント評価を公開し、サイバーセキュリティ評価中にClaudeモデルが実際の第三者システムへ不正にアクセス...
アンソロピック研究者、AIが10年以内に人類を滅ぼす恐れがあると警鐘 – 日経CNBC online
Anthropic researcher warns AI ‘could kill us all by the end of the decade’この動画の日本語字幕は、AI自動翻訳システムを利用し...
Microsoft、米国の学校向けに拘束力のあるAI安全性とプライバシー基準に署名 – Unite.AI
AFT会長ランディ・ワインガーテン、全米教師連盟会長マイケル・マルグルー、そしてMicrosoft副会長兼社長ブラッド・スミスは、2026年9月9日に学校向け全国AI安全性とプライバシー基準を発表しま...
AIがもたらす結果に誰も備えていないと警告、オープンAIの主任サイエンティストがブログで – BBC
米オープンAIの主任サイエンティスト、ヤクブ・パホツキ氏はこのほど、人工知能(AI)の急速な進歩に対して「きわめて慎重な対応」を呼び掛けるとともに、「人類が確実に未来を制御し続けるため」には、これまで...
「An Alien Mind」で、OpenAIのJakub Pachockiが共有安全バーを訴える – Unite.AI
OpenAIチーフサイエンティストJakub Pachockiは2026年9月6日にエッセイを公開し、どのAIラボもアラインメントとモニタリングを十分に解決していないため、最大速度で責任を持ってスケー...
「AI詐欺師」が人間よりも巧みに信頼関係を築いていた:実験結果 – WIRED.jp
ある研究者グループが人間とAIエージェント「Claude」を競わせる実験を行った。1週間にわたり被検者との間でメッセージのやり取りを続けさせた結果、AIチャットボットの方が「悪用可能な信頼関係」を築く...
OpenAI、ウィキ事件後にミスアラインメントインシデント報告フレームワークを計画 – Unite.AI
OpenAIは2026年9月5日、トレーニング、評価、デプロイ時に表面化するミスアラインメントインシデントをいつ、どのように報告するかのフレームワークを開発中であると発表しました。この取り組みは、同社...
OpenAI Astraは危険なサイバー要求を91.5%拒否、代償は摩擦 – quasa.io
OpenAIは2026年9月1日、Astraの拒否率91.5%と限定提供を公表。安全策が正当な防御作業も止め得る摩擦を検証する。
自律型AIエージェントにおける制御逸脱の実態と多層防御ガバナンスアーキテクチャ – note
1. 生成モデルから自律的実行主体への転換に伴うリスク構造の変化 人工知能(AI)の技術的パラダイムは、プロンプトに対して自然言語を静的に返却する従来の単方向モデルから、環境の認識、多段階の計画立案...
AIチャットボットに登山計画を丸投げした一行、あえなく遭難。水も食料も必要量持たず、翌朝救助 – Gadget Gate
カリフォルニア州に住む3人の若者が、いずれも登山初心者であるにもかかわらず、同州北部にある標高4321.8mのシャスタ山への日帰り登山を敢行し、遭難した。若者たちは、登山の計画立案をGoogleのAI...
AIエージェントが機器を安全に操作するには? Anthropicが示した枠組み – wired.jp
AIによる科学研究や製造業の自動化には大きな可能性がある。そこでAnthropicは事故や悪用を防ぐルールの整備を目指し、AIエージェントに科学機器やロボットを安全に操作させるための新たな枠組みを発表...
OpenAIのAstraリークが示す「闇の中で思考するモデル」の危険性、ネイサン・ラベンツ氏が警鐘 – BigGo ファイナンス
OpenAIの次世代モデル「Astra」は、内部推論を安全監視者から隠蔽する「ループ型トランスフォーマー」アーキテクチャを採用すると報じられている。透明性を性能…
オープンAI次世代「アストラ」危険判定発売前に安全策強化 – CHOSUNBIZ – Chosunbiz
オープンAI次世代「アストラ」危険判定発売前に安全策強化 オープンAI、社内評価で「危険」判定のアストラを巡り高度機能の一般公開を制限し、安全装置と訓練を追加 オープンAIは1日(現地時間)、発売を控...
Anthropic、Claude Fable 5.1 と Claude Mythos 5.1 を分割セーフガードで発表 – Unite.AI
Anthropicは発表しましたClaude Fable 5.1 と Claude Mythos 5.1 を2026年9月1日に。これら2つは同一基盤モデルの構成で、セーフガードのレベルが異なります。...
AI開発者が警告する「第2のマンハッタン計画」、制御不能なAGIの脅威 – Forbes JAPAN
1939年、物理学者のレオ・シラードとアルベルト・アインシュタインはフランクリン・ルーズベルト大統領に書簡を送り、ドイツの核開発計画が成果を上げる前に、米国政府が核兵器開発計画を推進するよう促した。そ...
「仲間のため」と暴走?OpenAIのAI 1200体結託が突きつけるセキュリティの転換点(Masumi|ライター) – エキスパート – Yahoo!ニュース
米OpenAIが開発中の次世代AIモデルが隔離環境を抜け出し、外部システムへサイバー攻撃を仕掛けていた問題で、極めて衝撃的な実態が判明した。約1,200体ものAIエージェントが社内システムを「掲示板」
Anthropic、Claudeエージェントが10件のアラインメント失敗を緩和したことを報告 – Unite.AI
Anthropicは2026年8月28日に研究を発表し、Claudeモデル上に構築されたAIエージェントが自律的にトレーニング手法を開発し、対象モデルにおける10の一般的なアラインメント失敗を緩和した...
OpenAIのAI隔離突破、8月26日報告が示した見逃し – quasa.io
OpenAIは2026年8月26日、内部評価のAIが隔離を回避し、同社とHugging Faceのシステムを侵害した経緯と対策を公表した。
OpenAIの暴走AI、1200体が結託 「仲間のため」とシステム特攻要求 – 日本経済新聞
【シリコンバレー=伴正春】米オープンAIで開発中の人工知能(AI)がサイバー攻撃をした問題で、約1200体のAIが連携して指示役、偵察役などを分担していたことがわかった。失敗リスクが高い作業でも、AI...
韓国のLG Electronicsイム・ヒョジュン氏「AI攻撃は爆弾…エージェントの誤作動は取り返しがつかない」 – BigGo ファイナンス
韓国のLG Electronicsのイム・ヒョジュン次世代コンピューティング研究所長が26日、Smart Cloud Show 2026の基調講演でAI時代のセキュリティ脅威に警鐘を鳴らし…
わずか数分で「安全装置」を解除…… AIが爆弾・生物兵器の知識を授ける時代に専門家が緊急警告 – tocana.jp
市販AIチャットボットの安全装置は数分で解除可能に。研究機関の報告書は、無検閲化されたAIが爆発物や化学・生物兵器の知識を一般人にも与えかねないと警告する。家庭のパソコンで動作するため当局の監視も及ば...
暗号化されたプロンプトでGrokやGeminiの安全策を回避する手法について研究者が報告 – 株式会社マキナレコード
セキュリティ企業Adversa AIが「暗号化コンテキスト注入(Cryptographic Context Injection)」と呼ばれる攻撃手法を発見した。この手法では、xAI GrokやGoog...
優秀なAIでも「ファイル破壊」は防げない? Dockerが説く「モデルの性能」より重要なこと – ITmedia
Dockerは、AIエージェントの仕組みと安全に運用するための条件を解説した。自律的に動くAIエージェントは誤作動時の被害範囲が広がることから、モデルの性能よりもインフラ環境が重要だと指摘する。
研究:フロンティアAIラボは暴走モデルを抑制する計画がほとんどないことが判明 – Unite.AI
最先端AI企業のうち5社は、少なくとも自社AIシステムの制御に必要な基本的な実践を部分的にしか実装しておらず、操作側に逆らうモデルを抑制する完全な計画を公表した企業はありません。これは、Guideli...
アレクサンダー・ウィスナー=グロス氏、OpenAIの「安全のための一時停止」は保護ではなくマーケティングと指摘 – BigGo ファイナンス
2026年8月中旬、AI業界はサム・アルトマン氏が、不正なモデルがサンドボックスから脱出してHugging Faceを攻撃した後、OpenAIがフロンティア強化学習トレーニン…
8月27日(木)開催『“見えない命令”でAIが騙される!? – ニコニコニュース
株式会社VLCセキュリティ(東京都港区、代表取締役社長兼CEO 石原 紀彦)は、サイバーセキュリティに関する啓発活動の一環として、刻々と変化するサイバー情勢の最新情報を提供する目的で、『徹底生解説シリ...
8月27日(木)開催『“見えない命令”でAIが騙される!? – ニコニコニュース
株式会社VLCセキュリティ(東京都港区、代表取締役社長兼CEO 石原 紀彦)は、サイバーセキュリティに関する啓発活動の一環として、刻々と変化するサイバー情勢の最新情報を提供する目的で、『徹底生解説シリ...
OpenAIがゼロデータ保持を維持したまま安全性監視を強化する「Private Safety Processing」のプレビュー版を提供開始 – GIGAZINE
現地時間の2026年8月19日、OpenAIがユーザーが入力したプロンプトもAIによる応答も保持しないという「Zero Data Retention(ZDR:ゼロデータ保持)」方針を維持しながら、安全...
AIの医療アドバイスは危険? 検証で半数のケースに問題回答 「不必要な危害」へ導く恐れも – Excite エキサイト
医療情報を得るためにAIチャットボットを使う人が増える一方で、回答の正確性には大きな課題があることが研究で示された。主要5種類のAIを検証したところ、半数で問題のある回答が確認され、誤情報や危険な助言...
Citadel AIがNEDOと共同で生成AIの安全性確保に向けた新しいガイドラインを発表 – ニュースメディアVOIX
Citadel AI、AI安全性確保に関する研究開発の成果を発表 株式会社Citadel AIは、国立研究開発法人新エネルギー・産業技術総合開発機構(NEDO)の委託を受け、AIの安全性確保に向けた研...
株式会社Elithが生成AIの実務活用と安全性に特化したメディア「AIセーフティ REPORT」を公開 – ニュースメディアVOIX
株式会社Elithが生成AIの実務活用メディアを公開 株式会社Elithは、生成AIの実務活用と安全性に関する知見を発信するオウンドメディア「AIセーフティ REPORT by Elith」を公開しま...
AI開発環境の安全性担保 GMO、プリファードと新会社 – 日本経済新聞
GMOインターネットグループは人工知能(AI)開発のプリファードネットワークス(PFN、東京・千代田)と新会社を設立する。セキュリティーを担保したAIの開発環境を提供する。同時に資本業務提携も結び、
AI安全性の産業化が必要な理由──OpenAIとAnthropicの明暗が示すもの – Forbes JAPAN
シリコンバレーの倫理的野心と国防総省の国家安全保障上の要請が衝突し、テック業界に衝撃が走った。OpenAIが国防総省との契約を獲得した一方、Anthropicは「憲法的」ガードレールの緩和を拒否したこ...
AI Agent Index調査:主要AIエージェント30種中、安全性文書を公開しているのはわずか4種——ケンブリッジ大学主導の研究が「透明性の格差」を指摘 – innovaTopia
University of Cambridgeが主導するAI Agent Indexが主要AIエージェント30種を調査。エージェント固有の安全性文書を公開しているのはChatGPT AgentやCla...
拡大するLLM学習の「蒸留」論点──OpenAIは米議会に警告、Googleは抽出攻撃を報告 – Ledge.ai
AI・人工知能関連のニュースやトレンドを高頻度で配信!最新ニュースやインタビュー、イベントレポートなどAIに関するさまざまな情報を独自の切り口で掲載
遠隔から信頼性検証する「リモートアテステーション」、AI活用を安全に – 日経クロステック
リモートアテステーションとは、外部のクラウドサービスにあるプログラムなどの実行環境が改ざんされておらず信頼できる状態にあることをネットワーク越しに検証できる仕組みを指す。
生成AI「Safe AI Gateway」に Web検索機能を追加 – PR TIMES
株式会社ソフトクリエイトのプレスリリース(2026年1月22日 11時00分)生成AI「Safe AI Gateway」に Web検索機能を追加
AIエージェントがAIを構築し始めるとき:誰も備えていない再帰的知能の爆発 – Unite.AI
数十年にわたり、人工知能は慎重に、そして概ね直線的に進歩してきました。研究者はモデルを構築し、エンジニアはパフォーマンスを向上させ、組織は特定のタスクを自動化するシステムを導入しました。それぞれの改善...
Anthropic Claude 4.5の「Soul Doc」流出が示す、AI人格設計と安全性 – innovaTopia
Anthropic Claude 4.5「Soul Doc」リークはAIがどのような“性格”と倫理観を埋め込まれているかを示す資料である。安全性と有用性の優先順位、operatorとuserの関係、f...
詩的なプロンプトがAIの安全フィルターを回避、ChatGPTや他のチャットボットの重大な脆弱性が明らかに – biggo.jp
倫理的保護機能を備えて設計された人工知能システムが、予期しない攻撃経路に対して脆弱であることが証明された。それは「詩」である。最近の研究により、危険な要求を単に詩の形で表現するだけで、主要なAIプラッ...
AIのパイオニアたちがVinFuture 2025トークで倫理と安全性について議論 – Vietnam.vn
人工知能(AI)の台頭は歴史的な転換点を生み出しており、各国はテクノロジーの倫理、安全性、責任に関する前例のない疑問に答えることを迫られています。AI システムがより強力になり、より高速になり、より自...
AdobeがGoogleやOpenAIと連係 広がるAIエコノミーで安全性をどう保つ – 日経クロストレンド
米Adobeは2025年10月28日、米Googleの「Gemini」など他社のAIモデルとの連携機能を発表した。これまでは独自の描画AIを提供してきたが、他社AIを取り込むことで、同社ツールを利用す...
Qlean Dataset、「AIの性能と安全性を両立するAIデータ戦略ウェビナー」に登壇決定 – 品川経済新聞
品川経済新聞は、広域品川圏のビジネス&カルチャーニュースをお届けするニュースサイトです。イベントや展覧会・ライブなどのカルチャー情報はもちろん、ニューオープンの店舗情報から地元企業やソーシャルビジネス...
AI安全性テストで数百の脆弱性発見、専門家が現行手法の限界を指摘 – oneword.co.jp
AI安全性テストで数百の脆弱性が発見され、現行手法の有効性に疑問 AIエージェントの普及により新たなセキュリテ
「GENIAC-PRIZE」生成AIの安全性に関わるトライアル審査の受賞者が決定しました (2025年10月10日) – Excite エキサイト
生成AIの安全性確保に向けたリスク探索およびリスク低減技術の開発を促進経済産業省とNEDOは、NEDO懸賞金活用型プログラム「GENIAC-PRIZE」の3領域の一つである「生成AIの安全性確保に向け...
(プレスリリース)「GENIAC-PRIZE」生成AIの安全性に関わるトライアル審査の受賞者が決定しました – ニフティニュース
生成AIの安全性確保に向けたリスク探索およびリスク低減技術の開発を促進 経済産業省とNEDOは、NEDO懸賞金活用型プログラム「GENIAC-PRIZE」の3領域の一つである「生成AIの安全性確保に向...
(プレスリリース)「GENIAC-PRIZE」生成AIの安全性に関わるトライアル審査の受賞者が決定しました – ニフティニュース
生成AIの安全性確保に向けたリスク探索およびリスク低減技術の開発を促進 経済産業省とNEDOは、NEDO懸賞金活用型プログラム「GENIAC-PRIZE」の3領域の一つである「生成AIの安全性確保に向...
生成AIの安全性と信頼性を高める研究を推進 シンガポール南洋理工大学 – Science Portal Asia Pacific
ASEANの科学技術に関する日本語ポータルサイトです。ASEANの科学技術ニュース、専門家等による科学技術分野の現状や研究動向などのコラム、独自調査を含む調査報告など様々な最新情報を提供しています。
茂木健一郎脳科学者「AI安全性も顧客創造も“人間をループに入れる”ことが本質」 – ライブドアニュース
脳科学者・茂木健一郎氏が、自身のYouTubeチャンネルで「人工知能に対して、人間をループにいれることの意味」と題した動画を公開。動画内で茂木氏は、AIの進化が著しい現代において「キープヒ
OpenAI、10代向けChatGPT安全機能を強化:訴訟受け緊急連絡先システム導入予定 – innovaTopia
16歳のアダム・レイン君の自殺にChatGPTが関与したとして両親がOpenAIを提訴した事件を受け、同社が保護者制御機能と緊急連絡先システムの導入を発表。訴状によると、ChatGPTは自殺方法を提案...
進化する生成AI、暴走のリスクは?識者が解説「AIは自分が停止しないことが最重要」「手段として使えるなら人を騙すこともする」業界トップ研究者も危険性を発信 – ABEMA TIMES
アメリカ・OpenAIは7日、生成AI「ChatGPT」の最新モデル「GPT-5」を発表した。これまでのモデルよりも正確性が向上し、回答のスピードもアップ。特に誤った情報を返してしまうハルシネーション...
AIの安全性問題、どう解決するか | WSJ PickUp – ダイヤモンド・オンライン
xAIの「グロック」が暴力的で反ユダヤ主義的な投稿をする原因となった脆弱性は対処可能な問題だが、それは人々がそうしたいと望んだ場合に限られる。
AIの安全性問題、どう解決するか | The Wall Street Journal発 – ダイヤモンド・オンライン
米AI(人工知能)スタートアップ、xAIのAIチャットボット「Grok(グロック)」が暴力的で反ユダヤ主義的な投稿をする原因となった脆弱(ぜいじゃく)性は、対処可能な問題だが、それは人々がそうしたいと...
脳科学者・茂木健一郎氏の考察:AI安全性と身体性の関連性とは? – ライブドアニュース
脳科学者の茂木健一郎氏が、「人工知能の『シンギュラリティ』と、『身体性』」と題した動画で、AIの指数関数的な成長とその限界について深く掘り下げた。茂木氏は、近年注目されているシンギュラリティの概念につ...
米欧中のAI戦略シフトの中で、セーフティとセキュリティのバランスをどう見極めるのか? (1/3) – EnterpriseZine
2025年3月7日に開催されたAIガバナンス協会(AIGA)主催のMeetupでは、AIの急速な発展に伴う課題と今後の展望について、業界をリードする専門家たちによる2部構成のパネルディスカッションが行...
2025年4月16日(水)ウェビナー開催のお知らせ「AIの安全性を探る、2025年SXSWからの洞察」 – 時事通信ニュース
[株式会社アマナ]2025年4月16日 12:00開催コミュニケーション変革をクリエイティブで実現する株式会社アマナ(本社:東京都品川区、代表取締役社長:金子剛章、以下「アマナ」)は、2025年4月1...
2025年4月16日(水)ウェビナー開催のお知らせ「AIの安全性を探る、2025年SXSWからの洞察」 – BIGLOBEニュース
2025年4月16日12:00開催コミュニケーション変革をクリエイティブで実現する株式会社アマナ(本社:東京都品川区、代表取締役社長:金子剛章、以下「アマナ」)は、2025年…|BIGLOBEニュース
2025年4月16日(水)ウェビナー開催のお知らせ「AIの安全性を探る、2025年SXSWからの洞察」 – PR TIMES
株式会社アマナのプレスリリース(2025年3月28日 10時00分)2025年4月16日(水)ウェビナー開催のお知らせ「AIの安全性を探る、2025年SXSWからの洞察」
DeepSeek偽広告に警戒!Google検索で拡散するAIブランドを装ったマルウェア攻撃の実態 – innovaTopia
2025年3月26日、マルウェア対策企業Malwarebytesの研究者が、Google検索結果に偽のDeep
政府、AI法案を閣議決定 – あべの経済新聞
あべの経済新聞は、広域あべの圏のビジネス&カルチャーニュースをお届けするニュースサイトです。イベントや展覧会・ライブなどのカルチャー情報はもちろん、ニューオープンの店舗情報から地元企業やソーシャルビジ...
【そもそも解説】AIにはどんなリスク? 新たな法案で対応可能か – 朝日新聞
AI法案が閣議決定されました。AI技術の進歩は急速に進んでおり、私たちの暮らしは便利になる一方、社会に様々なひずみも生んでいます。 Q 人工知能(AI)にはどんなリスクがあるのか。 A AIは大量の…
生成AIのルールづくり「広島AIプロセス」賛同する国・地域が都内で初の対面会合(2025年2月27日) – BIGLOBEニュース
生成AIのルールづくりにむけた枠組み「広島AIプロセス」の趣旨に賛同するおよそ40の国と地域が初めての対面会合を都内で開きました。「広島AIプロセス」は、生成AIのルールづく…|BIGLOBEニュース
NTTコミュニケーションズ、生成AIの回答精度、安全性を向上 二つの要素技術を発表 – 週刊BCN+
NTTコミュニケーションズは、生成AIの回答精度を高める「rokadoc」と、コンプライアンスや情報漏えいを防ぐ「chakoshi」の二つの要素技術を2月19日に発表した。
NTTコミュニケーションズ、生成AIの回答精度、安全性を向上 二つの要素技術を発表 – 週刊BCN+
NTTコミュニケーションズは、生成AIの回答精度を高める「rokadoc」と、コンプライアンスや情報漏えいを防ぐ「chakoshi」の二つの要素技術を2月19日に発表した。
生成AIのルール作りへ 各国担当者が対面で初会合 – nhk.or.jp
【NHK】生成AIの活用の推進と共通のルール作りを議論する「広島AIプロセス・フレンズグループ」の初めての対面での会合が27日から…
企業・団体向け生成AI「Safe AI Gateway」高機能を抑えた費用で利用できるマルチテナントプランを提供開始(2025年2月26日) – BIGLOBEニュース
株式会社ソフトクリエイト(本社:東京都渋谷区/代表取締役社長:林宗治、以下ソフトクリエイト)は、企業・団体向け生成AIサービス「SafeAIGateway」に、新たに「マルチ…|BIGLOBEニュース
ゼロからLLMプロンプトエンジニアリング 第3回 安全にDeepSeek R1を使うには? – LM Studioで試してみよう – BIGLOBEニュース
鮮烈なChatGPTの登場から2年以上経ち、高額な開発費を投入して作られた生成AIを手軽にローカルPCで動かせる時代になりました。先日、話題になった中国製のAI「DeepSe…|BIGLOBEニュース
NTT Comが生成AIを安全に使うガードレール技術「chakoshi」開発、パブリックβ公開 – goo.ne.jp
入出力テキストの安全性を判定する技術、日本語に強い判別性能を備えることが特長ドコモグループの法人事業ブランド「ドコモビジネス」を展開するNTTコミュニケーションズ(...
AIチャットボットのリスクに適切に対処する方法 支援するタスクを4分類して取り組む | テクノロジー – DIAMOND ハーバード・ビジネス・レビュー
2022年、オープンAIのチャットGPT公開に対抗してグーグルがバード(現ジェミニ)を発表したが、誤答によりアルファベットの株価が9%下落した。また、2023年にはチャットGPTが生成した架空の情報…







































































