の検索結果 Claude Opus 4.6
AI & Enterprise
Xiaomi、AIエージェント向けハーネス自動最適化基盤「HarnessX」を公開
Xiaomiの研究チームは、AIエージェントのハーネスを自動的に改良するフレームワーク「HarnessX」を公開した。15のモデル・ベンチマークの組み合わせで検証し、平均14.5%の性能改善を確認した。
Crypto
Anthropic、AI「Mythos」で高リスク脆弱性1万件超を検出
Anthropicは、AIモデル「Mythos Preview」を活用した「Glasswing」で、1か月で高リスクまたは致命的な脆弱性を1万件超検出したと発表した。AIによる大量発見が進む中、検証や開示、パッチ配布の遅れが新たなリスクになると警鐘を鳴らした。
AI & Enterprise
Cerebras、企業向けKimi K2.6推論サービス開始 毎秒981トークン
Cerebrasは、オープンウエイトモデル「Kimi K2.6」の企業向け推論サービスを開始した。Artificial Analysisの測定では毎秒981トークンを記録し、1万トークン入力時の応答完了は5.6秒と、公式エンドポイントを大きく上回った。
-
AI & Enterprise
DeepSeek V4 Pro、中国勢最高水準も米最新モデルに約8カ月差 CAISI評価
-
AI & Enterprise
Meta、個人向けAIエージェント「Hatch」開発 Instagram連携の購入支援も
-
AI & Enterprise
AIエージェントが9秒で本番DB削除 PocketOS創業者が事故の経緯公表
-
AI & Enterprise
DeepSeek、新AI「V4」プレビュー版公開 低価格も訴求
-
AI & Enterprise
AWS、Bedrock AgentCoreに「Managed Agent Harness」 本番運用基盤の構築を自動化
-
AI & Enterprise
Moonshot AI、オープンソースLLM「Kimi-K2.6」公開 ベンチマークでGPT-5.4とClaude Opus 4.6超えを主張
-
AI & Enterprise
Anthropic「Claude Mythos」で警戒強まる AIセキュリティ体制見直しへ
-
AI & Enterprise
Anthropic、「Claude Opus 4.7」発表 高難度コーディング性能を強化
-
AI & Enterprise
Anthropicの「Claude Mythos Preview」、英国のAISI評価で専門家向け攻撃課題の正答率73%
-
AI & Enterprise
Google、オープンソースAIモデル「Gemma 4」公開 Apache 2.0採用で商用利用しやすく
-
AI & Enterprise
AI高度化でセキュリティ需要は縮小せず、拡大 Boldstart創業者が指摘
-
AI & Enterprise
OpenAIとAnthropic、AIエージェントの自動化競争が加速
-
AI & Enterprise
Anthropic新モデル報道で米サイバーセキュリティ株下落
-
AI & Enterprise
Anthropic、新型AIを一部顧客に試験提供 未公開文書で判明
-
AI & Enterprise
AIによる依存関係更新提案、28%が幻覚 脆弱性放置の恐れ