#オープンモデル
このタグが付いた記事
Index
count=4- AI / ML
Aleph Alpha、78B の MoE オープンモデル『Kolibri』公開
ドイツの Aleph Alpha が、総パラメータ 78B・アクティブ 3.46B の MoE モデル『Kolibri』を Apache 2.0 で公開しました。独英対応・1M トークンのコンテキスト長・推論モードを備え、公共・産業向けの主権 AI 用途を狙います。
- AI / ML
ELYZA、国産 LLM-jp-4 ベースの推論モデルを商用利用可で無料公開
KDDI 傘下の ELYZA が、国立情報学研究所主導の LLM-jp-4 を基盤にした推論特化モデル「ELYZA-Thinking-1.0-llm-jp-4-33b」と MoE 版の 32b-a3b を無料公開しました。日本語と英語の推論性能を強化し、商用利用も可能です。
- セキュリティ
Anthropic、GLM-5.3の攻撃能力と防護の弱さを警告
Anthropic の Frontier Red Team は 9 月 29 日、Zhipu AI のオープンウェイトモデル GLM-5.3 が自律的な攻撃コード生成能力を持ち、簡易な手口で安全対策を 64〜100% の確率で回避できると報告しました。研究者はブラウザ経由の情報窃取攻撃を 1 日以内に構築できたとしています。
- AI / ML
StepFun、600B MoE の Step 5 Preview を公開 オープンウェイトは 10 月 15 日
中国の StepFun が 9 月 20 日、総パラメータ 600B / アクティブ 27B の疎な MoE フラッグシップ「Step 5 Preview」を公開しました。1M トークン文脈と入力 $1 / 出力 $2.70(1M 当たり)の API 提供が同日開始され、フルウェイトは 10 月 15 日にオープンリリース予定と告知しています。