用語

Prefill

最新の報道、解説、関連するテクノロジーストーリーを確認できます。

最新の報道

CN
JetBrains、クラウドやクレジットなしでMac上でJunieを完全ローカル実行可能に

JetBrains、クラウドやクレジットなしでMac上でJunieを完全ローカル実行可能に

JetBrainsは、Qwen3.6-27Bモデルを使用してMac上でプログラミングエージェントJunieをローカル実行するJunie Localを開始した。コードやプロンプトをクラウドに送信することなく利用できる。実行にはM5チップ搭載のMacと64ギガバイトのメモリが必要で、約20ギガバイトのダウンロードを要する。

CN
JetBrains كيف حسّنت تشغيل Qwen3.6 محلياً داخل وكيل Junie

JetBrains كيف حسّنت تشغيل Qwen3.6 محلياً داخل وكيل Junie

تشرح JetBrains التعديلات التي أجرتها على Junie ومحرك الاستدلال لتشغيل Qwen3.6-27B محلياً على أجهزة MacBook المزودة بشريحة M5. وتظهر التجربة أن أداء وكلاء البرمجة المحليين يعتمد على إدارة السياق ومرحلة prefill بقدر اعتماده على سرعة توليد الرموز.

CN
なぜ将来のAIコンピューティングは1種類のチップに依存しないのか?

なぜ将来のAIコンピューティングは1種類のチップに依存しないのか?

データセンターは、すべてのタスクを1台のGPUに依存するのではなく、CPU、GPU、NPU、専用アクセラレーター、光インターコネクトを組み合わせたヘテロジニアス・クラスターへと向かっている。この変化により、ソフトウェア、ネットワーク管理、電力が、トークンコストを削減し、ハードウェアの利用効率を高めるための決定的な要因となる。

CN
Jane StreetがEtchedのハードウェアをテストした後、Etchedの評価額が1か月で210億ドルに倍増

Jane StreetがEtchedのハードウェアをテストした後、Etchedの評価額が1か月で210億ドルに倍増

AIスタートアップのEtchedは、Jane Streetが同社から出荷された初の完全なAIシステムをテストし、自社のデータセンターで稼働させるために購入した後、評価額210億ドルで7億ドルを調達した。この資金調達は、AIモデルの推論を高速化し、コストを削減する同社の設計に対する賭けを反映している。

CN
エッジAIがLLMモデルへ移行する中、なぜNPUは再設計を必要とするのか

エッジAIがLLMモデルへ移行する中、なぜNPUは再設計を必要とするのか

Expederaのシャラド・チョールは、エッジデバイスが従来のビジョンネットワークからLLMやVLMへ移行することで、ボトルネックの性質が演算能力からメモリトラフィックへと変化していることを分析する。また、パケットベースの処理が外部データ転送を削減し、自動車や組み込み機器内でのモデル実行を改善する役割を紹介する。