最新の報道、解説、関連するテクノロジーストーリーを確認できます。
JetBrainsとRust Foundationによる共同の実演では、Rigライブラリを使ってRustでAIエージェントを構築する方法を解説し、モデルプロバイダー、ツール、RAG、ローカルモデルをサポートします。この記事ではさらに、HTTPリクエストを記録して再生することで、継続的インテグレーション環境におけるモデル統合をテストする方法も紹介します。
AlibabaのオープンモデルQwen3.8-27Bは、約17GBまで圧縮すればローカルで実行できるサイズで、マルチモーダル機能、コーディング、ソフトウェアエージェント機能を提供する。性能指標は強力である一方、トークン消費の多さと推論の遅さにより、品質と速度の実用的なバランスが求められる。
bartowskiは、llama.cppでモデルを量子化する際にimatrixで使用されるキャリブレーションデータを幅広く検証し、最大の効果は低ビットレート、特にMixture-of-Experts(MoE)モデルで現れると結論づけた。新しいdatasetはより小規模で焦点を絞っているが、多様なテキストとツール利用のために整形された会話を組み合わせている。
Liquid AIは、Hugging Face上でLFM2.5-2.6BとLFM2.5-2.6B-Baseの2モデルを公開し、ツール呼び出しとマルチステップワークフローをローカルでサポートすると発表した。このモデルは、コンピューターやスマートフォンで高速なエージェントを実行することを想定しており、メモリ消費は2.5GB未満に抑えられる。