关注最新报道、解读和相关科技故事。
JetBrains 与 Rust Foundation 的联合演示介绍了如何使用 Rig 库在 Rust 中构建人工智能代理,并支持模型提供商、工具、RAG 和本地模型。文章还重点介绍了通过记录 HTTP 请求并在持续集成环境中重放这些请求,来测试模型集成的方法。
阿里巴巴的开源模型 Qwen3.8-27B 提供多模态、编程和软件代理能力,压缩至约 17 GB 后可在本地运行。尽管性能指标强劲,但其较高的令牌消耗和推理速度较慢,要求在质量与速度之间进行实际权衡。
本文介绍了 bartowski 对 llama.cpp 量化模型所使用的 imatrix 校准数据进行的大规模改进实验,并得出结论:最大的收益出现在低比特率下,尤其是在混合专家(MoE)模型中。新的 dataset 更小、更集中,但结合了多样化文本和经过格式化的工具调用对话。
Liquid AI宣布在Hugging Face上提供LFM2.5-2.6B和LFM2.5-2.6B-Base模型,支持在本地调用工具和执行多步骤工作流。该模型旨在让计算机和手机运行快速智能体,内存占用低于2.5 GB。