🤖 AI Agent 资讯聚合

更新时间: 2026-08-26 06:20 (Asia/Shanghai) | 共 5 条
OpenAI

Jalapeño 自研推理芯片首次实测:业界领先的 AI 推理速度与效率

OpenAI 首款自研推理芯片 Jalapeño 测试结果公布,在 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 上实现 1.5-1.9 倍能效提升和 1.7-3.6 倍延迟降低,特别适合需要多步骤顺序执行的智能体场景。
阅读全文 →
Hugging Face / IBM Research

智能体需要多少记忆?ALTK-Evolve 揭示模型能力与记忆剂量的关系

研究发现智能体记忆并非简单开关,而是需根据模型能力校准剂量:强模型适合完整指导集,弱模型需紧凑核心加任务检索,饱和模型则无显著收益。gpt-oss-120b 以仅 5% 额外 tokens 提升 16.1% 任务完成率。
阅读全文 →
Meta / Hugging Face

Muse Glimmer: Meta 开源本地多模态智能体模型

Meta 发布 Muse Glimmer-30B,30B 参数多模态模型专为本地智能体场景优化,Apache 2.0 许可。在 MCP Atlas、WildClawBench 等智能体基准上表现优异,适合隐私敏感的编码、文档分析、个人助手等应用。
阅读全文 →
NVIDIA / Hugging Face

NVIDIA Magpie TTS: 构建低延迟多语言语音智能体

NVIDIA 发布开源多语言 TTS 模型,支持 12 种语言包括阿拉伯语、韩语、葡萄牙语。提供开放权重和 NIM 部署,适合客户支持、医疗助手、企业副驾驶等多语言语音智能体场景,可在自有基础设施上优化延迟。
阅读全文 →
OpenAI / AWS

GPT-5.6 登陆 Kiro:提升开发者编码性价比

GPT-5.6 模型家族(Sol、Terra、Luna)现已在 Kiro 软件开发智能体平台上线。测试显示 GPT-5.6 Terra 在 Terminal-Bench 2.1 上实现约 82% 成本降低,通过规范驱动方法帮助团队更高效地规划、构建、审查和测试代码。
阅读全文 →