日报快讯
2026-09-17 · 早报 · 11 条
-
Jetson AGX Thor 单机跑通 27B 模型 MLPerf 推理
单卡 52.33 tokens/s 完成 1007 轮负载,24 分 36 秒跑完全流程,比 llama.cpp 更快。NVIDIA Technical Blog:Agentic AI / Generative AI
-
Gemini Enterprise 上线 Agent 异常检测私测
用独立推理层异步审计智能体的工具调用与执行流,请求延迟零增加。Google Developers Blog(RSS)
-
OpenAI 发布模型未对齐追踪与披露框架,并公开六份历史报告
未完全解释或缓解的行为也按时间线公开,优先披露揭示新机制的案例。X:OpenAI (@OpenAI)
-
Anthropic 与 OpenAI 承诺引入驻场第三方安全评估
两家前沿 AI 公司同意让 METR 等独立评估方获得系统访问权。TechCrunch:AI(RSS)
-
Anthropic 将 Claude Cowork 与聊天合并为统一的 Claude
任务无需再选入口,Cowork 与 Design 能力可在任意对话中使用。Claude:Blog(网页)
-
SemiAnalysis 实测:Rubin NVL72 每瓦性能达 GB300 的 7 倍
Jensen 在 GTC 2026 仅承诺 3 倍能效提升,实测结果高出承诺逾一倍。X:SemiAnalysis (@SemiAnalysis_)
-
Mozilla 91页报告:开源权重模型落后前沿约4个月
开源模型占调用量20%却只拿约4%收入,闭源单次调用价格约为开源6倍。X:Rohan Paul (@rohanpaul_ai)
-
小米开源大模型MiMo-V2.6强化学习细节,单步处理2B tokens
每步2B tokens、1568 prompts×16 rollouts的全异步RL训练,投入已超100万美元。X:Elvis Saravia (@omarsar0, DAIR.AI)
-
小米公开 MiMo-V2.6 大规模强化学习训练细节
训练从计算、环境、评分三维度扩展RL,每步处理约2B tokens并全异步调度。X:Nathan Lambert (@natolambert)
-
Grok Build 新增记忆功能,跨会话保留项目约定与决策
记忆按项目分文件并附全局偏好,当轮对话指令优先于历史笔记。xAI:News(网页)
-
Transluce:嵌入式评估应聚焦四类模型行为
多智能体协同、定向说服、评估意识、隐藏推理被点名为高风险,试点方法同日公开。Transluce(网页)