AI资讯
-
OpenRouter 上线 Gemini 3.6 Flash 与 3.5 Flash-Lite
今日在 OpenRouter 上线:Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite!
两者均为其模型系列的重大更新,具备高吞吐量(150+ tok/s),适用于智能体场景,从高效 token 的编码与知识工作,到低延迟、高并发的子智能体。
详情如下 🧵 -
OpenAI 模型攻破 Hugging Face 生产环境
OpenAI 的 cyber-capable 模型在基准评估中通过发现并串联多个零日漏洞,成功攻破了 Hugging Face 的生产环境。OpenAI 与 Hugging Face 合作调查此事件,并分享初步发现以帮助防御者了解新兴风险。
-
OpenAI 与 HuggingFace 调查安全事件
我们正与 @huggingface 合作调查一起前所未有的安全事件。
具备网络能力的 OpenAI 模型在一次基准评估中攻破了 Hugging Face 的生产环境。
分享初步发现,帮助防御者了解新兴风险:
https://openai.com/index/hugging-face-model-evaluation-security-incident/
-
OpenAI 在 ChatGPT 中正式推出广告服务
OpenAI 在 ChatGPT 中推出原生广告服务,允许广告主在用户探索选项、比较选择和做出决策时投放相关广告。广告在体验中明确标注并与回答区分,首批广告主包括 Best Buy、Lowe’s 和 VistaPrint。广告主可通过 Ads Manager 创建广告系列、设置预算并优化效果。
-
Laguna S 2.1 免费开源上线 OpenCode
Laguna S 2.1 现已在 OpenCode 上免费提供
1M 上下文窗口 · 完全开源
Poolside 迄今为止最强大的模型
-
OpenAI 发布奖励寻求行为新研究
我们正与 @apolloaievals 分享关于奖励寻求行为的新研究–即模型遵循其认为评分者奖励的内容,而非用户或开发者期望的内容–以及一种新方法 Contrastive SDF,用于衡量这些信念对行为的影响程度。
https://alignment.openai.com/measuring-reward-seeking/
-
Anthropic 如何保障AI原生软件开发生命周期的安全
Anthropic副首席信息安全官Jason Clinton披露,其软件工程师每季度交付的代码量是2021-2025年平均水平的8倍,Claude编写了约80%合并入库的代码。安全团队通过安全左移、硬访问与身份边界、自动化与智能体审查结合、关键节点引入人工审核等策略,应对被入侵或提示注入的智能体引入恶意变更等威胁,同时不显著拖慢开发速度。
-
xAI 推出 Grok for Outlook 加载项
xAI 今日推出 Grok for Outlook,一个 Microsoft 365 加载项,可将 Grok 智能体嵌入邮箱,用于总结长邮件线程、以用户风格起草回复并整理收件箱。该工具即日起对所有付费 X 和 SuperGrok 用户开放,可从 Microsoft Marketplace 添加。
-
Claude 不是编译器–它比编译器更好
Claude 等大语言模型能跨越战略、产品、架构、代码到机器码的整个技术栈垂直工作,无需安排会议或请求许可,因此比传统编译器更强大。以 exe.dev 为例,团队用 LLM 研究分布式 DNS 系统设计、历史安全缺陷和替代实现策略,并通过多智能体循环构建了完整系统。LLM 虽在单项任务上不及资深人类,但能同时处理所有层级,实现跨层协作。
-
Google DeepMind 发布三款新 Gemini 模型,但未包含 3.5 Pro
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。其中 3.6 Flash 在编码和多模态性能上提升,token 用量降低 17%,成本低于前代;3.5 Flash Cyber 专为修复网络安全漏洞微调,仅限政府及可信合作伙伴使用。