我们把全球 AI 前沿资讯编译成给中国企业主看的中文洞察——每条都标注来源、可查原文。看别人怎么用,想清楚自己怎么做。
思科基金会AI团队开源Antares系列安全小语言模型(350M/1B参数),专用于将CVE等外部漏洞描述精准定位至代码库中的具体文件。模型基于IBM Granite 4.0微调,采用工具调用型智能体架构,在新发布的VLoc Bench基准上表现优于同规模通用大模型及主流静态分析工具。
Poolside公司正式发布1180亿参数开源Agentic编码模型Laguna S 2.1,采用MoE架构(每token激活约80亿参数),支持100万token上下文,在SWE-Bench多语言基准测试中以78.5%准确率登顶公开模型榜首。模型权重已开放下载,可在单台NVIDIA DGX Spark上部署运行。
谷歌正式推出Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber三款新型号,全部归属‘Flash’系列,聚焦速度、成本与高并发智能体任务,而非深度推理。新模型在多项基准测试中显著提升token效率、降低延迟与价格,并强化安全防护。其中Flash Cyber专用于代码漏洞识别与修复,已在内部安全评估中超越主流大模型。
Anthropic推出Claude Cowork桌面应用新功能:用户可边执行任务边录制屏幕,同步添加语音解说,系统将自动将其转化为可重复调用的AI技能。该能力无需编程,旨在降低自动化工作流构建门槛。
谷歌推出Gemini 3.6 Flash、3.5 Flash-Lite及受限版3.5 Flash Cyber三款新模型,专为降低企业级AI智能体的token消耗与推理延迟。其中3.6 Flash在多项基准测试中输出token减少17%–65%,推理成功率显著提升;Flash-Lite主打高吞吐文档处理;Flash Cyber则面向安全团队提供代码漏洞修复能力,仅限政府及认证合作伙伴试用。