科学论文图片质量自动评估 为什么要看完整论文
SciFigQual-Bench 提出科学图像质量评估不能脱离全文语境
SciFigQual-Bench 提出科学图像质量评估不能脱离全文语境
Dependabot 新增分组更新机制和三天等待期,安全更新独立触发
MemSecBench 基准测试揭示代理记忆系统的安全漏洞,84.2%的恶意内容可持久化
OmegaUse-OfficeVal 基准测试评估了LLM代理在办公任务中的经济性与质量表现
NVIDIA发起开放安全AI联盟,推动AI安全工具共享。闭源安全方案有结构性缺陷,开放协作是更务实的路线。
Google Cloud发布网络安全快照报告:多数入侵源于人为失误,工具堆叠不能替代架构韧性和响应速度。
FastAPI新提交的OpenAPI依赖基准测试揭示了大型项目的性能隐患,依赖链深度影响开发体验。
Anthropic与Cognizant扩展合作,将Claude嵌入企业级开发运维体系。背后是3万人培训规模和制造业场景落地,真正的门槛不在模型能力而在系统集成。
SK集团与NVIDIA宣布超5000亿美元合作计划,涵盖2GW的Vera Rubin DSX AI工厂和下一代HBM内存。
NVIDIA在韩国连落三子:首尔国立大学AI中心、NAVER/Brookfield合建AI工厂、与SK的5000亿美元合作。
OpenAI推出ChatGPT Work登录网站功能,用户只需登录一次,AI即可在登录状态下持续执行任务。
Google Cloud 通过 Apigee AI Gateway 统一管理大模型 API 流量,实现鉴权、限流、监控和 MCP 集成
Google Cloud 推出 Prompts-as-Code 架构,将系统提示词拆分为模块化 skill 文件,引入 CI/CD 管理和构建时校验
Google Cloud 推出 Cloud Run 沙箱功能,可在 serverless 环境中安全运行 AI 生成的代码
VS Code 1.130 引入 Agent Host 架构和 AI 工具审批机制,编辑器正在从工具变为 AI 平台。
GPT-5.6 Sol 在网络安全演习中刷新纪录,Codex Security 插件开始实战应用,但AI安全工具能真正落地吗?
GitHub 重构漏洞赏金计划,设立VIP通道、固定奖金,向AI批量生成的垃圾报告说不。
Dependabot 引入三天冷却期应对供应链攻击,这个策略对开发者意味着什么?
Panasonic Automotive与Google Cloud合作,在C4A-metal Arm裸金属实例上运行vSkipGen数字孪生平台,彻底改变了汽车座舱软件的开发和验证方式。
NVIDIA在SIGGRAPH 2026上展示Agent AI与物理AI技术,GPU从图形加速器转型为物理世界模拟器的深度观察。
GitHub Sponsors累计筹款突破1亿美元,但开源生态的资金缺口仍然巨大。本文分析企业赞助模式与开源可持续发展的矛盾。
AWS为AI编程Agent推出了一键式Lambda配置,同时GPT-5.6已登陆Bedrock。Serverless开发与AI工具的深度集成正在改变开发者的工作方式。
2026年7月19日 AI科技新闻
2026年7月19日 AI科技新闻
IntelliJ IDEA 2026.2发布,支持Java 27和Kotlin 2.4,新增日志断点和原生Copilot集成,这次更新到底值不值得升级
Perplexity新模型配备内置顾问工具,可在需要时自动升级到更强的模型
IntelliJ IDEA 2026.2发布,支持Java 27和Kotlin 2.4,原生集成GitHub Copilot
Google推出Gemini Spark后台AI助手,AI从问答模式转向任务执行模式
Google Cloud发布多项新功能,Cloud Run沙箱、AI代理API治理、TPU加速等
NVIDIA Nemotron 3 Embed系列显示,嵌入模型的质量直接影响Agent推理成本,高质量检索可以显著减少下游token消耗。
Google Cloud团队通过Agent驱动架构,将基础模型升级从数月缩短到数小时。本文分析模型迁移为何是搜索问题而非执行问题。
Microsoft安全博客讨论AI Agent的最小权限原则,提出每个Agent应该拥有独立身份、基于任务的细粒度权限和工具白名单。
Hourglass Reasoning通过严格隔离推理阶段之间的信息流,显著提升大模型的归纳推理能力
NVIDIA Nemotron Labs发布开源模型,企业AI定制化路径正在改变
ToFu是一款面向研究人员的白盒Agent框架,高token效率、可观察可修改的编排逻辑
UMoE通过剪枝低相关专家和扰动式扩展,提升MoE模型在特定领域的微调效果
Clawk是一个开源工具,为AI编码Agent提供一次性的、网络受限的Linux虚拟机环境,解决Agent执行代码时的安全问题。
Zig语言创建者Andrew Kelley公开批评Anthropic的公开承诺与实际行为之间的差距,引发了对AI公司可信度的广泛讨论。
一个开源项目用现代Rust完全重写了Linux 0.11内核,包括标准库和60多个核心工具,在i386 QEMU中成功启动。
开发者对Apple新发布的SpeechAnalyzer API进行了详细基准测试,与Whisper和上一代API对比。系统级API在延迟和功耗上有明显优势,但准确率表现取决于使用场景。
微软开源Flint,一种AI驱动可视化的中间语言,让AI代理生成高质量图表不再需要繁琐的低层参数配置。
GitHub如何构建了一个自动化系统,强制为1.5万个仓库设置持久化所有者,包括两个值得注意的翻车事故。
GitHub将Copilot代码审查工具从专用系统切换到共享CLI工具后,审查效率反而下降——原因不是工具,是指令设计。
Anthropic发布Claude Science——面向科研人员的AI工作台,集成60多个科研工具、审查Agent和灵活的算力管理。
CNCF发布白皮书,分析AI工作负载在训练、推理和Agent三个阶段对数据存储的不同需求,以及传统存储架构的瓶颈。
Good Tools Are Invisible 引发的思考:开发工具最好的状态是让使用者感觉不到它的存在。
GPT-5.6 Sol Ultra 独立完成了 Cycle Double Cover Conjecture 的数学证明,这是一次从工具到协作者的角色转变。