Baseten正式加入Hugging Face推理服务提供商生态
Baseten作为新推理服务提供商正式接入Hugging Face Inference Providers,用户可直接通过HF Hub接口调用Baseten托管的模型推理服务,进一步丰富了HF的云端推理选择,部署更便捷。
Baseten作为新推理服务提供商正式接入Hugging Face Inference Providers,用户可直接通过HF Hub接口调用Baseten托管的模型推理服务,进一步丰富了HF的云端推理选择,部署更便捷。
Apple机器学习研究院发表论文,介绍Siri Expressive Voices使用的解耦时序深度扩散Transformer架构,在Apple Matrix Coprocessor的严格计算和内存预算内实现高保真音频合成,基于AFM 3 Core Advanced(Apple最强本地基础模型)。
Liquid AI在Hugging Face发布LFM2.5-2.6B,专为本地部署设计的小型智能体模型,使开发者能在边缘设备和本地环境中运行高效AI Agent,无需依赖云端API,兼顾隐私保护和低延迟。
Hugging Face博客深度探讨GPU利用率管理,将闲置GPU类比为停飞飞机(纯损耗无收益),呼吁AI团队重视GPU调度和资源利用率优化,系统性降低训练和推理的基础设施成本。
NVIDIA在Hugging Face发布Cosmos-H-Dreams,将实时生成式仿真技术引入外科机器人领域,可为手术机器人训练提供高质量合成数据和仿真环境,加速医疗机器人的开发迭代周期。
Hugging Face发布2026年7月安全事件的详细技术时间线,揭示一次利用AI Agent实施的复杂网络入侵攻击全过程。这是首次公开记录的Frontier Lab Agent Intrusion技术分析,对整个AI行业具有重要警示意义。
Hugging Face将Nunchaku的4-bit扩散模型推理方案集成进Diffusers库,用户可在显存受限环境下高效运行图像生成模型,同时保持较高生成质量。这是面向消费级显卡用户的重要优化。
Hugging Face官方博客发布2026年7月安全事件正式披露报告。作为全球最大AI模型托管平台,此次安全事件可能影响大量依赖HF服务的开发者和企业,用户应立即检查相关凭据。
IBM Research 在 Hugging Face 博客发文深入探讨模型路由的挑战,揭示在多模型系统中如何智能分配请求并非表面上那么简单,需要兼顾延迟、成本、能力等多维度权衡。
Hugging Face 推出 Real World VoiceEQ 评测框架,专门衡量语音 AI 的人类质量标准,填补了现有语音评估体系在真实世界场景下的空白。
Hugging Face 博客 PyTorch 性能分析系列第三篇,专注于 Attention 机制的性能分析方法,帮助开发者识别和优化模型推理中的性能瓶颈。
Hugging Face 官方博客介绍了与 vLLM 集成的原生速度 Transformers 建模后端,为使用 transformers 库的用户提供接近 vLLM 原生性能的推理能力,无需额外迁移成本。
Hugging Face 官方博客介绍了与 Amazon SageMaker Studio 的深度集成,允许用户一键将 HF 模型部署到 SageMaker 环境中,大幅简化 MLOps 工作流程,降低 AI 工程部署门槛。
Anthropic官方澄清,当Claude在有多名用户的频道中工作时,它使用的是自己的专属凭据(agent identity),而非任何用户的身份。这一「智能体身份」设计对安全合规有重要意义。
Claude Code v2.1.191新增/rewind指令支持在/clear后恢复历史对话;修复Background Agent被停止后自动复活的问题;改进沙盒网络权限记忆功能,允许的主机在整个会话期间无需重复确认授权。另修复多项UI和配置问题。
Hugging Face 博客介绍如何利用 NVIDIA NeMo AutoModel 大幅提升 Transformer 模型微调速度,通过优化计算资源利用帮助开发者更高效地训练专属模型,降低 GPU 算力的浪费。
OpenAI 官方宣布与 Broadcom 联合设计并量产首款 AI 芯片 Jalapeño,专为 ChatGPT、Codex、API 及未来 Agentic 产品的 LLM 工作负载深度定制。OpenAI 表示芯片是 AI 经济的基础,自研有助于扩大智能规模、服务更多用户。原推文获 9591 点赞、922 转发、82 万浏览量。
OpenAI 官方博客发布 Jalapeño 芯片详情:由 OpenAI 与 Broadcom 联合从零设计,专为驱动 ChatGPT、Codex、API 和未来 Agent 产品的 LLM 推理负载优化,性能每瓦显著优于现有方案。此举是 OpenAI 从产品到模型到基础设施全栈扩张的关键里程碑。
研究在涵盖健康、科学、教育等真实场景的数据集上以有益行为(诚实、公平、风险意识、可纠正性等)训练RL模型,在50多个独立对齐基准中超过80%获得提升。仅限健康领域的RL训练即可改善非健康对齐评估,跨领域迁移效果显著,且提升了对抗提示和有害微调的抵抗能力。
研究在涵盖诚实、公平、风险意识、可纠正性等有益行为数据集上进行RL训练,在50余个独立对齐基准上超过计算匹配基线。关键发现是对齐的跨领域迁移:仅在健康领域的有益训练也能改善非健康领域的对齐,减少奖励黑客和欺骗行为,并提升对对抗提示和有害微调的抗性。
微软研究院推出 MagenticLite 系统及配套的 MagenticBrain 和 Fara1.5 模型,专为小模型设计的 Agentic 体验,支持浏览器与本地文件系统的统一工作流。通过专业化模型编排,在日常任务上实现高效 Agentic 性能,无需依赖大型模型。
微软研究院发布 SocialReasoning-Bench 基准测试,研究发现当前 AI 智能体虽能胜任执行任务,但无法持续优化用户利益,即便明确指示优化也如此。这揭示出当前 agent 在「用户利益优先」上存在系统性缺陷,对 AI 对齐设计有重要意义。
AI研究者Andrej Karpathy发文将Claude Tag定位为LLM交互的第三次范式转变:第一次是LLM作为网站,第二次是LLM作为App,第三次是LLM作为持久、异步、拥有全机构工具和上下文的团队成员。该帖获856万次浏览、533次转发、6712个赞。
OpenAI 官方博客宣布,三星电子正式在全球范围向员工部署 ChatGPT Enterprise 和 Codex,覆盖软件开发、营销、产品开发和制造等核心职能。OpenAI 将此列为迄今最大规模企业 AI 部署案例之一。
Runway 平台一次性发布三款顶级视频生成模型:Seedance 4K、Seedance Mini 和 Kling 3.0 Turbo,均已全面可用。首三个月可享 7 折优惠(使用码 30RUNWAY)。
Claude Code v2.1.187 主要更新:新增 sandbox.credentials 设置可阻止沙箱命令读取密钥文件;支持组织配置的模型访问限制;修复了 --resume 失败、结构化输出模型无限重调等多个 bug;MCP 工具调用超时从无限等待改为超时报错。
Cursor发布新功能"Customize"页面,将插件、Skills和MCP工具整合到一个入口,用户可一站式定制AI编程工作流。这是Cursor在可扩展性上的重要更新。
Apple机器学习研究院测试了由9个前沿LLM组成的评委团,发现其实际信息量仅相当于约2票独立投票,约3/4的名义独立性因模型间错误相关而被抵消,严重动摇了LLM-as-a-judge评估范式的可靠性。
美国新颁行政令设定2030年为后量子密码学迁移截止日期,为政府和企业建立了强制性合规框架。Cloudflare官方博客深度解读行政令要点,并给出政府和企业的具体迁移路线图,是目前最权威的技术解读之一。
OpenAI宣布2026年开发者日(DevDay)正式开放报名,活动将于9月29日在旧金山举办,定位为OpenAI最大规模开发者活动。报名截止日期为7月10日。
Anthropic发布Claude Tag,允许在Slack频道中@提及Claude参与团队工作流。Claude具备主动性、多人协作能力和独立记忆。Anthropic内部已用Claude Tag完成65%的代码编写,包括Claude Tag本身的大部分代码。
OpenAI 官方博客分享:GPT-5 Pro 帮助免疫学家 Derya Unutmaz 解开了一个困扰三年的 T 细胞行为谜题,相关发现可能推进癌症和自身免疫疾病研究。这是 GPT-5 在真实科研场景中创造价值的具体案例。
Hugging Face 官方博客分享了在 Transformers.js 中实验 Cross-Origin Storage API 提案的进展。该 API 旨在让浏览器端 AI 模型在不同域间共享缓存,减少重复下载,优化 Web AI 应用的模型加载体验。
MistralAI 正式发布 Mistral OCR 4,支持 170 种语言,提供包含边界框、块级分类和内联置信度评分的结构化输出。这是 Mistral 在文档智能领域的重要升级,对需要处理多语言文档的开发者极具实用价值,消息获得约 15 万次浏览。
IBM Research 在 Hugging Face 博客发布 CUGA 教程,提供两打可运行的 AI Agent 应用示例,基于轻量级框架构建。内容面向开发者,是快速上手 Agentic AI 应用开发的实用参考。
Claude Code v2.1.186 新增多项功能: 支持从 CLI 直接认证 MCP 服务器,无需打开交互菜单,并支持 SSH 环境下的 stdin 重定向; bash 命令现在会自动触发 Claude 对输出的响应;工作流视图新增状态筛选;修复多个 streaming 和后台任务相关 bug。
Hugging Face 分享了 huggingface_hub 每周发版流程,结合 AI 工具与开源自动化,保持「人在回路」的发版节奏,介绍了具体工具链、CI 流程与实践经验。
欧洲旅行平台 Omio 发布 OpenAI 合作案例,分享如何借助 AI 构建对话式旅行体验、加速产品开发并向 AI 原生公司转型。OpenAI 官方博客案例,具有较高参考价值。
Hugging Face 博客分享实验成果:使用本地运行的开源模型对 OpenClaw 代码仓库 PR 进行自动分流和初步审查,全程零成本。文章展示具体配置方案和效果对比,证明本地模型在代码审查辅助任务上已具备实际可用价值。
Apple 正式公布第三代 Apple Foundation Models(AFM),这是 Apple Intelligence 新一代核心架构。该系列包含 5 个模型,由 Apple 与 Google 合作开发,从端侧到服务器端全面覆盖,以隐私保护和架构创新为核心亮点。