AI 情报文章归档
浏览 AI圈报 已保存的 5621 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5621
正式分类6
精选内容3360
全部文章
第 124 / 141 页 · 每页 40 条
产品发布 / 更新精选
用Runway将相册变特效引擎
用Runway将你的相机胶卷变成视觉特效引擎。 只需选择照片或视频,输入你想要的效果,就这么简单。 万物皆可创作,通过下方链接开始使用。
信息来源:X:Runway (@runwayml)
模型发布 / 更新精选
腾讯开源Hy-MT1.5-1.8B-1.25bit翻译模型,440MB体积支持手机离线运行
腾讯开源了Hy-MT1.5-1.8B-1.25bit翻译模型,其参数量为18亿,经量化后仅440MB,可在手机上完全离线运行。该模型支持33种语言、5种方言及1056个翻译方向,包括藏语、蒙古语等少数语言。在标准测试中,其性能媲美商业翻译API和2350亿参数的大模型。通过量化至1.25比特,模型内存占用从FP16格式的3.3GB大幅降低,比之前的1.67比特方法体积缩小25%、速度提升约10%,且无精度损失。该模型已在国际机器翻译竞赛中获得30项第一,并部署于腾讯多个产品…
信息来源:X:腾讯混元 (@TencentHunyuan)
行业动态精选
小米MiMo-V2.5-Pro在最新Arena排行榜中实现多项突破
小米MiMo-V2.5-Pro模型在最新Arena排行榜中表现卓越。在Text Arena(Expert)榜单中,它位列全球第六,同时是开源模型与中文模型的双料第一,其所属实验室全球排名第三。该模型在Text Arena(Overall)总榜中排名开源全球第二,在Code Arena(WebDev)前端开发榜单中位列开源全球第三。此外,它在Text Arena的四个关键子类别(Hard Prompts、英文Hard Prompts、指令遵循与长查询)中均获得开源全球第一。这…
信息来源:X:小米 MiMo (@XiaomiMiMo)
行业动态精选
OpenAI 在与微软重组协议次日登陆 AWS
微软与 OpenAI 解除了独家合作协议。次日,亚马逊云科技(AWS)便在其 Bedrock 平台上推出了三项新的 OpenAI 服务,其中包括一项双方共同构建的智能体服务。此举标志着 OpenAI 模型正式结束了在微软 Azure 云上的独家托管状态,开始通过 AWS 向更广泛的客户提供。
信息来源:The Decoder:AI News(RSS) · OpenAI
行业动态精选
马斯克和Altman在法庭上就OpenAI的营利性转向对峙
埃隆·马斯克与OpenAI CEO山姆·奥特曼之间备受关注的审判在奥克兰联邦法院开庭,焦点是OpenAI从非营利组织转向营利性公司的争议。双方在法庭上陈述了关于该AI实验室早期历史的截然不同版本:马斯克指控OpenAI违背了最初的非营利使命,而奥特曼则辩护称转型是为了更有效地推进人工智能发展。此案涉及AI伦理与商业化的核心辩论,可能对行业监管和未来创新方向产生深远影响。
信息来源:The Decoder:AI News(RSS) · OpenAI
观点 / 方法精选
闪速QLA:基于TileLang构建的高性能线性注意力内核
FlashQLA是基于TileLang开发的高性能线性注意力内核,专为提升个人设备上智能体AI性能而设计。它实现了2-3倍的前向传播加速和2倍的反向传播加速。其核心技术包括门控驱动的片上自动计算与通信重叠、硬件友好的代数重构,以及TileLang融合的Warp专用内核。该设计通过自动片上通信重叠显著提升了流处理器利用率,在张量并行、小模型和长上下文任务中效果突出。尽管在大批量处理时,其将GDN流程拆分为两个内核的策略会带来额外内存开销,但在边缘设备和长上下文实际场景中性能更…
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
产品发布 / 更新精选
闪存QLA:基于TileLang构建的高性能线性注意力内核
FlashQLA是基于TileLang构建的高性能线性注意力内核,专为个人设备上的智能体AI设计。其核心创新包括门控驱动的自动片内计算并行、硬件友好的代数重构以及TileLang融合的Warp专用内核,通过提升流处理器利用率,在前向传播上实现2-3倍加速,反向传播实现2倍加速。该技术在小模型、长上下文工作负载和张量并行设置中效果显著,虽然在大批次处理时内存I/O开销略高,但在边缘设备和长上下文场景中实际性能更优。反向传播通过16级Warp专用流水线在严格片上内存限制下实现了…
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
产品发布 / 更新精选
通过 Stripe Projects 命令行创建 OpenRouter 账户
运行 `stripe projects add openrouter/api` 命令,即可直接从命令行创建 OpenRouter 账户、获取 API 密钥并开通 Stripe 计费功能。该操作支持自动化代理执行,实现了账户开通与支付配置的一站式集成。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
使用 Cursor SDK 构建可编程智能体
Cursor 正式推出 SDK 公开测试版,开发者仅需几行 TypeScript 代码即可构建和部署智能体。该 SDK 提供与 Cursor 应用相同的运行时、框架及前沿模型(如 GPT-5.5)支持,并允许将智能体部署于本地或 Cursor 云的专用虚拟机。借助其生产级云基础设施,如安全沙箱和持久状态管理,智能体正从个人工具演变为组织的可编程基础设施。许多团队已将其集成至 CI/CD 流水线、工作流自动化及核心产品中。
信息来源:Cursor Blog · GPT / Cursor
产品发布 / 更新精选
OpenRouter 推出 CLI 创建账户功能,集成 Stripe 计费
运行 `stripe projects add openrouter/api` 即可从命令行创建 OpenRouter 账户、获取 API 密钥并配置 Stripe 计费。AI 智能体同样可自动化完成该操作,无需手动注册。
信息来源:OpenRouter:Announcements(RSS)
模型发布 / 更新精选
SenseNova U1上线Hugging Face与GitHub
是的,SenseNova U1 现已在 Hugging Face 和 GitHub 上发布! 探索它如何以语义精确性和像素级保真度实现复杂的 #信息图 创作。 Hugging Face: https://huggingface.co/collections/sensenova/sensenova-u1 GitHub: https://github.com/OpenSenseNova/SenseNova-U1 Discord: https://discord.gg/cxkwX…
信息来源:X:商汤 SenseTime (@SenseTime_AI) · Hugging Face
模型发布 / 更新精选
HappyHorse 1.0 在 fal 平台上线
HappyHorse 1.0 现已在 @fal 上线。去构建吧。 【引用 @fal】:Happy Horse 1.0 is live on fal, day 0 🐎 🎬 一流的运动质量 🎧 原生1080p,音频同步一步完成 🔗 音视频联合生成,非拼接 🔓 限制更少,商业用途更广 ⚡ 为生产规模而构建
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud)
观点 / 方法精选
Intelligence Age 下的网络安全
OpenAI 发布了一份旨在强化 Intelligence Age 网络安全的五点行动计划。该计划的核心是推动 AI 驱动的网络防御民主化,并保护关键基础设施系统。OpenAI 强调,面对日益复杂的网络威胁,必须广泛普及 AI 安全工具,以提升整体防御能力。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
AI初创公司的独立生存之道:差异化、专注与速度
针对AI初创公司是否必须被大模型实验室收购的讨论,Cognition公司的经验表明,同行被收购反而会强化剩余独立公司的地位。独立公司在软件工程等动态领域拥有明确市场,客户重视模型灵活性。其成功关键在于三大法则:一是建立清晰差异化,如专注企业市场、加速全开发周期、解决复杂部署难题并保持模型独立;二是极致专注,在特定领域深挖边缘复杂性问题,做到实验室无法比拟;三是保持速度优势,利用小团队决策快、工具链高效和工程文化,通过快速迭代建立竞争壁垒。
信息来源:X:洪明 (@hongming731)
行业动态精选
SiliconFlow成第三方模型日用量榜首
👀 🚀 🙌 【引用 @SiliconFlowAI】:开发者们正在用他们的 token 投票 🔥 SiliconFlow 现已成为日 token 使用量排名第一的第三方模型提供商 在 @OpenRouter 上, • 每日约 280B token • 每月约 1.9T token • 33 个前沿模型:DeepSeek V4 系列、GLM 5.1、Kimi K2.6 等 衷心感谢每一位与我们共同构建的开发者 更多精彩即将到来🚀
信息来源:X:硅基流动 SiliconFlow (@SiliconFlowAI) · DeepSeek / GLM / Kimi
观点 / 方法精选
Codex超级应用七项核心能力详解
一个很棒的Codex教程: 这些是7种知识工作能力… 在超级应用Codex内部 00:00 介绍 02:19 能力1 - 完整文件访问 07:41 能力2 - 持久记忆 10:46 能力3 - 插件 13:52 能力4 - 技能 19:22 能力5 - GPT图像访问 21:03 能力6 - 浏览器与计算机使用 23:58 能力7 - 自动化 25:31 额外功能 - 编年史 27:21 总结
信息来源:X:Greg Brockman (@gdb) · GPT
模型发布 / 更新精选
蚂蚁发布Ling-2.6系列模型,以极致token效率推动AI生产落地竞赛
蚂蚁集团发布Ling-2.6系列模型,通过MoE架构与Fast-Thinking机制,将推理激活率降至7%,在实现接近GPT-5.4非推理水平综合智能的同时,大幅降低token成本。该模型在SWE-bench Verified等真实Agent场景测试中表现领先,旨在解决Agent规模化应用的成本痛点。目前已在OpenRouter提供免费API并即将开源,推动行业焦点从刷榜转向生产落地。其高效率特性尤其适合高频任务,在部分任务中速度比Claude Sonnet 4.6快6倍、…
信息来源:X:阿易 AI Notes (@AYi_AInotes) · GPT / Claude
行业动态精选
2026年Q1云巨头资本支出达1120亿美元,谷歌增长领先
2026年第一季度,三大云服务巨头资本支出合计1120亿美元。谷歌云以63%的同比增长率领跑,远超微软Azure的40%和亚马逊AWS的28%。谷歌增长主要受企业AI解决方案驱动,云服务积压订单环比翻倍至超4600亿美元。客户通过API每分钟处理160亿个令牌,同比增长60%。为满足需求,谷歌将2026年资本支出指引上调至1800-1900亿美元,超过微软的约1200亿美元。谷歌凭借全栈自研的Gemini模型和TPU芯片,在增长速度和结构优势上表现突出。
信息来源:Tomer Tunguz 博客(VC 分析) · Gemini
观点 / 方法精选
AI推理市场的专业化分化
AI推理市场正快速分化,各模态如文本、图像、视频和音频发展出独立推理技术栈。自ChatGPT发布后,NVIDIA数据中心收入三年内增长17倍,凸显市场爆发。分化根本原因在于工作负载差异:图像视频生成需高计算力,长上下文消耗更多内存,边缘设备则受功耗限制。市场按延迟分为实时、近实时和批量三层;按模态分为文本、图像视频音频;按部署分为云端和边缘。Hugging Face上已有超9万个图像生成模型,整个AI推理市场规模预计约1000亿美元,这种专业化趋势正为各细分领域创造领导者机…
信息来源:Tomer Tunguz 博客(VC 分析) · ChatGPT / NVIDIA / Hugging Face
教程 / 实战精选
60秒制作伴奏指南
如何在60秒内制作伴奏音轨。
信息来源:X:Suno (@suno)
产品发布 / 更新精选
NVIDIA发布开源多模态模型Nemotron 3 Nano Omni
NVIDIA NemotronTM 3 Nano Omni 已在 OpenRouter 上线。 这是一个用于智能体工作流的开源 30B-A3B 多模态模型:文本、图像、视频和音频输入 → 文本输出,拥有 256k 上下文窗口和高效的 MoE 架构,适用于计算机使用、文档和音视频推理。
信息来源:X:OpenRouter (@OpenRouter) · NVIDIA
产品发布 / 更新精选
加速AI:通过GCSFS和Rapid Bucket将Google Colossus引入PyTorch
Google Cloud推出了一项高性能集成方案,通过fsspec接口将Rapid Storage直接连接至PyTorch,以消除AI训练瓶颈。该方案利用Google的Colossus架构和双向gRPC流技术,可提供高达15 TiB/s的聚合吞吐量,并显著降低延迟。开发者仅需更新存储桶类型而无需修改代码,即可将总训练时间缩短23%。
信息来源:Google Developers Blog(RSS)
论文研究精选
使用BioMysteryBench评估Claude的生物信息学研究能力
Anthropic团队开发了BioMysteryBench生物信息学基准测试,用于评估Claude在分析真实数据集、解决开放式研究问题上的能力。测试发现,Claude的生物学科学能力正快速迭代,当前模型表现已与人类专家相当,最新模型甚至解决了部分专家小组未能破解的问题,且有时策略迥异。该基准旨在应对科学评估的固有挑战,如生物学研究中存在多种合理的"正确"方法,以及研究决策的高度主观性。
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
产品发布 / 更新精选
Claude API技能现已集成至CodeRabbit、JetBrains、Resolve AI及Warp
Claude API技能现已扩展集成至CodeRabbit、JetBrains、Resolve AI和Warp四款开发工具中,使开发者能在其常用环境中直接获得生产就绪的Claude API代码支持。该技能能自动捕获API最佳实践细节,如适配的智能体模式、参数变更与提示缓存规则,从而减少错误并简化模型迁移。开发者可在工具内直接指示Claude执行"提高缓存命中率"或"升级至最新Claude模型"等任务。此开源技能会随SDK更新自动同步,帮助团队更快采用新功能,避免因API知识…
信息来源:Claude:Blog(网页) · Claude
观点 / 方法精选
谷歌研究团队应用实证研究辅助工具的四个领域
自去年秋季推出实证研究辅助(ERA)工具以来,谷歌研究团队已将其应用于多个科学领域以解决实际问题。在流行病学中,它助力流感与新冠预测;在宇宙学里,协助分析星系数据以探究暗能量;在大气监测方面,提升了二氧化碳排放的追踪精度;在神经科学领域,则用于解析大脑活动数据。这些实践表明,ERA能帮助科学家生成专家级的实证软件,其成果超越了黑箱模型,可发现兼具可解释性与机制准确性的解决方案,从而有效加速科学发现进程。
信息来源:Google Research:Blog(网页)
论文研究精选
秒级更新万亿参数--大规模分布式强化学习中的点对点权重传输技术
LMSYS团队针对SGLang中的强化学习工作负载,提出了一种基于RDMA的点对点权重更新机制,作为传统NCCL广播方法的补充。该设计利用源端CPU引擎副本和Mooncake TransferEngine进行P2P RDMA传输,将拥有1T参数的Kimi-K2模型的权重传输时间从53秒大幅缩短至7.2秒,提速7倍。其代价是每个训练等级需在CPU内存中额外占用一个32G的推理引擎副本。此优化最大限度地减少了网络冗余,允许推理服务器更快恢复rollout过程,且兼容所有主流开源…
信息来源:LMSYS:Blog(Chatbot Arena 团队) · Kimi
产品发布 / 更新精选
企业级部署指南:如何利用Claude Cowork推动全员AI协作
Anthropic发布《企业级Claude Cowork部署指南》,旨在帮助非技术岗位员工规模化应用AI。该指南基于内部团队及Thomson Reuters等客户实践,提供了从试点到全面推广的完整路径。核心内容包括一个五级成熟度模型、试点用例评估方法以及为期六个月的组织级部署路线图。Claude Cowork作为桌面应用,能深度集成本地文件、Slack、Google Drive及浏览器,并结合Claude for Excel/PPT实现跨文档工作流,适用于金融、法律、销售等…
信息来源:Claude:Blog(网页) · Claude
模型发布 / 更新精选
介绍 NVIDIA Nemotron 3 Nano Omni:面向文档、音频和视频智能体的长上下文多模态模型
NVIDIA 发布了 Nemotron 3 Nano Omni 模型,这是一个专为处理长上下文多模态任务设计的轻量级模型。该模型能够同时理解并处理文档、音频和视频数据,旨在赋能新一代多模态智能体。其核心变化在于将长上下文能力与多模态理解结合到一个小型化模型中,提升了在复杂跨模态场景下的处理效率与应用灵活性。
信息来源:Hugging Face:Blog(RSS) · NVIDIA / Hugging Face
产品发布 / 更新精选
Claude推出原生连接器,可直接操作Blender、Fusion等创意软件
Anthropic为Claude推出了一系列针对创意软件的原生连接器,使其能直接接入Blender、Autodesk Fusion、Adobe Creative Cloud等专业工具内部工作流。这标志着Claude从问答助手转变为能在生产环境中直接操作的智能体。其核心突破在于通过自然语言桥接软件API,例如在Blender中调试场景、批量编辑对象,在Fusion中直接创建或修改3D CAD模型。此举旨在消除创意工作中大量的琐碎"翻译成本",如寻找菜单、记忆语法、编写一次性脚…
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
观点 / 方法精选
Opus 4.7模型成本普遍上涨12-27%
我们研究了市场上Opus 4.7的数据,发现成本增加了12-27%,但短提示除外,实际上短提示的成本效益更高。 完整文章:https://openrouter.ai/announcements/opus-47-tokenizer-analysis
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新精选
Claude Code新增任务完成手机推送功能
Claude Code 现在可以在长时间任务完成或需要您输入时,向您的手机发送推送通知。 离开终端吧,完成后我们会通知您。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
模型发布 / 更新精选
AntLingAGI与SGLang团队合作推出Ling-2.6-flash即时指令模型
AntLingAGI与SGLang团队合作,正式推出Ling-2.6-flash(亦称Elephant-alpha)即时指令模型,并在SGLang平台上实现了首发支持。该模型总参数量达104B,但活跃参数仅7.4B,专为低延迟的智能体工作流优化,能够实现即时响应。它在编码、文档处理和智能体任务中展现出极高的token效率,所用token数量显著减少。尽管活跃参数较少,其模型质量仍与当前SOTA水平相当,兼具速度与执行力,适合需要快速响应的生产级智能体应用。团队强调,快速且稳…
信息来源:X:蚂蚁百灵 (@AntLingAGI)
观点 / 方法精选
优化CLAUDE.md:聚焦关键规则以提升AI协作效率
多数人编写的CLAUDE.md冗长无效,常因添加过多人格指令导致Claude仍会猜错命令或重写文件。有效的CLAUDE.md应是精炼的项目技术简报,控制在60-80行内。核心在于认识到Claude的注意力是稀缺资源,系统提示已占用部分容量。正确结构应包含:明确的关键命令、简洁的架构地图、强调禁止事项的硬性规则、清晰的工作流偏好,并避免重复AI已记忆的内容。这本质上是LLM时代的注意力经济学,通过具体、负向的规则能显著提升输出精准度。一份好的CLAUDE.md能随项目积累价值…
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
模型发布 / 更新精选
Poolside发布首款公共基础模型
@poolsideai 的首批公开基础模型刚刚在 OpenRouter 上发布! Laguna M.1 和 Laguna XS.2。专为智能体编码和长周期工作从头构建。限时免费 ⬇️
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新精选
Claude创意工作套件
Anthropic推出Claude for Creative Work,这是一套连接器工具,可实现Claude与Blender、Autodesk、Adobe等主流创意软件的直接集成。这些连接器允许Claude访问各平台功能,例如在Adobe系列中调用50多款应用,在Autodesk Fusion中通过对话创建3D模型,或在Blender中通过自然语言操作Python API。创意工作者可利用Claude加速软件学习、编写脚本插件、桥接多工具工作流以及自动化批量处理等重复任务…
信息来源:Anthropic:Newsroom(网页) · Claude
产品发布 / 更新精选
Claude新增Blender连接器赋能创意工作流
Claude 现已连接创意专业人士已在使用的工具。 通过新的 Blender 连接器,您可以直接从 Claude 中调试场景、构建新工具,或对每个对象批量应用更改。
信息来源:X:Claude (@claudeai) · Claude
行业动态精选
马斯克诉OpenAI案开庭,指控其背叛非营利初衷
埃隆·马斯克在美国加州法院起诉OpenAI及其CEO萨姆·奥特曼,指控其将最初的非营利组织转变为营利性商业实体,构成背叛。马斯克要求法院撤销2019年的营利性转型,恢复非营利地位,罢免奥特曼等管理层,并索赔高达1340亿美元。他认为此案关乎公共原则,若此类转型无后果将危及全美慈善机构信任。OpenAI则反驳称该诉讼是"无根据的、出于嫉妒的竞争攻击"。此案结果可能为使命驱动型科技公司的结构与融资设立重要法律先例。
信息来源:X:Kim (@kimmonismus) · OpenAI
产品发布 / 更新精选
Microsoft VibeVoice:开源前沿语音人工智能
微软开源了前沿语音人工智能项目VibeVoice,该项目已在GitHub上发布。VibeVoice能够生成高度自然、富有表现力的语音,支持多种语言和情感语调,显著提升了合成语音的真实感与感染力。其开源策略旨在推动语音AI领域的协作与创新,降低开发门槛。该项目在技术社区获得关注,在Hacker News上获得了103个投票点数。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
OpenAI开源Symphony,Agent编排颠覆程序员工作方式
OpenAI开源代理编排器Symphony,将Linear、GitHub Issues等任务跟踪器转化为始终在线的Codex Agent调度系统。它突破了人类同时有效监督仅3-5个编码Agent的瓶颈,允许管理几十个Agent,实现自动编码、测试、交叉审查,并提交包含CI全绿和安全审查的证据包。所有验证通过后,任务才进入Human Review队列,使人类角色从微观监督转变为结果审查与指导。OpenAI内部已实践此模式,三名工程师五个月生成一百万行代码且零人工编写。未来核心…
信息来源:X:阿易 AI Notes (@AYi_AInotes) · OpenAI
行业动态精选
谷歌与五角大楼签署AI协议,允许其模型用于机密军事目的
谷歌已与五角大楼签署协议,允许其AI模型用于机密工作及"任何合法的政府目的",此举无视了超600名员工的反对,并逆转了其2018年因员工抗议退出Project Maven的立场。协议条款看似比OpenAI的同类合约更为宽松,虽声明AI"不拟用于"大规模监控或无人监督的自主武器,但法律专家指出该措辞缺乏约束力。协议还要求谷歌应政府要求调整AI安全过滤器。这与Anthropic因拒绝在类似用途上妥协而被五角大楼列为供应链风险形成对比。
信息来源:X:Kim (@kimmonismus) · OpenAI / Claude