AI 情报文章归档
浏览 AI圈报 已保存的 5635 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5635
正式分类6
精选内容3360
全部文章
第 123 / 141 页 · 每页 40 条
产品发布 / 更新精选
V8.1 更新
Midjourney V8.1 版本现已登陆 Discord 平台及其官方网站。本次更新重点提升了图像的清晰度与整体画质,这一改进在风格参考(SREF)和情绪板(Moodboards)功能中效果最为显著,同时所有类型的图像生成质量均有所增强,为用户带来更精细的视觉体验。
信息来源:Midjourney:Updates(RSS)
产品发布 / 更新精选
Luma Agents:一键生成高转化网站设计
为你的网站寻找外观。同时探索每个方向。 定义目标,设定美学风格,然后让Luma Agents构建每个元素。英雄区域。文案。视觉效果。布局。所有内容都经过结构化设计,从首次滚动开始就旨在实现转化。 立即构建 → http://lumalabs.ai/app
信息来源:X:Luma AI (@LumaLabsAI)
观点 / 方法精选
GPT Image 2"笨拙涂鸦"提示词爆红网络
一条针对GPT Image 2的特定图像生成提示词正在社交媒体上病毒式传播。该提示词的核心要求是:以最笨拙、潦草且极其糟糕的方式重绘所附图像,背景为白色,使其看起来像是用鼠标在MS Paint中绘制。生成效果需与原图似是而非,带有低质量像素感和令人困惑的别扭感,以突出其荒诞的"差劲"。推文引用者指出,这条提示词正引发疯狂传播。
信息来源:X:ChatGPT (@ChatGPTapp) · ChatGPT / GPT
行业动态精选
Alphabet市值单日暴增4200亿美元,逼近英伟达
Alphabet股价大涨约9%,市值单日增加约4200亿美元,创下历史最大单日涨幅纪录。其市值目前仅比全球市值最高的上市公司Nvidia低约6%。这一强劲表现的核心驱动力来自Google Cloud,其营收实现了63%的增长,增速超过了近期AWS和Azure的表现。增长主要得益于企业客户广泛采用基于Gemini模型和定制TPU构建的AI解决方案。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Gemini / NVIDIA
产品发布 / 更新精选
Codex简化日常办公流程
使用Codex处理日常工作从未如此简单。 选择你的角色,连接你每天使用的应用,并尝试建议提示。 Codex能在研究规划、文档、幻灯片、电子表格等方方面面提供帮助。
信息来源:X:OpenAI (@OpenAI) · OpenAI
论文研究精选
百万对话揭示用户如何向Claude寻求指导
人们如何向Claude寻求指导? 我们分析了100万次对话,以了解人们提出什么问题、Claude如何回应,以及它何时会陷入阿谀奉承。我们利用这些发现改进了Opus 4.7和Mythos Preview的训练方式。 https://www.anthropic.com/research/claude-personal-guidance
信息来源:X:Anthropic (@AnthropicAI) · Claude
观点 / 方法精选
DeepSeek-V4 API推理内容字段缺失导致报错问题
用户在使用DeepSeek-V4 API或集成该模型的终端编码代理(如Claude Code、Kimi CLI)和AI IDE(如Cursor)时,频繁遇到HTTP 400报错。错误信息指出,在思考模式下必须将`reasoning_content`字段回传给API。核心问题在于,当任务步骤的`tool_call`过于简单直接时,DeepSeek-V4返回的`reasoning_content`可能为空字符串。许多开发工具默认会过滤掉空值字段,导致该字段未被回传,从而触发AP…
信息来源:X:karminski (@karminski3) · DeepSeek / Claude / Kimi
产品发布 / 更新精选
Response Caching:相同请求零成本
新推出的 Response Caching 头部实现了 API 请求的缓存机制,完全相同的请求可获得缓存响应,响应时间大幅缩短至微乎其微的水平,且不会产生额外成本。该功能通过自动识别并复用已生成的响应,显著提升了重复请求的处理效率。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
OpenRouter 推出 Response Caching:相同请求零成本缓存
OpenRouter 新增 Response Caching 头部,用于缓存完全相同的 API 请求,使后续请求的响应时间大幅缩短,且缓存调用完全免费。
信息来源:OpenRouter:Announcements(RSS)
论文研究精选
无需人类同步监督的智能体操作自动审查机制
一项名为"自动审查"的新机制为代码智能体的部署提供了更安全的默认方案。该机制通过一个独立的审查智能体,对主智能体可能越界的操作进行异步的批准或拒绝,从而无需人类进行实时同步监督。这种方法旨在提升自主智能体在代码生成与执行过程中的安全性与可控性,是保障AI代理在边界内可靠运行的关键技术进展。
信息来源:OpenAI:Alignment 研究博客(RSS) · OpenAI
模型发布 / 更新精选
AntLingAGI开源Ling-2.6-1T模型,登陆Hugging Face平台
AntLingAGI团队宣布Ling-2.6-1T模型正式开源,已登陆Hugging Face平台,并通过Novita Labs提供官方推理体验。该模型采用混合专家架构,总参数1万亿、激活参数630亿,核心优化方向为"令牌效率"以满足真实生产需求。具体表现为:低令牌开销,能在无需冗长推理链的情况下保持强大智能;可靠的多步执行能力,提升指令、工具、上下文和工作流的控制水平;生产就绪的部署特性,覆盖从代码生成到错误修复的任务,并广泛兼容各类智能体框架。团队旨在通过降低测试、部署…
信息来源:X:蚂蚁百灵 (@AntLingAGI) · Hugging Face
行业动态精选
英国政府警告:AI网络攻击能力加速远超预期
英国政府向商界领袖发出紧急警告,指出AI网络能力正以前所未有的速度加速发展。英国人工智能安全研究所(AISI)的评估显示,前沿模型的能力翻倍周期已从原先的八个月缩短至四个月。这一结论基于对Anthropic的Mythos等先进模型的测试,表明AI网络威胁的演变速度远超先前预估。政府强调,拥有先进国家AI评估能力的官方机构确认此趋势,证明相关风险并非夸大,各界需高度重视这一急速变化的威胁态势。
信息来源:X:AI Safety Memes (@AISafetyMemes) · Claude
产品发布 / 更新精选
Gemini App移动端正式向所有用户开放Notebooks功能,并即将登陆更多欧洲国家
Gemini App中的Notebooks功能现已正式在移动端向免费和付费用户开放,并计划很快扩展至更多欧洲国家。此次更新标志着NotebookLM与Gemini的深度集成,用户现可直接在Gemini App内访问所有个人未共享的笔记本,并能将Gemini的聊天记录用作新笔记本或现有笔记本的资料来源。功能推出将分阶段进行:首先面向网页版的Google AI Ultra、Pro和Plus订阅用户,未来几周将逐步覆盖移动端用户、更多欧洲地区以及免费用户。
信息来源:X:NotebookLM (@NotebookLM) · Gemini
模型发布 / 更新精选
谷歌发布首个原生多模态嵌入模型Gemini Embedding 2
谷歌上周正式向公众发布了其首个原生多模态嵌入模型Gemini Embedding 2。该模型如同"通用翻译器",能将文本、图像、视频和音频数据转化为独特的数字向量。其核心突破在于不再依赖关键词匹配,而是基于语义将不同模态的数据映射到同一空间,从而理解内容间的深层联系。开发者已利用该模型构建视频分析工具、视觉购物助手等应用,实现通过拍照或描述场景进行智能搜索的功能。模型现可通过Gemini API或Gemini Enterprise Agent平台使用。
信息来源:X:Google AI (@GoogleAI) · Gemini
教程 / 实战精选
GitHub Copilot CLI 入门指南:交互模式与非交互模式
GitHub Copilot CLI 提供了交互与非交互两种主要使用模式。交互模式允许用户通过对话式指令逐步构建和调整命令,适合探索性任务。非交互模式则支持直接输入完整指令快速执行,适用于自动化脚本或已知命令。理解这两种模式的区别能帮助开发者更高效地利用该工具,提升命令行工作效率。
信息来源:GitHub Blog
产品发布 / 更新精选
Gemini应用正式推出移动端Notebooks功能
Google的Gemini应用正式向移动端免费和付费用户推出Notebooks功能,并即将扩展至更多欧洲国家。该功能允许用户在Gemini应用内直接访问所有个人未共享的笔记本,并能将与该AI的对话内容作为新笔记本或现有笔记本的资料来源。此次发布首先面向网页端的Google AI Ultra、Pro和Plus订阅用户,后续将逐步推广至移动端、更多欧洲地区及免费用户。
信息来源:X:NotebookLM (@NotebookLM) · Gemini
产品发布 / 更新精选
Replit Slides:一分钟生成演示文稿
介绍Replit Slides! 不到一分钟就制作了整个演示文稿,无需手动操作任何一张幻灯片。只需描述你的需求,通过聊天进行迭代修改,然后导出为PowerPoint、Google Slides或PDF格式(或发布实时链接)。幻灯片功能面向Core和Pro用户开放。🎯
信息来源:X:Replit (@Replit)
观点 / 方法精选
零基础项目经理借助Claude Code,六周内独立开发并上线压力管理应用
毫无编程经验的项目经理Kostiantyn Vlasenko,借助Claude Code在72小时内独立开发出压力管理应用Respiro,并于六周后成功上线苹果应用商店。该应用能通过手机实时检测用户压力信号,并即时引导呼吸练习。其架构由15个以上并行运作的专用子智能体构成,涵盖设计、开发、审查等模块。Claude协助完成了从技术选型、代码重构到苹果账号注册、服务集成乃至界面调试等一系列复杂操作,甚至支持了后续的市场推广工作。
信息来源:Claude:Blog(网页) · Claude
模型发布 / 更新精选
DeepSeek 公布多模态模型技术报告
DeepSeek发布了多模态大模型及技术报告,提出创新的"基于视觉原语的思考"框架。该框架将点、边界框等视觉元素作为推理的基本单元,旨在解决多模态模型在空间参照任务中存在的"参照鸿沟"核心问题,使模型能将抽象认知锚定到图像的具体坐标上。尽管模型规模紧凑且图像标记预算较低,其在多项挑战性计数和空间推理基准测试上的性能,可与GPT-5.4等前沿模型相媲美。
信息来源:IT之家(RSS) · GPT / DeepSeek
观点 / 方法精选
Qwen-Scope开源套件发布:稀疏自编码器助力模型内部特征操控
Qwen团队推出开源稀疏自编码器套件Qwen-Scope,将SAE特征转化为实用工具。该套件支持四大应用方向:无需提示工程即可通过直接操控内部特征引导模型输出;用极少样本对目标数据进行分类与合成,提升长尾能力;追踪代码切换和重复生成问题的根源并进行修复;通过分析特征激活模式优化评测基准并减少冗余。团队希望社区利用Qwen-Scope深入探索Qwen模型内部机制,并开发出超越现有研究范围的应用。相关资源已开放。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
行业动态精选
Meta首次日活用户下降,资本支出激增致股价大跌
2026年第一季度,Meta全球日活跃用户首次下降,"应用家族"日活减少2000万。公司归因于伊朗网络中断和俄罗斯禁用WhatsApp,但合并数据掩盖了具体应用流失。同时,Meta将2026年资本支出指引上调至1250-1450亿美元,主要用于应对内存芯片涨价和加码AI基础设施投资,日均投入约4亿美元。尽管营收增长33%至563亿美元、净利跃升61%,公司仍计划裁员8000人以"抵消"AI投资成本,Reality Labs部门亏损40亿美元。华尔街对其支出轨迹不满,股价盘后…
信息来源:X:Kim (@kimmonismus)
行业动态精选
Softbank 计划将估值高达1000亿美元的新AI与机器人公司Roze上市
软银集团计划在美国启动并推动其新成立的人工智能与机器人公司Roze进行首次公开募股。据《金融时报》报道,这家新公司的估值可能高达1000亿美元。此举标志着软银在AI和机器人领域的重大战略布局,旨在将相关业务整合并独立上市以获取市场资源与更高估值。
信息来源:The Decoder:AI News(RSS)
观点 / 方法精选
持续优化智能体工具链:上下文演进与效果评估
Cursor团队以构建软件产品的方式迭代优化其智能体工具链,核心围绕上下文窗口的演进。早期模型能力有限,工具链依赖大量静态上下文和防护机制;随着模型能力提升,团队已转向提供更多动态上下文获取方式并移除限制。评估改进效果采用线上线下结合:通过CursorBench等基准测试进行标准化质量评估,同时进行线上A/B测试,使用"代码保留率"和用户反馈语义分析衡量真实场景表现。团队持续监控并修复工具调用错误,以应对日益复杂的工具链状态。
信息来源:Cursor Blog · Cursor
行业动态精选
马斯克律师庭审出示关键证据,揭露OpenAI早期转型营利内幕
马斯克律师在庭审中出示了OpenAI联合创始人Greg Brockman 2017年的私人日记,其中明确写道团队真正想要的是营利性结构并计划将马斯克排除在外,承认若转型则此前承诺皆为谎言。然而两个月后,Brockman却公开向马斯克表达敬意。证据显示OpenAI早在2017年就已策划从非营利转向商业。此前,OpenAI试图用Sam Altman 2022年提及股权的短信作为证据,但被马斯克以非营利组织法律上不能有股权为由反驳,反而坐实了其早期就已背离公益初心。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · OpenAI
模型发布 / 更新精选
Qwen3.6-Plus上线Together AI平台
Qwen3.6-Plus 现已在 @togethercompute 上线。快来使用吧。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
产品发布 / 更新精选
阿里云发布HappyHorse,实现秒级AI视频生成
阿里云推出最新AI视频生成模型HappyHorse。该模型具备多项突破性功能:可生成影院级1080p高清画质;原生实现精准的音画同步,确保口型与声音对齐;在复杂场景和镜头切换中保持多镜头角色一致性;支持从文本提示到视频成片的秒级即时生成。用户现可免费试用。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud)
模型发布 / 更新精选
ERNIE 5.1 Preview发布,架构更轻性能更强
百度ERNIE 5.1 Preview模型正式上线。该模型采用更轻量高效的架构,在总参数量压缩至前代约1/3、激活参数量约1/2的同时,仅消耗可比模型约6%的预训练成本,实现了在其规模下的领先基础性能。根据@arena的Text Arena榜单,ERNIE 5.1 Preview在全球总排名第13位,并位列中国实验室第一。其在多个细分领域进入全球前十,特别是在法律与政府领域排名第一。百度预告将在2026年的Baidu Create大会上发布更多ERNIE模型更新。
信息来源:X:百度 Baidu (@Baidu_Inc)
产品发布 / 更新精选
Wan2.7-Image实现精准色彩控制
你知道吗?Wan2.7-Image 也有自己的"调色板"功能?😉 只需输入参考图像、精确色码,甚至插入自己的调色板,该模型就能确保色码匹配以保持品牌一致性,并克服长期困扰 AI 图像的色彩还原不一致问题 🎨 观看视频,立即完美掌控你的色彩! #AlibabaAI #Wan #Innovation
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud)
模型发布 / 更新精选
Ling-2.6-1T 正式开源:面向复杂任务的万亿级综合旗舰模型
Ling-2.6-1T 于上周发布,今日正式开源。该模型定位为面向复杂任务的万亿级综合旗舰模型。
信息来源:公众号:蚂蚁百灵(Ling)
论文研究精选
STARFlow-V:基于标准化流的端到端视频生成建模
研究团队提出了基于标准化流的视频生成模型STARFlow-V,旨在应对视频生成领域长期由扩散模型主导的局面。该模型具备端到端学习、鲁棒的因果预测和原生似然估计等优势,能够直接处理连续数据并建模复杂的时空动态。这一工作标志着标准化流在图像生成取得进展后,首次被系统性地扩展至计算成本更高、时空结构更复杂的视频生成任务中,为生成式模型的设计提供了新的技术路径。
信息来源:Apple Machine Learning Research(RSS)
产品发布 / 更新精选
自定义语音与语音库
xAI于2026年4月30日推出自定义语音和语音库功能。用户可通过约1分钟录音快速克隆声音,并在Grok文本转语音及语音代理API中即时使用,整个过程仅需2分钟。语音库提供集中管理平台,内置语音已超80种,支持28种语言。为确保安全,系统采用两阶段验证,包括实时转录匹配和说话人嵌入确认,以防止未经授权的克隆。这些功能适用于品牌代理、内容创作、无障碍辅助、多语言团队及游戏娱乐等多种场景,且使用自定义语音无需额外费用。
信息来源:xAI:News(网页) · Grok
产品发布 / 更新精选
Introducing Advanced Account Security:推出高级账户安全功能
平台推出了高级账户安全功能,核心更新包括抗钓鱼登录验证、更强大的账户恢复机制以及增强型保护措施。这些升级旨在更有效地保护用户的敏感数据,并重点防范账户被恶意接管的风险。新安全体系通过多重技术强化了整体防护层级。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
Google Gemini实现AI"交付时代"跨越,直接生成可下载办公文件
Google Gemini迎来重磅更新,用户现可在聊天中通过一句话指令,直接生成并下载Docs、Sheets、Slides、PDF等主流办公文件,无需手动复制排版。该功能支持含LaTeX公式的学术文档、表格和图表,且免费向全球Gemini App用户开放。这标志着AI从输出文字的"对话时代",迈向了直接产出可交付生产力资产的"交付时代"。Google凭借与Workspace生态的深度集成,实现了降维打击,对依赖AI生成文档的初创公司构成巨大压力,并推动行业竞争焦点转向直接产…
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Gemini
教程 / 实战精选
轻松构建网页应用
你完全可以构建网络应用
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
产品发布 / 更新精选
Codex通过Figma插件实现方案可视化
通过Figma插件,Codex现在可以将实施计划转化为可视化的FigJam白板。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
产品发布 / 更新精选
响应API引入WebSocket提升代理效率
⚙️ 我们通过 Responses API 中的 WebSockets 让代理循环运行得更快 随着 Codex 速度提升,瓶颈从推理转移到了低效的 API 调用 WebSockets 在工具调用之间保持响应状态活跃,帮助工作流程端到端运行速度提升高达 40% https://openai.com/index/speeding-up-agentic-workflows-with-websockets
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
观点 / 方法精选
Where the goblins came from:GPT-5 行为中"妖精"输出的起源
研究揭示了GPT-5等AI模型中"妖精"输出的传播路径、时间线与根本原因。这些由特定"人格"驱动的怪异行为,源于训练数据中意外混入的特定模式或"文化基因"。开发团队已识别出问题根源,并正在部署修复方案,通过调整训练数据和微调模型来消除此类非预期的个性特征,以提升模型行为的稳定性和可预测性。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / GPT
产品发布 / 更新精选
Claude Code内置Claude平台协作技能
Claude Code 内置一项用于操作 Claude Platform 的技能。 适用于模型迁移、使用 API 功能(例如提示缓存),或接入较新的 API 如 Claude Managed Agents。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
观点 / 方法精选
AI迷雾:预见能力崩溃与短期化未来
《哈佛商业评论》文章指出,AI的首要经济影响并非自动化,而是制造了巨大的不确定性"迷雾",导致"预见能力的崩溃"。这动摇了现代资本主义依赖未来"可读性"的根基,使得个人对教育投资、企业对长期雇佣与资本开支、金融市场对终值的评估均陷入犹豫。其结果是行为模式迅速转向短期视野:更倾向于模块化、可调整的投入,而非长期、不可逆的重大承诺。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新精选
Ling-2.6-1T 发布并获 vLLM 即时支持
AntLingAGI 开源了 Ling-2.6-1T 模型,这是一个面向现实世界智能体工作流程的新旗舰模型。作为 1T 参数规模模型的先驱,团队强调了硬件、软件与 LLM 协同设计的重要性。vLLM 项目从发布首日(Day-0)起即提供支持,体现了顶尖工程生态系统的协作。这种合作旨在实现最佳的优化效果与用户体验,共同推动技术进步。
信息来源:X:蚂蚁百灵 (@AntLingAGI)