AI 情报文章归档
浏览 AI圈报 已保存的 5559 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5559
正式分类6
精选内容3470
全部文章
第 5 / 139 页 · 每页 40 条
教程 / 实战精选
Nobody searches for security apps. So I made mine a tool for AI agents instead.
A Japanese version of this is on Note. (This is Part 2 of the solo-security-dev series. Part 1 on the...
信息来源:DEV Community
教程 / 实战精选
Five Languages, One Law
A library gets proven by people using it. A specification is a harder claim to back up: someone else...
信息来源:DEV Community
模型发布 / 更新普通
OpenAI 未发布模型 Astra 首批输出曝光
OpenAI 未发布模型 Astra(内部代号"mozaik-alpha-fdm")的首批公开输出已流出,测试显示其零样本、Max effort 下表现惊艳。OpenAI 已扩大该模型的内部测试,暗示发布可能临近。
信息来源:X:Testing Catalog (@testingcatalog) · OpenAI
观点 / 方法普通
OpenAI自研芯片Jalapeno性能超Rubin
OpenAI的秘密武器刚刚亮相。Jalapeno,这款AI设计的芯片,每兆瓦token数超越Rubin,九个月内完成流片,还能运行Doom。 Myron和Bryan与@JordanNanos一起在SemiAnalysis Weekly上全面解析: - Jalapeno vs Rubin和GB300的InferenceX对比 - 为什么每兆瓦token数才是关键指标 - 三星HBM4的回归 - AI编写的RTL和内核 - CUDA护城河正在流失吗? - Anthropic的A…
信息来源:X:SemiAnalysis (@SemiAnalysis_) · OpenAI / Claude
观点 / 方法精选
The #1 row on this AI memory leaderboard is not a measurement
Bench'd (benchd.ai) calls itself the neutral benchmark authority for AI memory, and sells vendors a...
信息来源:DEV Community
观点 / 方法精选
I built an AI incident responder that refuses to fix anything without asking
Built for the WeMakeDevs × TrueFoundry Agent Harness Hackathon. There are two kinds of "AI for...
信息来源:DEV Community
观点 / 方法精选
The AI Agent Stack: What Actually Makes an Agent Work?
What actually makes an AI agent work? Explore the practical architecture behind modern AI agents—from...
信息来源:DEV Community
观点 / 方法普通
EdgeBench 最强智能体 12 小时仅得 51.3 分
EdgeBench 长时程基准测试中,最强智能体运行 12 小时仅得 51.3/100 分。该基准提供 134 个任务的持久执行环境与反馈,智能体可调试代码、运行模拟并反复提交结果,但 6 类任务约 3.8 万小时交互仍难转化为持续进步。5 个模型的平均表现呈 log-sigmoid 曲线(R2≥0.997),先慢后快再饱和。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法精选
This is what every AI pin gets WRONG
If you are interested to get this project developed further, cosider starring it on my github:...
信息来源:DEV Community
观点 / 方法普通
OpenAI 关闭留言板时(带声音)
当 OpenAI 关闭留言板时(打开声音)
信息来源:X:Clément Delangue(Hugging Face CEO) (@ClementDelangue) · OpenAI / Hugging Face
观点 / 方法精选
Transactional Outbox no JurisOS: Resiliência Local-First e Criptografia End-to-End com Elixir & BEAM
Transactional Outbox no JurisOS: Resiliência Local-First e Criptografia End-to-End com...
信息来源:DEV Community
观点 / 方法精选
How I Migrated 40 REST Endpoints to GraphQL With Claude Code in 12 Days
TL;DR I moved 40 REST endpoints to GraphQL in 12 days using Claude Code as the grunt-work...
信息来源:DEV Community · Claude
观点 / 方法普通
Google 发布 Gemini Omni 1.1 Flash:40 秒场景扩展、首尾帧控制与 4K 放大
Google 发布 Gemini Omni 1.1 Flash 生产更新,场景扩展可读取最多 10 秒先前上下文并累计至 40 秒,支持首尾帧控制运镜。360p 草稿生成速度提升最高 60%、成本为 720p 的三分之一,成片可放大至 4K。模型经 Gemini API 提供,Adobe、Figma Weave、GMI Cloud 和 Runway 已投入生产使用。
信息来源:MarkTechPost(RSS) · Gemini
观点 / 方法普通
天网日快乐,致蛇怪信徒
祝那些信奉蛇怪的人天网日快乐。
信息来源:X:Emad Mostaque (@EMostaque)
产品发布 / 更新普通
Claude Code 或将支持免选文件夹启动会话
Anthropic 正在开发一项功能,使用户无需在 Claude Desktop 上选择文件夹即可启动 Claude Code 会话。 同样的功能也已添加到今日构建版本的 iOS 应用中(目前仍处于隐藏状态)。 终于快来了吗?👀
信息来源:X:Testing Catalog (@testingcatalog) · Claude
教程 / 实战精选
Why 100% Line Coverage is Lying to You in AI-Generated Code (And How We Catch It)
If you have spent the last few months building projects with AI coding assistants (Antigravity,...
信息来源:DEV Community
论文研究普通
WikiSkill:谷歌用持久化Wiki提升智能体技能进化
谷歌新论文提出WikiSkill,将智能体工作区分为执行轨迹、技能文件和中间Wiki三层,记录失败模式及每次技能编辑的接受/拒绝历史。在Gemini-3.5-Flash上,WikiSkill在5项基准测试中平均得分68.1%,优于最强对比方法的56.1%和无技能时的49.5%。论文指出技能由系统直接提供而非检索,技能选择未纳入测试范围。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Gemini
观点 / 方法普通
Grok Bot 搜索热度超越 OpenClaw
Grok Bot 在 Google Trends 搜索兴趣上已超越 OpenClaw。🔥
信息来源:X:cb_doge (@cb_doge) · Grok
观点 / 方法普通
吴恩达:Agent 时代工程师核心是判断力
吴恩达发文指出,AI 虽让写代码变便宜,但未降低做判断的成本,工程师核心壁垒转向判断力。他提出三条硬逻辑:懂系统架构以把控 Agent、先定数据架构再写功能、警惕 Agent 静默做错事并让其先写测试自证。软件基本功不再是手写,而是当"方向盘"。
信息来源:X:阿易 AI Notes (@AYi_AInotes)
行业动态普通
国家数据局:截至 7 月底我国智算总规模达 245 万 PFLOPS
国家数据局在2026中国国际大数据产业博览会上披露,截至7月底全国智算总规模达245万PFLOPS(FP16),八大国家算力枢纽和三个算电协同发展区已建成智算规模占全国比重超85%。其中145万PFLOPS智能算力已纳入国家级监测调度平台。另据国家数据发展研究院院长胡坚波介绍,2025年我国智能体专利授权量超3400件,增速为上一年的两倍以上。
信息来源:IT之家(RSS)
行业动态普通
Neuralink脑机接口从猴子玩Pong到人类手写签名
过去与现在 Neuralink 2021年的猕猴玩Pong演示。 而如今,瘫痪的PRIME试验参与者Audrey Crews于2025年7月植入该设备,正通过思维控制的鼠标光标在笔记本电脑上绘画并签下自己的名字。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法精选
One MCP Server, Two AI Clients: Wiring Actian VectorAI DB Into Claude and Cursor
MCP promises one server, any AI client. I put that to the test by wiring Actian VectorAI DB up to...
信息来源:DEV Community · Claude / Cursor
观点 / 方法普通
美国风投Dimension Capital内部信:中国AI生态全解析
美国风投Dimension Capital合伙人访华后致出资人内部信流传,详析中国AI生态。信中指出,美国出口管制倒逼中国团队形成全栈效率文化,中国开源模型18个月内占OpenRouter Token消耗份额从不足2%升至45%,Qwen成Hugging Face最快破10亿下载模型家族,约80%美国AI初创已部署中国开源模型。
信息来源:X:阑夕 (@foxshuo) · Qwen / Hugging Face
观点 / 方法普通
OpenAI 关闭留言板引热议
当 OpenAI 关闭留言板时
信息来源:X:Clément Delangue(Hugging Face CEO) (@ClementDelangue) · OpenAI / Hugging Face
行业动态普通
英伟达"看中"Hugging Face,开放权重 AI 模型成硅谷热门收购目标
英伟达有望以约 130 亿美元(约合 876.47 亿元人民币)收购开放权重 AI 模型平台 Hugging Face,交易尚待公司确认。此前英伟达已与开放权重模型公司 Poolside 达成 60 亿美元协议,Stripe 亦以超 70 亿美元收购 OpenRouter。开放权重模型采用率仍低(约 6% 公司使用),但企业为降推理成本、获更强控制权,关注度正上升。
信息来源:IT之家(RSS) · NVIDIA / Hugging Face
观点 / 方法精选
I sent 1,027 cold emails with my own AI sales agent. 7 replied. The problem was not the emails.
Last week I wrote about our Product Hunt launch. 2 upvotes, 0 signups. This is the other half of the...
信息来源:DEV Community
观点 / 方法精选
How I Built an In-Place Android Screen Translator with Jetpack Compose, ML Kit, and Gemini Vision
Language barriers in mobile apps, games, and foreign media are a constant friction point. Traditional...
信息来源:DEV Community · Gemini
观点 / 方法精选
We ran 160 agent tasks across two frameworks. The frameworks tied. Then we changed the model.
We ran 160 agent tasks across two frameworks. The frameworks tied. Then we changed the model — and...
信息来源:DEV Community
行业动态普通
AI生成视频正取代中国演艺与直播行业真人演员
AI生成视频正冲击中国演员、网红和主播岗位,部分制作已用数字演员替代真人。自字节跳动Seedance 2.0发布以来,数字演员能以更快、更便宜的方式产出更高质量视频。2026年一季度中国上线约12.8万部短剧,为2025年全年三倍,其中95%为AI生成;一分钟AI视频成本仅90至120美元,约为真人拍摄成本的十分之一。
信息来源:The Decoder:AI News(RSS)
论文研究普通
Anthropic 揭示"AI 训练 AI"新方法:自动化对齐研究员成本更低、速度更快
Anthropic 发布论文《自动化研究员能够可靠缓解对齐失效》,展示用 AI 系统改善模型对齐表现。该系统针对 10 种失调行为测试,全部指标均有改善且未牺牲整体能力。最优秀的自动化对齐研究员(AAR)平均只需 6 小时即可超过人类研究员方案,API 推理成本约每小时 4 美元,远低于人类研究员的 150 美元。
信息来源:IT之家(RSS) · Claude
观点 / 方法普通
WorkBuddy Excel 协同编辑系列第二集
Co-Write 系列,第二集:Excel。 别再向 AI 解释你的电子表格了。 选中区域,说出你的需求,剩下的交给 WorkBuddy,就在同一个表格里完成。 有新任务?只需选中下一个区域,继续即可。 你编辑,AI 也编辑--同一个文件。
信息来源:X:Tencent WorkBuddy (@WorkBuddy_AI)
观点 / 方法普通
Anthropic 发布 AI 自我改进研究,Claude 提升对齐能力
Anthropic 发布研究论文,让 Claude 负责改进其他 AI 模型的对齐性,包括搜索文献、提出方法、创建训练数据、训练模型并评估迭代。该方法在 60 小时内改善了全部 10 项测试的对齐失败,且未降低通用能力,甚至用较弱的 Sonnet 5 后训练了早期 Opus 4.8 检查点。Anthropic 称最佳 AAR 方法平均在六小时内优于人类专家提出的方案,但尚未实现完全递归自我改进。
信息来源:X:Kim (@kimmonismus) · Claude
观点 / 方法普通
斯坦福课程拆解:Agent 落地三条铁律
斯坦福《自我进化 Agent》第一讲指出,判断工作能否被 AI 取代,关键看有无廉价的自动验证器,而非仅看能否被替代。课程强调生成与验证鸿沟:代码 Agent 因单元测试可自动闭环反馈而率先跑通。Agent 落地需遵循三条铁律:验证便宜的岗位(如重构、补测试)越用越强;靠人肉审美的岗位只能当草稿纸;生产级 Agent 须先画流程图并设人工审批闸门。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
行业动态普通
Debian 社区议案表决:开发者可使用生成式 AI,人类负最终责任
Debian 社区近日就大语言模型辅助开发议案完成表决,多数开发者支持负责任地使用生成式 AI。第 5 个选项"负责任地使用生成式 AI"在孔多塞投票制下胜出,新政策不禁止在软件开发、文档编写中使用生成式 AI,但要求 AI 辅助生成的代码和文档满足质量与法律合规要求,最终责任由人类开发者承担。Debian 不强制贡献者标注代码是否使用 AI,但鼓励披露。
信息来源:IT之家(RSS)
观点 / 方法精选
A zero isn't data until you can prove the instrument was running
A page showed 0 views. I drew a reasonable conclusion and wrote it into my state file. Two days later I found the page had never had analytics installed at all. Didn't happen and wasn't measured look identical.
信息来源:DEV Community
观点 / 方法精选
What I Learned Building an AI Product Photography SaaS
When I started building Shotinger, I thought the hardest part would be the AI. Getting good images....
信息来源:DEV Community
观点 / 方法精选
Why Vercel AI SDK 6/7 is a Paradigm Shift for React & Next.js AI Engineers
Why Route Handlers are Holding Back Your AI Apps For months, the standard advice for...
信息来源:DEV Community
观点 / 方法普通
Nvidia 的 AI 优势正超越 GPU 本身
Nvidia 的竞争优势正从 GPU 扩展到周边系统层。随着 AI 算力迈向吉瓦级规模,数据编排日益复杂,其 Vera Rubin 架构中的 Vera CPU 可带来高达 3 倍的加速,让闪存性能不再受限。尽管面临亚马逊、谷歌等自研芯片的竞争,Nvidia 在系统级效率上仍占据领先地位。
信息来源:TechCrunch:AI(RSS) · NVIDIA
行业动态普通
Anthropic 安全框架自动降级:Claude 误删开发者 700 GB 主目录,自动化清理反成灾难
开发者 Sebastien Guillemot 测试 AI 智能体文件删除防护机制时,Claude 误删约 700GB 数据,包括整个用户主目录及一周工作成果。
信息来源:IT之家(RSS) · Claude
观点 / 方法精选
Forward Deployed AI Engineer: The Role Enterprise AI Actually Needs
Every enterprise AI initiative I've seen fail had one thing in common. The engineers who built the...
信息来源:DEV Community