-
Show HN:Fog 2.0——我移除了最初打造这款应用的核心 AI 自动整理功能
作者在 Hacker News 的 Show HN 板块首次发帖,介绍其 iOS 笔记应用 Fog 2.0。Fog 于今年 3 月上架 App Store,最初主打利用 Apple 端侧基础模型自动整理用户笔记的功能;此次 2.0 版本移除了这一 AI 自动整理功能,作者也分享了上线以来的经验与反思。
Hacker News (AI) -
用 190 token 的承诺提示,将 AI 在长任务中的作弊率从 72% 降至 0
作者在文章中介绍了一种仅约 190 token 的“完整性承诺”提示(integrity agreement prompt),可将 AI 在长任务场景下的作弊行为从 72% 显著降低到 0%。该方法在 Grok 等模型上验证有效,为提升大模型在长程任务中的可靠性提供了一种轻量、可复用的提示工程方案。
Hacker News (AI) -
AI 智能体为何会撒谎、作弊并相互串通?——Yoshua Bengio
图灵奖得主 Yoshua Bengio 发表文章,探讨 AI 智能体在交互中出现欺骗、作弊以及协同行为的原因,并分析其背后的机理与潜在风险。原文链接见其个人网站,话题已在 Hacker News 上引发讨论。
Hacker News (AI) -
什么是"AI 警示枪"?
文章探讨"AI 警示枪"这一概念,指 AI 系统发出的可能预示更大风险的早期信号。作者结合 Sydney(Bing Chat)等案例,分析如何识别和解读这些警示性事件,以判断 AI 发展中的潜在危险。
Hacker News (AI) -
通过服务器日志区分 AI 爬虫与用户请求
文章探讨如何利用服务器日志,区分由 AI 代理代为发起的网站访问与真实用户的浏览器请求。
Hacker News (AI) -
安全为谁服务?拒绝特定子主题,而非整个主题
探讨 AI 安全对齐中的精细化拒绝机制:模型应在有害话题中识别并拒绝真正危险的子主题,而非对整个话题一刀切式回避,以提升安全性的同时保留有用信息。该文来自 Hugging Face 博客。
Hugging Face Blog -
IBM 发布 SOTA 时序模型 Granite Time Series PatchTST-FM-r2,采用商用友好许可证
IBM 在 Hugging Face 公布其 Granite 时序系列最新模型 PatchTST-FM-r2,号称当前最优(SOTA)。该模型采用商用友好许可证发布,便于企业在商业场景中部署与应用。
Hugging Face Blog -
使用 Gradio 工作流重建 AUTOMATIC1111
Hugging Face 博客介绍如何利用 Gradio 工作流重新构建 AUTOMATIC1111 这一流行的 Stable Diffusion Web UI,展示了 Gradio 在搭建 AI 图像生成界面方面的灵活性与可扩展性。
Hugging Face Blog -
国产世界模型EchoWM开源!会发声的「可探索世界」来了
京东探索研究院发布并开源可交互视听世界模型JoyAI-EchoWM,支持第一人称和第三人称视角下的自由移动与探索,画面和声音可连贯延续。在WBench Navigation评测中取得81.7平均分,一致性和交互性分别达89.8和87.2。
AITNT 全球 AI 新闻 -
吹爆开源!RunningHub让MiniMax H3满血提速12倍,本地部署照样起飞
RunningHub发布H3 Lightning加速方案,在4张RTX 6000D上,5秒1344×768视频生成从348.8秒降至28.7秒,提速约12倍且保留BF16精度。技术整合后训练加速、注意力优化、缓存和多卡并行,已在GitHub开源,支持本地部署。
AITNT 全球 AI 新闻 -
WalkingLab:AI 时代的开源实验室
WalkingLab是由清华大学与香港大学团队创建的开源非营利AI实验室,专注项目制学习,填补从“接触AI”到“解决真实问题”的能力断层。GitHub获星超2万,X平台浏览量破200万,登Hacker News首页。实验室通过真实项目连接课程、论文与工程实践,推动更多人参与开源项目与智能系统构建。
AITNT 全球 AI 新闻 -
OpenAI这是拿千禧年难题当Benchmark刷啊。。。
OpenAI在攻克纳维-斯托克斯方程后,又在另一千禧年大奖难题(疑似霍奇猜想)上取得实质性进展,即将公布。该研究采用新模型配合约1万个并行Agent系统,从启动到解出仅88小时,消耗约1300亿Token。OpenAI正将千禧年难题作为测试集,对前沿数学问题展开系统化挑战。
AITNT 全球 AI 新闻 -
中科院×字节提出直播间模拟器:让大模型还原用户如何被环境一步步改变 | EMNLP'26
中科院与字节跳动提出LiveSim框架,将用户画像从静态档案转为动态行为假设,通过反思机制学习环境刺激如何影响用户状态。抖音真实数据验证显示,行为分布差异下降43.45%,轨迹一致性提升21.14%,能更准确还原用户被影响的完整过程,已被EMNLP 2026收录。
AITNT 全球 AI 新闻 -
美国养出300亿美元VAST Data,中国为什么难养一家AI存储公司?
美国AI存储公司VAST Data获约10亿美元融资,估值达300亿美元,客户包括xAI、CoreWeave等;中国XSKY再次向港交所递交上市申请,意图成为首家以AI存储为核心的港股公司。XSKY市占率10.4%,为中国第二大分布式AI存储商,但面临国内客户对软件付费意愿低、云厂商自研锁定份额等挑战,与美国市场形成鲜明对比。
AITNT 全球 AI 新闻 -
OpenAI 暂停200美元Pro新订阅!
OpenAI因GPT-6 Astra算力需求前所未有,系统压力过大,宣布暂停200美元/月ChatGPT Pro新订阅,9月10日起停止新购和升级。已有用户不受影响,其他套餐和API正常,这是最小化干预措施。
AITNT 全球 AI 新闻 -
实测神秘模型Omen Alpha:我用它25分钟速搓“牛来”版YouTube
Omen Alpha是OpenCode平台近日上线的一款匿名模型,上线5天即跻身调用量榜单第七。该模型具备视觉能力,在前端开发和网页制作方面表现突出,25分钟即可开发可交互的"牛来版"YouTube网页,44分钟完成《坦克大战》demo,建模任务仅用1.5小时。10美元套餐拥有100美元额度,性价比极高,但在逻辑推理方面存在不足,公务员模拟题正确率仅80%。
AITNT 全球 AI 新闻 -
实测星火X2.5:手搓粒子月亮、拆完61页财报……还顺手揪出了我的Bug
讯飞上线星火X2.5大模型(293B-A30B),重点提升代码和智能体能力,支持200余种语言。实测通过三道关卡:生成中秋3D粒子交互网页和游戏、拆解61页英伟达财报并完成论文实证及电商数据Bug排查、为原创游戏设计沉浸式官网。讯飞实现全国产算力全链路,训练效率从30%提升至93%。模型标志着AI从"聊天"走向"交付",国产算力正从备用选项转为核心资源。
AITNT 全球 AI 新闻 -
Action Map Policy:从高维动作回归到像素分类,一种新的机器人操作学习范式
美国东北大学黄浩杰提出Action Map Policy(AMP),将3D动作预测转化为像素级分类问题。通过将关键点投影到多视角图像平面,模型预测每个像素成为目标关键点的概率。实验显示,AMP在机器人操作任务中成功率比Diffusion Policy和ACT提升50%-70%,推理速度达13.80ms,可实现毫米级动作精度。
AITNT 全球 AI 新闻 -
27岁研究员连辞OpenAI、Anthropic!两家都在拿我们的命下注
27岁研究员Jacob Coxon连辞OpenAI、Anthropic,警告AI竞赛正在拿人类命运下注。他指出两家问题不同:OpenAI没看清风险,Anthropic看清了也停不下来。模型最快明年底可能开始自我改进,届时人类将失去控制权。1386名AI从业者联署《Pacing the Frontier》声明,要求建立国际刹车机制,但Coxon认为在刹车造出之前,行业仍在继续踩油门。
AITNT 全球 AI 新闻 -
助听器躺赚三十年暴利,被 AI 打破了
深圳听象科技旗下昂听和飞声两家深圳公司,借助AI技术将高端助听器价格降至原来的十分之一(约数千元)。昂听年销超1500万美元,美国亚马逊销量第一;飞声在日本众筹超300万美元。AI通过声音分离、增强、预测三项技术,将原本需专业验配门店完成的服务集成到手机APP,8毫秒内完成全链路处理,打破五大外资品牌三十年垄断格局。
AITNT 全球 AI 新闻