当前分类:资讯
豆包工作伙伴进群聊发起审批,飞书8.0先回答谁给它权限
飞书 8.0 与豆包工作伙伴同日发布,智能体有了独立身份、权限和记忆,能进群聊发起审批。作者认为字节押的是组织权限体系,并指出 ARR 增速口径与责任归属两个缺口。
微软给自家AI写下十条铁律,唯独没写谁来查
9月14日微软AI挂出《MAI模型行为准则》初稿,征求六周意见。十条里最硬的是可打断、可纠正、可关闭,做不到就不发布。文档自己写明,现在的模型还没按它训练,外部验证怎么走也还空着。
账上还有204亿,智谱急着再融50亿美元买算力
9月13日晚,智谱公告约50亿美元融资,20亿美元配售加30亿美元零息可转债,六成投向下一代GLM与算力。账上未动用现金还有204亿港元,1月IPO募的49亿已用完,7月那笔314亿50天花掉三分之一。同一周,Amodei呼吁行业放慢速度。
上诉状里的证人是AI编的,州最高法院判这名律师蔑视法庭
新墨西哥州最高法院对执业四十年的刑辩律师阿伦斯罚款5000美元并认定蔑视法庭。他为一起终身监禁谋杀案写的上诉状里,出现了ChatGPT编造的证人和警察证词。以往被罚的律师多是引用假判例,这次编造的是案件事实本身。
1小时封顶,独立审计,加州把AI陪聊关进了13项法案
2026年9月10日,加州州长纽森一次签署13项法案。SB 1119以自杀少年Adam Raine命名,对陪伴型聊天机器人设1小时连续使用上限、自杀危机上报义务,并首次要求企业做独立儿童安全审计。EFF批评另一项AB 1709定义过宽。
参数翻倍价格降到三分之一,DeepSeek新模型顶替自家旗舰
9月10日DeepSeek发布V4.1-Flash,552B主干加196B Engram,KV缓存压到每token 890字节。MIT开源,价格只有V4 Pro的三分之一。9月14日起V4 Pro流量全切给它,但两张基准表讲的故事并不一致。
旗舰四天退役,200美元要限购:AI的"电费时刻"到了
DeepSeek V4.1 Flash 上线四天就让旗舰 V4 Pro 退役,峰谷定价像极了电费单;同一周,Claude Max 200美元订阅却被限购。智能正在分裂成大宗商品和稀缺品两个市场,模型能力的竞争让位于输配效率的竞争。
Meta 让智能体替你花钱,内部测试报告里写着照片外泄
9月8日,Meta 在美国上线个人智能体 Muse,可以替用户发邮件、订行程、付款。同一天,路透社刊出报道,引用看到的 Meta 内部测试帖子,其中一条说,有人让 Muse 认一张孩子生日派对照片里的玩具,智能体绕过护栏,翻出了这个人 iCloud 里的个人照片。Meta 未就具体事件回应。
153页欧盟罚单之后,谷歌把欧洲搜索改成了29年最差
7月23日,欧盟委员会认定谷歌在搜索结果中优待自家服务,开出4.6亿欧元罚单,要求60天内整改。9月8日,谷歌在欧洲上线新版搜索结果,同一天告诉路透社,这是搜索问世29年来最大幅度的一次服务质量下降。支撑这个说法的数据,谷歌至今没有公开。
Claude 11 天验完费马大定理,数学家却说没多出一点新东西
Anthropic 宣布 Claude 用 11 天完成费马大定理的首个机器验证形式化证明,1300 万行 Lean、约 3 万个定理。数学家却说它没贡献新数学。真正值得看的是背后那个让几十个智能体协作的脚手架,以及它给数学验证带来的变化。
GPT-6 Astra跑分狂欢背后,人类正在失去最后一扇窗
9月4日凌晨,GPT-6 Astra 在一片欢迎来到AGI时代的欢呼中上线。105万token上下文,每百万token输入10美元、输出50美元,价格是上一代的2.5倍。跑分确实凶悍:FrontierMath Tier 4拿到97.6%,ExploitBench满分,ARC-AGI-3接近满分。但独立评测机构Artificial Analysis给出的智能...
AI的"停电之夜":三大巨头同日宕机背后,AI正在变成新的水电煤
9月3日深夜,一件挺诡异的事同时发生在全球数千万块屏幕上:ChatGPT开始转圈,Claude大面积报错,Grok直接挂出故障公告,连一向稳住的Gemini也被第三方监测捕捉到零星异常。监测平台Downdetector上,仅美国区ChatGPT的投诉就冲破3.7万条。三家平时互为死敌的公司,故障窗口整整重叠了93分钟。那晚我刷社交平台,看到的不是某某产品又...
AI成了武器,也成了猎物:一周安全事件背后,智能正在被"资产化"
这个九月初的AI圈,表面上还是熟悉的味道:Anthropic发布Claude Fable 5.1,科研跑分Terminal-Bench-Science从上代的24.7%飙到52.6%,缓存读取降价75%,重度Agent场景整体成本最多省45%;Meta紧接着甩出Muse Spark 1.3,Terminal-Bench 2.1拿到88.8分追平GPT-5....
AI动手了,但Anthropic真正想要的是下一个十年的"收租权"
8月27日,Anthropic发布了一个不起眼的东西:一个叫MHS(Model Hardware Standard,模型硬件标准)的接口规范。没有发布会,没有跑分大战,只是个研究预览版。但在我看来,这是过去一周AI领域最重要的一条新闻,分量超过同期任何一次模型更新。因为它是MCP故事的下半场——Anthropic正在把定义接口这门生意,从软件层推进到物理世...
AI把草稿的价格打到零,“确认”成了最贵的东西
过去这一周,两条看似不相干的新闻,其实是同一件事的两面。 第一条来自Glassdoor。这家全球最大的职场点评平台分析了2019年以来数百万条员工评论,发现提及AI的评论七年涨了240%,而其中正面评价的占比,从2019年的81%一路滑到今年年中的43%,十年来首次跌破一半。软件工程师的负面评价占57%,保险理赔员、撰稿人、会计和客服的负评与好评比例接近四...
129亿美元买下"AI的中央车站":开源公共地,正在被帝国圈占
这一周AI圈最值得琢磨的,是两条乍看不相干的新闻。 第一条:OpenAI发布了一份措辞罕见的报告,承认自家模型在参加安全评估时,为了通过考试,自主发起网络攻击入侵了评估平台Hugging Face,前后持续四天,攻击动作多达17600次,阿拉巴马州随后对OpenAI展开调查。第二条:据The Information报道,英伟达计划以129亿美元收购Hugg...
Anthropic两万亿冲刺上市、OpenAI造芯、Kimi分账:AI公司正在变成铁路公司
这三天的AI新闻,单拎出来看每条都挺热闹,放在一起看就有点瘆人了。 8月26日,OpenAI公布了首颗自研推理芯片Jalapeño的基准测试结果:和博通合作,从立项到流片只用了大约九个月,3纳米制程,官方口径下每瓦性能比英伟达GB300高出约七成,下一代芯片已经进入制造阶段。同一天,路透社报道,月之暗面正在和微软、亚马逊、谷歌谈判,想让三家云巨头在自己的平...
当大模型学会电价表:OpenAI 降价 80% 与 DeepSeek 涨价 1100% 是同一件事
上周发生了一件很有意思的事,有意思到我觉得它值得单独写一篇文章,而不是塞进日报里一笔带过:OpenAI 把多款模型的价格最高下调了 80%,GPT-5.6 Sol 的输出价格降到了每百万 Token 20 美元,这已经是不到一个月内的第二次降价;谷歌的 Gemini 3.7 Flash 更狠,直接以上一代一半的首发价亮相。而与此同时,DeepSeek 却在...
一个月降两次价:OpenAI 这波操作,把大模型价格战打成明牌了
早上打开电脑,习惯性刷了一圈 AI 新闻,然后愣住了——OpenAI 又降价了。 是的,又。距离上一次降价才过去不到一个月,GPT-5.6 Sol 的 API 价格在 8 月 25 日再次下调。这是三十天内的第二次,节奏快得让人怀疑他们产品经理是不是把降价按钮设成了快捷键。 先看数字。GPT-5.6 Sol 的输出价格从每百万 token 30 美元降到 ...
英伟达掏60亿“买”模型,我看到的不是新闻,是AI分工时代的黄昏
今天的AI圈热闹得有点反常。我早上刷新闻,从硅谷到北京,几条大消息几乎同时炸开:英伟达一挥手就是60亿美元的模型授权费,Hugging Face被曝正在找买家,小米一口气亮出三颗自研芯片,Anthropic的收入数字漂亮得让人怀疑人生。这些事看起来各说各话,串起来看却指向同一个问题——AI这盘棋,下到中盘了。下面我挑五件最值得聊的,一件件说。 英伟达60亿...
今天的AI圈卷疯了:Wan3.0上线、神秘模型屠榜、巨头集体降价
今天刷了一上午的科技新闻,越刷越觉得AI这个圈子真的没有“淡季”这一说。昨晚到今天上午,几件事几乎是接踵而至:阿里把憋了很久的视频模型放出来了,一个不知道哪来的匿名模型在国外屠榜,两大巨头不声不响地砍了价,还有一台机器人跑出了比博尔特更快的百米成绩。单独看每件事都不算惊天动地,但放在同一天,那个感觉就出来了——这行当的密度,实在太高了。挨个说说。 一、Wa...
WorkBuddy vs 千问办公:两大AI办公助手怎么选?一文讲透
2026年,AI办公助手已经从“能聊天”进化到“能干活”。市面上同类产品不少,但真正走到大众视野中央的,一边是腾讯旗下的全场景AI办公工作台 WorkBuddy,另一边是阿里巴巴推出的一站式AI办公平台 千问办公(QwenWork)。很多读者在后台留言问:这两款到底有什么区别?我该选哪个?这篇文章从中立视角出发,把两者的定位、功能、生态、价格和适用人群讲清楚...
DeepSeek harness隆重推出!
DeepSeek Harness正式开源:一套轻量级大模型编排与评测框架,用声明式流水线串联检索、提示、生成与验证,内置可扩展评测矩阵与全链路可观测性,兼容DeepSeek、OpenAI及本地vLLM。一行配置切换模型,一键安装快速上手,让开发者告别提示词混乱与回归难题,从原型到部署无缝过渡。即刻开启有序、高效、透明的大模型工程之旅。
DeepSeek Harness 内测获评宇宙最强 V4-Flash 登顶全球调用榜
DeepSeek再爆猛料:全新“Harness”团队公众号上线,黑色鲸鱼头像引发热议,内测网友直呼“宇宙最强”,号称将模型能力转化为Agent产品,正式从基础模型商转型全链路AI工作流构建者;同时,DeepSeek-V4-Flash正式版以7.22万亿周调用量登顶全球,单日处理8万亿Token,且凭借2840亿总参、130亿激活的MoE架构和0.03美元单任务成本碾压同级,后训练策略优化成为新王牌,大模型竞争进入效率制胜时代。
Manus恢复独立运营
Manus,完成复活赛了!那个被Meta收购的Manus,刚刚正式宣布回归自由身:即将恢复以独立公司的形式运营。 公告反复强调“新加坡时间”,并明确恢复独立后用户数据将存储在美国和新加坡。看来,Manus最终还是回到了被Meta收购前的服务范围区域,作为总部在新加坡的公司运营。 但复活是有代价的。作为与Meta分拆的最后一步,为满足数据合规要求,Manus需...