教育热点-"老师邀请妈妈生物课示范课怎么写"-谷歌DeepMind研究再登Nature封面,隐形老师邀请妈妈生物课示范课怎么写水印让AI无所遁形_ZAKER新闻

老师邀请妈妈生物课示范课怎么写谷歌DeepMind研究再登Nature封面,隐形老师邀请妈妈生物课示范课怎么写水印让AI无所遁形_ZAKER新闻

老师邀请妈妈生物课示范课怎么写谷歌DeepMind研究再登Nature封面,隐形老师邀请妈妈生物课示范课怎么写水印让AI无所遁形_ZAKER新闻

谷歌DeepMind研究再登Nature封面,隐形老师邀请妈妈生物课示范课怎么写水印让AI无所遁形_ZAKER新闻

本资料仅为服务信息,不作为个股推荐,不构成对投资人的任何实质性建议或承诺,也不作为任何法律文件。上述ETF风险等级R4,投资者在投资基金之前,请仔细阅读基金的《基金合同》、《招募说明书》和《产品资料概要》等基金法律文件,充分认识基金的风险收益特征和产品特性,并根据自身的投资目的、投资期限、投资经验、资产状况等因素充分考虑自身的风险承受能力,在了解产品情况及销售适当性意见的基础上,理性判断并谨慎做出投资决策,独立承担投资风险。文中提及ETF涨幅为二级市场价格涨幅,基金场内价格不代表基金净值,基金产品历史业绩不预示其未来表现,指数业绩不代表基金未来表现,产品详细业绩表现可以通过华夏官网查询。市场有风险,投资需谨慎。数据来源:上交所、深交所,2023年7月5日

君可知,我们每天在网上的见闻,有多少是出自 AI 之手?除了「注意看!这个男人叫小帅」让人头皮发麻,真正的问题是,我们无法辨别哪些内容是 AI 生成的。养大了这些擅长一本正经胡说八道的 AI,人类面临的麻烦也随之而来。(LLM:人与 AI 之间怎么连最基本的信任都没有了?)子曰,解铃还须系铃人。近日,谷歌 DeepMind 团队发表的一项研究登上了 Nature 期刊的封面:研究人员开发了一种名为 SynthID-Text 的水印方案,可应用于生产级别的 LLM,跟踪 AI 生成的文本内容,使其无所遁形。论文地址:https://www.nature.com/articles/s41586-024-08025-4一般来说,文本水印跟我们平时看到的图片水印是不一样的。图片可以采用明显的防盗水印,或者为了不影响内容观感而仅仅修改一些像素,人眼发现不了。但本文添加的水印想要隐形貌似不太容易。为了不影响 LLM 生成文本的质量,SynthID-Text 使用了一种新颖的采样算法(Tournament sampling)。与现有方法相比,检测率更高,并且能够通过配置来平衡文本质量与水印的可检测性。怎么证明文本质量不受影响?直接放到自家的 Gemini 和 Gemini Advanced 上实战。研究人员评估了实时交互的近 2000 万个响应,用户反馈正常。SynthID-Text 的实现仅仅修改了采样程序,不影响 LLM 的训练,同时在推理时的延迟也可以忽略不计。另外,为了配合 LLM 的实际使用场景,研究者还将水印与推测采样集成在一起,使之真正应用于生产系统。大模型的指纹下面跟小编一起来看下 DeepMind 的水印有何独到之处。识别 AI 生成的内容,目前有三种方法。第一种方法是在 LLM 生成的时候留个底,这在成本和隐私方面都存在问题;第二种方法是事后检测,计算文本的统计特征或者训练 AI 分类器,运行成本很高,且限制在自己的数据域内;而第三种就是加水印了,可以在文本生成前(训练阶段,数据驱动水印)、生成过程中、和生成后(基于编辑的水印)添加。数据驱动水印需要使用特定短语触发,基于编辑的水印一般是同义词替换或插入特殊 Unicode 字符。这两种方法都会在文本中留下明显的伪影。SynthID-Text 生成水印本文的方法则是在生成过程中添加水印。下图是标准的 LLM 生成过程:根据之前的 token 计算当前时刻 token 的概率分布,然后采样输出 next token。在此基础之上,生成水印方案由三个新加入的组件组成(下图蓝色框):随机种子生成器、采样算法和评分函数。随机种子生成器在每个生成步骤(t)上提供随机种子 r ( t ) (基于之前的文本 token 以及水印 key),采样算法使用 r ( t ) 从 LLM 生成的分布中采样下一个 token。通过这种方式,采样算法把水印引入了 next token 中(即 r ( t ) 和 x ( t ) 的相关性),在检测水印的时候,就使用 Scoring 函数来衡量这种相关性。下面给出一个具体的例子:简单来说就是拿水印 key 和前几个 token(这里是 4 个),过一个哈希函数,生成了 m 个向量,向量中的每个值对应一个可选的 next token。然后呢,通过打比赛的方式,从这些 token 中选出一个,也就是 SynthID-Text 使用的 Tournament 采样算法。如下图所示,拿 2^m 个 token 参加 m 轮比赛(这里为 8 个 token3 轮比赛,token 可重复),每轮中的 token 根据当前轮次对应的向量两两 pk,胜者进入下一轮,如果打平,则随机选一个胜者。以下是算法的伪代码:水印检测根据上面的赛制,最终胜出的 token 更有可能在所有的随机水印函数(g1,g2,...,gm)中取值更高,所以可以使用下面的 Scoring 函数来检测文本:把所有的 token 扔进所有的水印函数中,最后计算平均值,则带水印的文本通常应该得分高于无水印的文本。由此可知,水印检测是一个程度的问题。影响评分函数检测性能的主要因素有两个。首先是文本的长度:较长的文本包含更多的水印证据,可以让检测有更多的统计确定性。第二个因素是 LLM 本身的情况。如果 LLM 输出分布的熵非常低(意味着对相同的提示几乎总是返回完全相同的响应),那么锦标赛采样(Tournament)无法选择在 g 函数下得分更高的 token。此时,与其他生成水印的方案类似,对于熵较小的 LLM,水印的效果会较差。LLM 本身的熵取决于以下几个因素:模型(更大或更高级的模型往往更确定,因此熵更低);来自人类反馈的强化学习会减少熵(也称为模式崩溃);LLM 的提示、温度和其他解码设置(比如 top-k 采样设置)。一般来说,增加比赛的轮数(m),可以提高方法的检测性能,并降低 Scoring 函数的方差。但是,可检测性不会随着层数的增加而无限增加。比赛的每一层都使用一些可用的熵来嵌入水印,水印强度会随着层数的加深而逐渐减弱。本文通过实验确定 m=30。文本质量作者为非失真给出了由弱到强的明确定义:最弱的版本是单 token 非失真,表示水印采样算法生成的 token 的平均分布等于 LLM 原始输出的分布;更强的版本将此定义扩展到一个或多个文本序列,确保平均而言,水印方案生成特定文本或文本序列的概率与原始输出的分布相同。当 Tournament 采样为每场比赛配置恰好两个参赛者时,就是单 token 非失真的。而如果应用重复的上下文掩码,则可以使一个或多个序列的方案不失真。在本文的实验中,作者将 SynthID-Text 配置为单序列非失真,这样可以保持文本质量并提供良好的可检测性,同时在一定程度上减少响应间的多样性。计算可扩展性生成水印方案的计算成本通常较低,因为文本生成过程仅涉及对采样层的修改。对于 Tournament 采样,在某些情况下,还可以使用矢量化来实现更高效率,在实践中,SynthID-Text 引起的额外延迟可以忽略不计。在大规模产品化系统中,文本生成过程通常比之前描述的简单循环更复杂。产品化系统通常使用 speculative sampling 来加速大模型的文本生成。小编曾在将 Llama 训练成 Mamba 的文章中,介绍过大模型的推测解码过程。简单来说就是用原来的大模型蒸馏出一个小模型,小模型跑得快,先生成出一个序列,大模型再对这个序列进行验证,由于 kv cache 的特性,发现不符合要求的 token,可以精准回滚。这样的做法既保证了输出的质量,又充分利用了显卡的计算能力,当然主要的目的是为了加速。所以在实践中,生成水印的方案需要与推测采样相结合,才能真正应用于生产系统。对此,研究人员提出了两种带有推测采样算法的生成水印。一是高可检测性水印推测采样,保留了水印的可检测性,但可能会降低推测采样的效率(从而增加整体延迟)。二是快速水印推测采样,(当水印是单 token 非失真时)保留了推测采样的效率,但可能会降低水印的可检测性。作者还提出了一个可学习的贝叶斯评分函数,以提高后一种方法的可检测性。当速度在生产环境中很重要时,快速带水印的推测采样最有用。上图表明,在非失真类别中,对于相同长度的文本,非失真 SynthID-Text 提供比 Gumbel 采样更好的可检测性。在较低熵的设置(如较低的温度)下,SynthID-Text 对 Gumbel 采样的改进更大。

koa12jJid0DL9adK+CJ1DK2K393LKASDad

编辑:贾德善

TOP1热点:阿鬼演我随地大小看运势

(3)TRIX与股价产生背离时,应注意随时会反转。。

创维数字近1年股东户数变动明细见下表:

TOP2热点:阿鬼演我随地大小看运势

前述金融监管蓝皮书中的专题报告称,在净息差收窄、利润空间逼仄的背景下,中小银行通过自身利润转赠资本的空间收窄,中小银行风险高、化险难,兼并重组成为重要化险措施。

而在西凤酒的人事变革中,“少壮派”张周虎取代“酿酒大师”贾智勇,担任西凤酒股份公司总经理引发广泛关注。

TOP3热点:敖丙金刚杵汆肉莲

6月20日,广州开发区投资促进局表示支持,出具《关于支持TCL中环25GW太阳能电池生产基地项目用地的说明函》(穗开投促函〔2023〕899号),项目地块拟选址于永和工业区翟洞片区内,用地总面积约47.6万平方米。其中,一期地块面积为24.2万平方米,二期地块面积为23.4万平方米。目前项目用地申请已通过预审,项目地块分别预计于今年第三季度、第四季度招拍挂公开出让。

2、2020-2022年,广合科技计入当期损益的政府补助分别为3020.56万元、2227.77万元和1232.19万元,占当期净利润的比例分别为19.42%、22.04%、4.41%。

TOP4热点:春节第一零食好像卖不动了ZoomkooL牧场猪

壹玖壹玖酒类平台科技股份有限公司

那么开源技术现在也变得很重要,这是我用了梅院士的一张图,我经过他允许的,我已经用了不止一次了,那么开源原来我们主要还是指的是是软件的源代码的开放。但是数字时代,其实开源要成为一种创新理念和文化形态,它大概指的是共享共创的力量。这种技术创新,我们现在需要数据越多越好,开源可以汇聚那么多的开发者一起在平台上来开发。

TOP5热点:OpenAI首席执行官承认站在历史错误一边上面一边亲下边一面膜的简介

此外,广合科技也对2023年1-6月业绩进行预测,净利润下滑仍将延续。

从完善兼并重组措施的重点来看,一是优化扶持政策,避免过快“退坡”。对于实施并购重组的地方法人银行,既要“扶上马”,也要“送一程”,建议给予3年左右的过渡期,期间实施差异化监管要求,在业务资质取得、央行评级与监管评级、宏观深深评估、存保费调降、网点省内撤并和再布局等方面予以适当倾斜,支持机构有效化险、平稳发展。

TOP6热点:三专钢钢钢钢钢钢钢好多痛

四川九洲(000801.SZ)公告,公司2022年度拟向全体股东按每10股派发现金1.00元(含税),本次利润分配股权登记日为:2023年7月13日,除权除息日为:2023年7月14日。

王刚等人通过研究发现,当前我国中小银行兼并重组化险中存在的问题主要有五方面:

TOP7热点:全网都知道苏醒在迪拜买贵了人马喀戎怎么配置阵容

但个股市值体量、股性以及所处的市场环境不同均会导致TRIX指标策略的有效性不同。保守起见,策略哥特地回测了近几年辽宁能源相同指标形态的出现次数及后续影响,数据发现辽宁能源从2020年起共出现过21次TRIX金叉。

7月5日,同属广东的粤财控股、

TOP8热点:美国4天内4机坠毁134大但人文艺术

据路透社消息,当地时间4日,荷兰政府宣称,欧盟必须对中国有关镓、锗相关物项实施的出口管制做出回应。

易方达基金表示,新一轮国企改革有望推动基本面持续优化,看好央企估值持续修复机会。新一轮国有企业改革正在谋划实施,2023年有关部门开始试行“一利五率”指标体系,提升净资产收益率和现金流考核权重,将指引建筑央企继续提升经营效率,结合此前相关部门提出的探索建立中国特色估值体系,建筑央企有望迎来基本面和估值共振,我们继续看好估值仍处历史低位、业绩稳健的龙头企业估值持续修复机会。

TOP9热点:天津医院职工传播传染病系谣言粉色abb下载安装包怎么安装

手机毕竟深入生活娱乐的各方面,除了极致的电竞属性,红魔还对系统进行着重升级,不止游戏好用,日常体验也在线。REDMAGICOS8.0系统进行了1000+项体验优化,日用流畅度提升30%,同时新增30+项高需求功能。可以说红魔8SPro系列有着超越以往的全能优秀体验,不仅是电竞机皇也是全能旗舰。

转自:经济日报

TOP10热点:孟子义上节目穿几十块的衣服伊苏8龙形古代种

2023年以来,国家发改委多次就生猪价格波动发声。今年2月17日,由于猪粮比低于5:1,处于过度下跌一级预警区间,国家启动了今年第一批中央冻猪肉储备收储工作,收储量达2万吨。

阿根廷中央银行行长米格尔·安赫尔·佩塞接受采访时说,在阿根廷对外贸易和资本市场等领域,以人民币结算的交易正在增长。阿根廷央行与中国人民银行保持密切合作,双方正努力创造条件以进一步推动人民币在阿根廷的使用。

发布于:广州海珠区