当前位置:我的网站主页 > 我的网站国内 > 我的网站内容

龙门镖局

“祥蛇纳福迎新年 童趣盎然启华篇” 崇文小学2025元旦联欢活动_我的网站

少年派的奇幻漂流

一 |     祥蛇纳福,     新岁将至。

二 |     家人们,就在刚刚,Google正式发布了Gemini 3.6 系列模型!          这次登场的一共三个模型:          面向普通用户和开发者推出的通用模型 Gemini 3.6 Flash:               输出 token 消耗减少了约 17%,在 DeepSWE 上最高减少 65%          输入:1.50 美元/百万 token          输出:7.50 美元/百万 token               主打低成本和高吞吐的 Gemini 3.5 Flash-Lite:               输入 $0.30/百万 token          输出 $2.50/百万 token               面向网络安全场景的 Gemini 3.5 Flash Cyber:      定价还没曝光,目前只给政府和还有Google定的受信任的合作伙伴限量开放               在正式开始详细介绍前,先给大家打一针预防针:          如果只看跑分,这次更新可能没有想象中那么炸裂—Gemini 3.6 Flash 的综合智能水平与上一代基本持平,代码能力也没有横扫同级模型,但是效率绝了!          Gemini 3.6 Flash          Gemini 3.6 Flash 是 Gemini 3.5 Flash 的升级版,也是这次发布的主角。

三 |          根据 Artificial Analysis 的发布前测试,Gemini 3.6 Flash 在 Intelligence Index 上拿到了50 分,与 Gemini 3.5 Flash 持平(Ps:从综合智能表现来看,可以说完全没有实现代际跃升):          在Gemini最擅长的知识类工作的基准GDPval-AA v2 上取得 1421 Elo,比上一代高 72 分:          它真正值得一说的提升,在速度和效率上。         Gemini 3.6 Flash 完成单项任务的平均时间从 2.7 分钟降至 1.3 分钟,缩短了一半以上;输出速度达到 每秒 304 个 token。与此同时,它的输出 token 消耗减少约 17%,在 DeepSWE 等特定任务上,降幅最高可达 65%。    在这辞旧迎新的美好时刻,我们的学校也被欢乐与期待填满,一场精彩纷呈的新年联欢会盛大启幕,宛如一幅绚丽多彩的画卷,在祥蛇纳福的旋律中,徐徐展开童趣盎然的华篇。

四 |           HAPPY NEW YEAR                              翰墨飘香 联韵寄情                              春联,是新年独特的文化符号。校园里翰墨飘香,一场别开生面的春联书法展示吸引了众人目光。         虽然没有更聪明,但是确实做到了能用更少的 token、更短的时间完成同样水平的工作。         Gemini 3.5 Flash-Lite          Gemini 3.5 Flash-Lite 面向的是另一类需求:高并发、低延迟和大批量任务。师生们齐聚一堂,挥毫泼墨,笔走龙蛇间,一个个刚劲有力、飘逸灵动的书法字跃然纸上。

五 | “祥蛇纳福迎新年,瑞气盈门映笑颜”等一幅幅饱含美好祝愿的春联,不仅展现了深厚的书法造诣,更传递出对新年的憧憬与期待。孩子们红扑扑的脸蛋上洋溢着专注与兴奋,他们在传统文化的滋养中,感受着笔墨纸砚的独特魅力,用稚嫩却认真的笔触,书写着对未来的无限向往。

六 |                              光影贺岁 共鉴新景                              师生们齐聚一堂,通过视频回顾这一年的精彩活动瞬间,视频中洋溢着孩子们的欢声笑语。         它在 Intelligence Index 上取得 36 分,相比 Gemini 3.1 Flash-Lite 的 25 分提升了 11 分。

七 |          进步最明显的是智能体相关评测:GDPval-AA v2 提高 498 分,TerminalBench v2.1 提高 22.5 个百分点,Tau3-Banking 提高 7.8 个百分点。随后,大家一同观看贺岁短片。         速度同样是它的核心卖点,平均每任务用时从 1 分钟降至 0.6 分钟,输出速度达到 每秒 350 个 token。大屏幕亮起,一段段精彩的画面将大家带入了充满欢乐与温情的新年世界。         不过,Gemini 3.5 Flash-Lite 的单次任务成本不降反升,从 0.04 美元增至 0.09 美元。短片里,小歌唱家们引吭高歌,清脆悦耳的歌声如潺潺溪流,流淌着新年的喜悦与希望;小演员们表情丰富,表演生动,把一个个小故事演绎得扣人心弦。         主要原因是输入和输出价格分别从每百万 token 0.25 美元和 1.50 美元,上调至 0.30 美元和 2.50 美元。

八 | 尽管平均每任务的输出量已从 2 万 token 降至 1.3 万 token,但仍不足以抵消价格上涨带来的成本增加。小观众们的眼睛里闪烁着好奇与快乐的光芒,他们时而因幽默的情节捧腹大笑,时而被温馨的场景深深打动。在这光影交错的时刻,大家共同领略着新年的多元魅力,也在心底默默种下了对新一年的美好种子。                   才艺荟萃 童星闪耀                              才艺展示环节将联欢会的气氛推向了高潮。         Gemini 3.5 Flash Cyber          除了两款通用模型,Google 这次还公布了一个更垂直的成员:Gemini 3.5 Flash Cyber。         CodeMender 是 Google 的代码安全代理,主要任务就是是在代码中发现安全漏洞,并进一步生成和验证修复方案。这次出的Gemini 3.5 Flash Cyber 将作为CodeMender的核心模型,服务于漏洞查找与修复流程。舞台上,同学们各显神通,宛如一颗颗璀璨的童星闪耀光芒。

九 |          按照 Google 的说法,它在代码安全任务上的表现达到了非常具有竞争力的前沿水平,并且运行成本也低于体量更大的模型。         Gemini 3.5 Flash Cyber 更像是 Google 对“专业模型+智能体”路线的一次验证: 以更轻量的 Flash 为底座,通过安全领域优化和专用代理,把模型能力集中到一个明确的高价值任务上。歌声悠扬悦耳,一曲《新年好》唱出了孩子们内心的喜悦与对新年的期盼;舞蹈活力四射,欢快的节奏带动着全场的气氛,仿佛祥蛇舞动,带来勃勃生机;乐器演奏精彩纷呈,清脆的钢琴声、激昂的架子鼓声交织在一起,奏响了新年的华丽乐章。

十 | 还有幽默风趣的小品表演,小演员们惟妙惟肖的表演让台下观众笑声不断,掌声雷动。每一个节目都凝聚着孩子们的努力与热情,展现出他们丰富多彩的才艺和无限的创造力。         HAPPY NEW YEAR          祥蛇纳福,为校园披上了节日的盛装;童趣盎然,让新年充满了希望与活力。         安全代理往往需要持续扫描大型代码库、分析大量上下文,并反复验证修复结果。相比一味调用最强、最大的通用模型,针对网络安全任务优化的轻量模型,更有可能在能力、响应速度和运行成本之间取得平衡。这场新年联欢会,不仅是一场视听盛宴,更是孩子们成长路上的珍贵记忆。愿在新的一年里,孩子们带着这份欢乐与梦想继续前行,在知识的海洋里畅游,在生活的舞台上绽放更绚烂的光彩。不过,Gemini 3.5 Flash Cyber 暂时不会向所有开发者开放。

十一 | 让我们共同期待,未来的日子里,校园里会奏响更多美妙的乐章,书写更多动人的篇章!                                        END                              文稿撰写:董雅倩     图片素材:信息组     页面排版:周琳 陈彬彬          文字编审:张娟          责任编审:蔡媛媛                                        新          年          快          乐          【官方订阅号】                                        【官方视频号】。它将通过 CodeMender 独家提供,仅面向受信任的合作伙伴开展有限访问试点。

十二 |          单看代码表现          在 Arena 公布的前端代码竞技场排名中,Gemini 3.6 Flash 以 1537 分位列第 12 名,相比 Gemini 3.5 Flash 的第 21 名有明显进步。         结语          目前,Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 正在 Gemini App 中陆续上线,开发者也可以通过 Google AI Studio 和 Android Studio 的 API 使用新模型。         至于正在内测的 Gemini 3.5 Pro,以及已经开始训练的 Gemini 4,或许才是 Google 留给下一次能力跃升的真正看点。

十三 |          最后,关于 Google 这次发布,我还有几句话想说          过去的大模型发布,最容易传播的是跑分又涨了多少,但是这几次跟Google家感觉已经不恋战了。

十四 | 它已经不太愿意继续纠缠于单纯的跑分竞争了。         Gemini 3.6 Flash 交出的依然还是近两年非常具有Google味儿的答卷:          综合智能分数可以不变,只要任务速度翻倍、token 用量减少、输出价格下降,模型依然能够获得非常实际的竞争力。

十五 |          可能有人会问:是不是 Google 已经卷不动了?          但在我看来,这更像是大模型竞争进入下半场的一个信号。

十六 |          当头部模型之间的能力差距逐渐缩小时,开发者真正关心的问题会越来越具体:同一个任务需要等多久?一次调用要花多少钱?长上下文是否稳定?能不能支撑大规模并发?          从这个角度看,Gemini 3.6 Flash 是 Google 又一次明确面向落地效率的升级。

十七 |

Current article:http://7o1.bomanglangsugangunxileba.cyou/4y2zl0w/5fm.html

Published on:18:25:35