关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
价值2999的《AI 爆文全套课程》
课程深入探讨 AI 写作工具的应用与技巧,涵盖 AI 写作原理、公众号定位、实用工具推荐、创作流程优化及案例分析,帮助学员掌握 AI 写作方法,提高创作效率与质量,爆发增长!
https://pan.quark.cn/s/a7ef1216fc31

AI探索 | Hermes/OpenClaw优质资源优质信息
跟模型厂商合作了三次首发测试
第一次,价格很好,模型不行
第二次,模型很好,价格不行
第三次,模型很好,价格很好
期待不要作妖坐地涨价 😂
@aigc1024
Seedance 2.5 正式发布
单次生成最长 30 秒
最多支持 50 个参考素材输入,角色、道具、风格等参考可以一次全塞进去
Seedance 2.5即将登陆 Higgsfield
先看看这段演示绝对的颠覆现有你对AI视频的认知,镜头运用、特效、人物的表现完全是电影级的
而且是一次生成出来的,没有分段拼接...
不可思议

AI探索 | Hermes/OpenClaw优质资源优质信息
而成——很像 Agent 调用 Skills。
2. 仿真示范可以直接提示真实机器人
GEN-1.5 的预训练数据不包含仿真数据,但它可以把仿真环境中的动作轨迹当作 Prompt,在现实中完成相应任务。这不等于彻底解决 sim-to-real,但意味着仿真数据可能不仅能用来训练,还能在推理时直接定义任务。
3. 人类可以直接用手示范
在部分任务中,人类在机器人摄像头前用自己的手完成动作,机器人随后可以用机械手复现。这是在跨越 human-to-robot 的 embodiment gap。
4. 它开始从复制轨迹走向泛化“策略”
训练示范使用刷子把方块扫入碗中,模型面对新工具时会:用香蕉充当刷子;用簸箕铲起方块再倒入碗中;换手操作;移开障碍物;在物体卡住时用另一只手解围。
真正有价值的是,模型似乎学到了“把物体送入容器”这一目标,并能重新组合已有动作知识。
四、它是不是机器人领域的 GPT-3 时刻?
在能力范式上很像,但在成熟度上仍未达到相同阶段。
它像 GPT-3 的地方在于:随着预训练规模扩大,模型没有被显式训练,却涌现出 one-shot in-context learning。任务适配开始从“修改参数”转向“提供上下文”。
但必须看到四个限制:
•目前主要是简单、短时、原子级操作任务;
•one-shot平均成功率只有59%,远低于工业部署要求;
•评测仅覆盖10项任务,且由公司自行设计和披露;
•尚未公开足够完整的模型架构、训练数据、失败分布和独立第三方评测。
GEN-1.5 展示了机器人版 in-context learning 的规模化涌现迹象,但尚未证明它已经成为可稳定部署的通用机器人模型。
五、产业和投资含义
如果这条路线继续成立,具身智能价值链会发生三项变化。
第一,任务适配成本可能断崖式下降。
第二,物理数据引擎成为真正的Scaling基础。
第三,机器人也将出现Context与Harness层。
未来机器人系统可能由四层组成:
•基础具身模型;
•用户和场景的物理Context;
•可组合的Physical Skills库;
•负责安全、验证、记忆和技能调度的具身Agent Harness。
2026年6月,Generalist完成4亿美元融资,投后估值20亿美元,累计融资超过5亿美元。投资者包括Radical Ventures、8VC、USV、NVIDIA、Bezos Expeditions、Norwest,以及李飞飞、林斌等。
https://generalistai.com/blog/gen-1.5
@aigc1024
GEN-1.5 导读:具身智能的“Prompt 时刻”
GEN-1.5 最重要的突破,是它开始像大语言模型一样,把示范当作 Context,直接用于理解和执行新任务。
GEN-1.5 展示了一条新路径:给机器人看一段 3—12 秒的动作示范,不更新参数、不做微调,它就能推断人类意图并立即执行。Generalist 将其称为 Physical Prompting(物理提示)。
GEN-1.5 是近期具身智能领域非常值得重视的进展。它最重要的意义已经超越59%或83%的成功率:它第一次比较清晰地展示,当物理预训练跨过某个阈值后,教机器人新任务可能不再需要专门训练,而会逐渐转化为Prompt和Context Engineering问。
下一步真正决定其产业价值的,是能否把这套能力从十几秒的原子动作,扩展到分钟级、多步骤、开放环境任务,同时把成功率提高到95%—99%以上。
一、GEN-1.5 到底是什么?
GEN-1.5 是一个端到端的机器人多模态基础模型:
•输入:视频、语言、传感器信号和机器人本体状态;
•上下文记忆:30 秒;
•输出:100Hz 的连续动作轨迹;
•核心能力:通过示范进行 one-shot / few-shot 学习,并在新物体、新环境和新工具上泛化。
这里的 Prompt 从一句扩展为一段包含视觉、动作和传感器信息的“身体经验”。用户可以把几秒钟的示范直接放进模型上下文,机器人一边记住示范,一边根据实时视觉闭环执行。这相当于把:“给机器人编程”变成:“做给机器人看”。
二、核心数据怎么看?
GEN-1.5 在10项未专门训练的短时操作任务上取得:(图)
相比之下,传统机器人策略学习经常需要成千上万次梯度更新。GEN-1.5 用10步微调,模型权重变化不到0.15%,说明它很可能是在用少量示范激活预训练阶段已经形成的物理知识,而非从头构建一项新技能。
GEN-1解决的是可靠性:用约1小时任务数据,把简单任务成功率提高到99%以上;
GEN-1.5解决的是适应速度:用几秒钟获得基础能力,再用几分钟接近可用水平。
三、真正值得重视的四项能力
1. 物理Prompt可以组合
分别给模型看“拉开拉链”和“从包里取出钞票”,GEN-1.5 可以把两段示范拼成一个连续任务,并自行生成示范中没有出现的换手、重新抓取和衔接动作。
这意味着未来复杂机器人技能可能不必整体采集,而是由一组可复用的“物理技能片段”组合
今日分享一款本地数据管理工具:WeFlow
支持 Win / Mac / Linux,适合做本地聊天数据整理、记录查看和内容归档管理。
对于有聊天资料整理需求的人来说,实用性还不错。
工具地址:
https://github.com/hicccc77/WeFlow/releases

@meiriyishu
我很好奇,有没有人从各种体验和细节上比较一下腾讯元宝、字节豆包、阿里通义千问(手机chatbot app,不是Qwen LLM model本体)到底有什么体验上的区别?
字节豆包到底是如何逐渐拉开差距,领跑一个身位的?

AI探索 | Hermes/OpenClaw优质资源优质信息
《打动自己,知难而进》冯骥
1、首先打动自己。
无论何时,请把自己与团队当作最优先的目标用户。
这是公司成立至今的价值观,我总是翻来覆去说这句有点拗口的——
“必须做开发者自己作为用户也理解、认可、喜爱的游戏。”
这不单是情怀,也是理性的产品策略。
如果你对正在做的东西缺乏非功利的热诚,你的直觉就会开始迟钝。
时间一长,大概率输给那些比你更乐在其中的人。
2、再找外部交集。
打动自己,不意味着孤芳自赏。
市场数据、用户反馈和商业上的可持续都很重要。只有组织活下来,集体认知才有机会成长,团队能力才有时间变强。
呼应第一点,我想强调的是,对内容产品而言,先在外部找到与自己个性、趣味、喜好相近的人,通常比试图讨好所有人更高效。随着受众规模扩大,开发者与用户的相似度可能逐渐降低,但这个过程更类似从核心向外自然扩散,而不是一开始就在茫茫人海里碰运气。
世界很大,没有谁真的独一无二。能深深打动自己的东西,往往也能打动世界上的另一群人。
创作过程的每一处用心,都一定会被懂你的用户感受到。
3、发现亮点,先于消灭缺陷。
与其先想着如何征服不喜欢你的人,不如先尽力满足喜欢你的人。
伟大的游戏也绝非面面俱到,这个世界存在太多的不可能三角。资源永远有限,完成度永远不够,目标之间永远存在取舍与矛盾。比“还有什么地方不够好”更重要的问是:有没有什么体验,只有在我这里才能玩到?
再往大一点说,一家内容公司存在的意义,也许就是让一部分人觉得:幸好这个世界上,还有人做出了这样的玩意。
4、可体验的版本,胜过满纸雄文。
文档可以解释意图,数据可以辅助判断,会议可以统一认识,但游戏实际上更接近一种综合的、复杂的、甚至有些混沌的沉浸状态。
内部判断产品风险时,我始终更相信真正跑起来、打起来、死上几次之后的感受,以及观察同事们在作为玩家时的真实反应。然后才据此去敲定某些拿不准的设计,或者放弃之前看上去牛逼的创意。
具体到每一次对外发布的实机视频,希望传递给大家的也是同一件事——
“看到后,能轻易想象自己亲手玩起来的样子。”
5、好玩是目标,也是底线。
这一条就不展开了……总之如果内部版本不够好玩,那就再调查调查,反思反思,学习学习,迭代迭代,重构重构,再多玩玩其他游戏,嘻嘻。
6、美无定式。
没有一种风格永远高级,也没有一种信号永远刺激。
再惊人的美学符号,反复出现也会失去最初的力量。美,更像是一种认真创造的陌生感。
说到底,神经传导会适应,多巴胺奖励会消停,人会厌倦一再重复的事物,这是创作者永远逃不出的无间狱。
前几天,我和佳骐(声音负责人)扯到这个,顺手编了句打油诗来比喻:美无恒美,法无定法。多见易俗,少见易雅。他说,滚,两面都让你说了,狡猾。
嗯,那个,反正,我要表达的意思是,或许不必追求找到一套万用万灵的美学公式,而是应该不断探索还有什么好的表达方式,其中既有技艺,又有新意。
7、走投无路,提升密度。
大部分时间里,我们其实找不到什么更聪明、杠杆更大的办法,去提升产品的竞争力。
这个时候,在那些已经被验证的亮点上继续增加有效密度,通常不是一个坏选择。
比如更细腻的粒子,更茂密的植被,更丰富的动画,更精确的打击反馈,更多样的妖魔鬼怪,更大的显存(bushi)……不是说无脑堆参数与资源就一定好,前提是这些内容的确是被验证过的亮点,而且依然能让用户感知到差异。
想不到妙手是游戏开发的常态,不妨先把每一步本手下扎实。
8、起点看最高,终点当领跑。
对同领域的当家花旦们,最好如数家珍——哪里玩到昏迷,哪里气到爆炸,哪里不知所措,哪里眼睛哭花。
然后去搞清楚——它们各自采用了何种开发模式、设计方法、制作工艺与技术标准。
最后反复思考——什么能学,什么学不得,什么要虚心,什么要创新。
游戏并非必需品,深入体验与研究标杆的另一重价值,是让我们对这个品类三五年后的及格线会有多高,大致心里有数。
取法乎上,把对标杆的认知当成制作自家demo的起点,绝不是坏事,哪怕暂时高山仰止。
但是,如果长期目标是“做到和某某差不多”,有点危险。
尊重标杆,学习标杆,是为了最终建立自己的尺度。
想登顶,想一览众山,想创造前所未有的新标杆——这不是自不量力,是宝贵的冲劲与志气。
要敢想。
9、难能,可贵。
充分竞争的成熟市场,鲜有低垂的果实。任何容易解决的问与需求,要么不存在后来者的机会,要么很快会被竞争对手挤满。
这一点我有切身体会。刚创业时,以为小公司只要选一个自己理解的赛道,做得比大厂快一点,玩法、剧情、画面、声音什么的有点小特色就够了。但事后看,这种所谓高执行力+低成本创新带来的价值微薄而脆弱,用户也很容易闻出这种速成产品的敷衍味道。
一直做相对容易的事,反而惶惶不可终日。
所谓护城河的本质,便是拥有难以被轻易取代的价值。
当我们被某样事物深深打动时,它往往是稀缺的、非凡的、来之不易的,而人们似乎天生就会被“哇这是怎么做到的”的魅力所吸引。
2019年的公司年会,我用八个字总结游科前五年的状态:东搞西搞,投机取巧。
也是在那年,在公司原来价值观“打动自己”外,又加了四个字——
知难而进。
10、理念是廉价的,但贯彻理念的行动是可贵的。
知行合一不是什么新鲜道理,但我加一句暴论:很多时候,行是知的前提。
因为咱们脑中的理念很有可能是肤浅的、偏颇的、错误的,只有贯彻理念的行动与现实发生了真实的碰撞,才能看清:这个世界与我们原先想的到底哪里一样/不一样。
有时撞得太猛,世界太硬,把我们原先的理念撞成了一地碎片。
没关系,正好一片片捡回来,慢慢拼出新的模样。
然后,再撞一次。
@aigc1024
大气的金主给我充了些积分,还有很多没用完,看了下够做一个四五分钟的视频。
根本舍不得乱用,下次做AI视频商单能省点成本。

AI探索 | Hermes/OpenClaw优质资源优质信息
最近存了不少DeepSeek的图,很多都不能放出来…这张可以放hhh🤨
@aigc1024
⚡️⚡️⚡️⚡️😂😂😂😂
2026世界杯官方指定投注平台

➡️ 豪礼大放送、高端嫩模、劳力士手表、奔驰E300 加入 #182体育 等你领取, 电子可拉2万一注

🌐182体育官网 1820036.com
TG玩家首选人民币台 不限ip 免实名免绑卡手机号码

🌐8K国际官网: 8k2793.com
TG玩家首选U台 U存U提出款稳,福利好反水无上限


😀😀😀😀😀😀😀😀😀😀😀😀😀

1.
PG电子赏金女王一举斩获830万并成功提现
2
.PA真人豪赢644万一路长虹一天实现暴富
3
.PG电子爆890万并以成功提现实现财富自由
4
.大哥在PA真人百家乐累计盈利突破1000万

🔤🔤🔤🔤 以及C币,K豆,OKpay、👌微信,👌支付宝,银行卡等30多种存取款方式,通畅便捷

大额出款额外奖励8888-128888,双重日存彩金128888+4688每日送,周流水彩金68888每周送,双重签到彩金16888+3888送不停

😅😏😃😃🙃😢😅😚😍😀😏😝
【 182体育 全网独此一家】
公平、公正、公开、 信誉第一、服务第一
不限ip、 免实名、免绑卡、免绑手机号码
每日存款彩金每日送,每笔存款加赠1%
🤩🤩🤩🤩🤩🤩🤩🤩🤩🤩🤩🤩

182体育频道: @vip182ty888
8K国际频道:
@GW_8KGJ
专属客服:
@vipkf_182ty8
体育推荐:
@VIP182TYTJ
双向联系:
@vipkf_182ty2_bot
吃瓜搞笑:
@chiguagaoxiaoxinwen


💰 8K国际网址: 8k2793.com
💰182体育网址: 1820036.com
😀😀😀😀😀😀😀😀😀😀😀😀😀

🤑 铂莱娱乐 8年老品牌 广告费每月投入高达500万U,全网担保上押1300万U,送“野鸡黑台”一句话,勿伤玩家利益,勿毁博彩信誉。

🫢 【贵宾会 750.cc 】 强势启航,集团背书,信誉担保,全网首发,引爆彩票娱乐新纪元!六合彩49倍 挑战全网心水 全民代理全民收单 助您白手起家 加拿大28全网最高赔率 挑战全网公式

🏃‍♀️ 很多平台热衷于宣传玩家中奖,却对中奖后的“漫长审核”“异常冻结”闭口不谈。

😀 就在本月,PG电子爆出200万u巨奖。本金仅为5000u……

😎 截至目前:200万U 已极速下发,单笔提款百万u秒出,亿级储备金硬核坐镇,不要去考验小盘的良心,要选就选大盘的实力。

🌟 当无数野鸡网在生灭中挣扎时,铂莱始终屹立不倒。这就是我们送给全行业最响亮的耳光!

😀😀😀😀: @BLKF0
😀😀😀😀: @bolaidaili
🟢🟢😀😄: @bolaiylc_bot
😀😀😀😀: @BLzhaoshang
😀😀😀😀: bolai178.cc
拿到Grok4.6马上和GPT ,Claude在实际使用上对比,有点意外,这个Grok4.6 high 已经和GPT 5.6 sol max,Fable 5差不多了,
乖乖,老马真的厉害👍

AI探索 | Hermes/OpenClaw优质资源优质信息
感觉具身智能现在虚得很呀
不过也看到了很多这几年可能容易跑出来的具身智能的项目。但是我想说,他们大部分都不是人形机器人,而是不像人的具身智能机器人。我觉得这种能跑出来并且做出成果的概率比人形机器人高太多了
那些纠结于是不是人形的,我觉得大概率会是做一个概念,可能就是用资本故事吧
@aigc1024
😂😂😂😂 😂😂😂😂
老品牌,值得信赖、相信品牌的力量

➡️ 豪礼大放送、高端嫩模、劳力士手表、奔驰E300 加入 #球速体育 等你领取, 电子可拉2万一注

🌐球速体育官网: qs1736.cc
TG玩家首选人民币台 不限ip 免实名免绑卡手机号码

🌐N1国际官网: n10086.com
TG玩家首选U台 U存U提出款稳,福利好反水无上限


😀😀😀😀😀😀😀😀😀😀😀😀😀

1.
泰国大老板百家乐存50万出512万
2.
斯里兰卡神秘大哥连续5天总提4000万+
3.
实力盘总PA真人喜提990万一路爆红
4.
pp电子糖果1000小注一拉爆出70万大奖

🔤🔤🔤🔤 以及C币,K豆,OKpay、👌微信,👌支付宝,银行卡等30多种存取款方式,通畅便捷

大额出款额外奖励8888-128888,双重日存彩金128888+4688每日送,周流水彩金68888每周送,双重签到彩金16888+3888送不停

😅😏😃😃🙃😢😅😚😍😀😏😝
【 球速体育 安全有保障】
老品牌值得信赖、安全第一、保障第一
不限ip、 免实名、免绑卡、免绑手机号码
每日存款彩金每日送,每笔存款加赠1%
🤩🤩🤩🤩🤩🤩🤩🤩🤩🤩🤩🤩
球速体育频道: @qsty8999
N1国际频道:
@N1GW8
体育推荐:
@QSTY988
午夜剧场:
@ziweifancha7
专属客服:
@QSTY567
双向联系:
@qsty168168_bot


💰 N1国际网址: n10086.com
💰 球速体育网址: qs1736.cc
《捞偏门》:揭秘快速赚钱项目与灰色产业链内幕
整理了各种快速赚钱方法与新兴项目,书中不仅揭开了灰色产业链的内幕,也提醒读者防范骗局,避免被割韭菜。
🔗https://pan.quark.cn/s/4df427340d5e

@meiriyishu
飞书cli 这种牛逼的东西,却因为飞书的技术架构,不得不让用户背负着巨大的理解成本,可以说这也是一种新旧时代交替的副作用了。
飞书的设计是经典的saas多租户的结构。要想使用飞书的api,就需要在飞书开发者后台创建一个新的应用,应用有两套权限,第一套是应用自己的,也就是应用跟员工平级,应用可以操作飞书里各种套件,比如文档啥的,操作的留痕就是应用。第二套是一种代理授权机制,也就是先让员工授权,把权限交给应用,应用去做事,但是留痕都是这个员工的。然后!这个应用有个机器人功能,可以让应用以一个机器人的面貌跟其他员工对,那这个机器人是啥权限呢,也是应用权限。
好,以上没有任何毛病,其实真研究明白了还挺清晰的。以前这里的复杂都是程序员来消化的,普通人难以得见,也不需要为此头疼。
但是有一天飞书cli发布了,这个团队极其的勤奋,144天狂发88个版本,平均1.5天发一版,功能的开放性也是超级炸裂,什么鸡儿都往里面加。之前飞书的功能开放全靠服务端api,这个api的更新是多久一回呢,基本上以季度来做节奏。当时官方飞书cli还没有发布时,我已经利用这批api做出了自己的飞书cli,当时就发现api开放性很差,很多细节都不提供api(比如文档发/回复评论)。完事官方的cli一发布,我做的cli立刻变成了小丑,因为官方cli里的api实在是太丰富了,远超之前的api体系。
于是,以上复杂的权限体系,庞大的功能,全部塞到这个cli里。按大的功能模块分组,官方提供了一堆skill来驱动Agent使用cli,牛逼也是真牛逼,但理解成本也真的很高。
首先是每个员工都要创建一个应用,每个员工!飞书已经对这个流程做了极致的简化,会引导你一键创建一个应用,但是,公司里创建应用首先是要审批的,创建了也不能立刻用上。再就是,很多小白员工发现一次居然不行,拿起小鞭子就让Agent反复创建应用,实际创建了一大堆!小白也不知道最终用的是哪个了!管理员你就审吧~
其次是权限,飞书的应用权限有 130 个,用户权限 139 个,你就配去吧,绝大多数人根本理解不了为什么权限会分为应用和用户,只能Agent说什么就做什么。然后还把两个权限的切换交给了cli,由Agent按需去用,实际最终的结果就是所有权限全打开了。那捏吗的还配置个der啊,直接默认全开不就好了吗?
再就是这个机器人,飞书cli的客服群里经常有人问,我都配置好了飞书cli了,为啥我的飞书机器人还是不回复我呢?对啊,为啥呢?说实这个问很难一句解释,因为经过一些骚操作,飞书cli确实也能让机器人跟员工对。但问在于,当你把这一大堆名词概念都推到小白前额叶的时候,大家都只能凭直觉去感受这耷拉着的AGI啊。
不过又说回来,这可能正是卖课的空间?由于这个架构的存在,这里的理解成本总是无法被消解的。也许精通AI的代价就是成为程序员的形状。
@aigc1024
lash是31分,已经不太适用通用场景了,只能用在特定的细分领域。
比如它们都突出一个「快」字,主攻高速模型的品类,聪不聪明你别管,就问有没有秒回吧,在不追求解效果的工业化任务里是有价值的。
什么,你问22分的百度文心ERNIE 5.0是不是位于马里亚纳海沟?自从拉了这坨大的之后,百度就没有再把新发布的ERNIR5.1上传AA竞技场了,不参战就是没胜负,精髓。
@aigc1024
随着智谱的GLM-5.3终于也在AA竞技场开榜,年中这一轮国产模型的上新,基本算是告一段落了,相当于期中考试出分。
若以AA竞技场为参照标准,且全部按提交的满功率版本来算,目前各家厂牌的成绩如下:
Kimi K3和GLM-5.3并列60分,是中国唯二能够挤进T1阵营里的模型,死死咬住了GPT-5.6和Claude Opus 5。
当然Kimi K3是已经发布超过1个月的「老」模型了,可见含金量之足,月之暗面应该是今年惊喜最大的AI公司了,路线修正得太及时了。
按照智谱创始人唐杰的说法,GLM-5.3是故意在控制变量,只通过后训练来做迭代,不动基座、架构和参数,看看能有多少提升,也很满意新模型的表现。
T2档位排下来依次是58分的Qwen3.8 Max、53分的DeepSeek-V4-Pro、52分的Qwen3.8 27B,也是兼顾性能与经济性的高竞争区间,凡尔登绞肉机的市场。
阿里的Qwen3.8这一代其实口碑不错,非但Max版本重回开源,27B版本更是被评价为「Opus at home」,在Hugging Face,Qwen全系列模型今年被下载了20亿次以上,比第2名到第5名加起来还多。
DeepSeek-V4-Pro到底出了什么问,现在没人知道,虽说有搭配专武(Harness极简模式)的找补,但我觉得 说得没毛病,一言不合就堆定语,是车圈陋习,咱大模型行业不要学。
再说T3分段,这里已经接近上桌吃饭的底线了,能看到45分的MiniMax-M3、43分的MiMo-V2.5-Pro、42分的Hy3,主打一个量大管饱的供应,够用就行,要啥自行车呢。
MiniMax今年算是垫给了智谱,M3押注的原生多模路线,在商业价值上还是比不过纯Coding,最后还是靠视频模型找回了场子,字节比智谱好打你们敢信?
在DeepSeek-V4-Flash发布之前,小米的MiMo系列模型其实在OpenRouter上当了小半年的性价比之王,很适合用来跑自动化工具链之类的低价值高频次任务,也已经在财报里帮雷总做市值管理了。
腾讯的Hy3是姚顺雨的第一个作品,打响了翻盘的第一步,而且真做到了中美两开花,内有扶WokrBuddy上位的功劳,外有开打OpenRouter价格战的成绩,均衡双修。
再往下数,T4的分段就很接近不可言说的深海了,蚂蚁的Ling 3.0 Flash是38分,美团的LongCat 2.0是34分,阶跃的Step 3.7 F
Back to Top