TGViewer
Channel Public Channel
V2EX

V2EX

@pushv2ex

推送 V2EX 论坛贴【全部板块】

本频道: @pushv2ex

友频道: @push52pj
Subscribers
549
Photos
24.2K
Videos
3
Links
226K

Showing posts older than #236839 · Back to latest

Older Posts 20 shown
Post #236838 1
[分享创造] 做了个图片转 3D 的工作台 Quady3D,想找玩 Blender、做游戏的朋友试试

大家好,最近在做一个 AI 3D 工作台,叫 Quady3D ,来分享一下。

我想把从参考图到模型的几个步骤放在一起:选模型生成,在网页里检查形状和贴图,再继续处理、导出到自己的项目里。

先放一组网站上的现有案例,用的是 Tripo H3.1 。

输入图片:

生成模型的预览:

案例页可以加载模型,转着看看侧面和背面,也有文字、草图、多视角输入的例子。

现在生成用的是 Meshy 、Tripo 、Rodin 、混元等现有模型。我主要做的是把模型选择、生成、预览、后处理和导出这些步骤接起来。各个模型支持的输入和设置不同,可以按手里的参考素材来选。

生成出来以后,模型还是需要检查。单张图片看不到的背面可能和预期有差别;做游戏资产可能要减面、绑定,拿去打印也得看薄壁、网格和尺寸。页面里的好看预览,最后能不能变成项目里可用的东西,我觉得这一步很值得继续打磨。

费用也先说清楚:邮箱验证后一次性送 30 积分,可以试生成和预览;完整 AI 模型下载需要购买积分包或订阅解锁。每次生成的费用随模型和设置变化,提交前会显示。

网站在这里:Quady3D。

想请玩 Blender 、做独立游戏或者 3D 打印的朋友帮忙看看:你们用 AI 生成模型以后,最费时间的是哪一步?准备参考图、反复生成、修模型,还是导入自己的软件?

如果愿意试一下,欢迎带着一个具体用途来,比如做个游戏道具或小摆件。哪一步卡住了,或者哪一步其实没帮上忙,直接告诉我就行。
Post #236837 1
[OpenAI] google play 付款 chatgpt,扣款了没有账单

上个月我是用 google play 开通的 5x 会员,会员快到期了,今天有一笔自动扣款失败,因为我习惯锁卡,所以我上 google play 想看看能不能手动支付,在订阅管理那里点了更新付款方式,然后信用卡就扣款了 100 刀,但现在过去 30 分钟了,google play 上没有看到订单记录,gpt 的订阅日期也没有更新,在 gpt 上面看到的会员到期时间也没有更新,我也搞不明白这 100 刀去哪里了,有宝子遇到这样的情况吗,后续会发生什么事情。
Post #236833 2
[分享发现] 钉钉最近是不是招了一个天才产品,功能太好用了。

这是钉钉哪个天才老板的需求,简直是太好用了。将侧边栏的空间利用到了极致,非常贴心的用了 小图标适用了窄导航。为了防止用户忘记侧边栏最近使用哪些内容,还增加了每次只要鼠标移动到图标上就能看到文件名称的功能,慢慢滑动鼠标就能帮我回忆起来是什么。防止误删最近使用中的内容,窄导航特意去掉了删除功能真实太为用户着想了。赶紧去申请专利吧,千万别让飞书学去。
Post #236831 3
[分享创造] [送码] Emby/Jellyfin/Plex/本地/NAS 视频播放器 Vidzer 迎来 macOS 首发,送 30 个永久 Pro

功能介绍

组了 NAS 之后,顺便搭建了 Emby/Jellyfin/Plex 服务器,对观影有了更高的要求,市面上的这类播放器软件,对于免费用户限制比较大,基本无法满足日常使用。我的想法是免费基础功能要能够覆盖大部分使用场景,这样用户量起来之后,可以更快的迭代优化。个人比较看重响应速度和用户体验

下面是免费版和 Pro 对比:

软件截图:

特性:

● 支持的文件源:Emby/Jellyfin/Plex、WebDav/SMB/NFS/FTP、本地文件/本地文件夹
● 播放器基于 MPV,视频的处理基于 FFmpeg,几乎兼容所有常见格式
● 跳过片头、小窗模式、字幕下载、进度条预览、记忆音频和字幕
● 学习模式(特色功能,支持悬浮查词、字幕列表、句子导航、字幕样式),主要针对语言学习场景,当前学习语言支持英语,可以边看美剧边学英语,后续计划支持日语。功能比较小众,灵感是我之前开源的双语翻译插件 Duo Translator 里面的 YouTube 双语字幕功能。但是不确定这个方向有没有市场。下面是实际效果:

相关链接

官网 Github

下载地址

apple intel

支持平台

首发 macOS。

Windows 大部分适配已完成,很快就可以发布。

Android 还在开发,适配工作量大点,年前应该可以发布。

iOS 计划中,看用户量和反馈吧

送码

送 30 个永久激活码,评论区发送邮箱,收到激活码邮件后,使用邮箱地址和激活码激活即可

入口:设置->授权->输入邮箱和激活码->激活

后续 Windows 和 Android、iOS 发布时打算再赠送一波激活码

收费计划

永久 Pro 最多支持三台设备,定价是¥19.9(美元$9.9),搞了个半价优惠码V2EX,优惠后价格¥9.9。拍脑袋决定的!想请教下价格是高了还是低了,后面打算研究下早鸟价方案

后记

当前是第一个 MVP 版本,功能已经比较全了,但是肯定会有很多 bug 和瑕疵,还请多多包涵。

如果遇到 bug 或者有功能建议,欢迎反馈!我会第一时间处理
Post #236830 3
[分享创造] CroCapture 带取色器的截图工具(for macOS)

我很喜欢用微信的截图工具——微信的产品体验确实做得好,但总有种被偷窥的感觉。

有时候刚开机,没有启动微信,发现用不了截图,打开微信,又发现没有登录也用不了。也就是说我要用微信的截图就必须登着微信。这更加让我有一种被偷窥的感觉了。

我不想有被偷窥的感觉,所以我决定自己做一个,于是就有了 CroCapture 。

模仿了一些微信截图的功能,只不过肯定不会偷窥你。然后发现我经常还需要屏幕取色(安装了好几个取色小工具),于是就把取色功能也加上了。

截图+简单标记+取色+支持九种语言,仅 1.8MB ,还不如一张照片大小。

虽然是完全的 Vibe Coding 作品,没费多少精力,但为了赚回一点苹果开发者的订阅费(月底要续费了),还是决定收费。

国区仅需 1 元即可终身买断使用(截止今年年底,年后恢复原价 8 元),非国区 0.99 美刀。
Post #236829 3
[分享创造] 开源了两个给中小工厂用的 Rails 应用:项目运营一体化 + 私有化 PLM,中文界面,可自部署

做了两个开源的 Rails 应用,给中小工厂和项目型公司用,都是 MIT 协议,自己部署。

很多小厂和做项目的公司,管理方式差不多都是:一个共享盘、十几张 Excel ,再加一个"知道哪个文件才是最新版"的人。这个人一请假,事情就卡住。

Aprove AI:项目运营一体化

https://qumge.com/zh/p/aprove-ai

● 项目与审批、订单、交付、回款、发票、合作方、合同、费用、文件、报表,都放在一个工作区里,不再分散在六张表加三份导出文件里
● 界面支持中文和英文
● Rails 8.1 + PostgreSQL
● bin/rails db:prepare && bin/rails db:seed 会生成一家演示公司,用 demo_admin 登录就能直接走一遍"订单 → 交付 → 开票"的完整流程

GitHub: https://github.com/Qumge/aprove-ai

MuseFlow:给制造业用的私有化 PLM

https://qumge.com/zh/p/museflow

● 管理 CAD 图纸版本、产品与多层零部件、工艺文件、BOM 发布,全部走同一套审批流
● 刻意做成单租户:一次部署只放一家公司的数据,不用到处加 tenant_id,也不会和别家的图纸放在同一个库里
● "已发布的图纸"指的是某个具体版本,并且带着审批记录:谁、批了哪一版、什么时候批的。改动走审批,不会被悄悄覆盖
● Ruby 4.0.1 / Rails 7.1 / PostgreSQL / Redis ,种子数据自带一套完整的产品、零件、工艺文件和 BOM 示例

GitHub: https://github.com/Qumge/museflow-plm

为什么要做成开源、自部署

这类公司的审批链、字段名、叫法都是按自己的习惯来的。用 SaaS 只能提需求然后等;用自己手里的 Rails 项目,自己或者本地的外包团队直接改代码就行。另外,对工厂来说,图纸就是公司的命根子,放在自己机房里,大家会安心很多。

如果你在小工厂或项目公司负责运营,或者是接这类外包的 Rails 开发,欢迎试用、提 issue 、提 PR ,也欢迎在这里拍砖。

我们做的其他东西( AI 网关、桌面 AI 助手、几个 iPhone 小工具)都在这里: https://qumge.com/zh/products
Post #236828 2
[推广] 这样 送住宅 ip+流量,规矩才能立得住,不烧心

周五不停歇,动态住宅 ip 流量,免费试用!!!

邀请码:veexfwaif

点击下方链接注册,填写邀请码,进入控制台找到 cdk 兑换即可

https://zooproxy.com/?kwd=LQ-v2ex

GRAA-BJPC-47GC

J4Q4-8GGA-YX9B

GLYZ-VZTR-H2GS

ZHY8-7ES2-MYRA

6UWQ-P27K-N8HB

我会查看后台,不定时更新 CDK 码

注意!!!需要帖子中的链接注册才能看到哦

没领取到的,可以联系官网客服领取免费试用额度或者私我您注册的邮箱。

也可以联系 https://t.me/Zooproxy7
Post #236824 2
[推广] RapDuo AI :我做了个用两张照片生成双人说唱视频的小工具

我最近做了个小工具,叫 RapDuo 。起因是想让朋友的两张照片「同台」说唱:不用拍视频,也不用自己剪辑,填个主题就能生成一段两人轮流唱词的短片。现在把它放到 V2EX 推广节点,想听听大家的使用感受和建议。

RapDuo 简介

RapDuo 是一个用两张照片生成双人说唱视频的网页工具。上传两张照片后,可以选择场景、填写一句主题,生成带人声和伴奏的 MP4 视频。朋友、情侣、同事,或者两只宠物,都可以试试。

RapDuo 的特点

● 两人各有唱词:视频会让照片中的两个角色轮流说唱,而不是只让其中一人动起来。
● 有九种场景:包括橙色录音棚、酒店大堂、街头、霓虹俱乐部和万圣节等。其中八种场景会为视频生成新的歌词和伴奏;「原版」场景使用原曲,发布到平台时可能遇到音乐版权识别。
● 可以先看短预览:新用户通过 Google 登录后,可免费生成一次 5 秒预览,不需要绑定银行卡。完整视频通常需要几分钟生成,失败的任务不扣点数。
● 照片尽量拍清楚:每张照片放一个人或一只宠物,正面、光线充足,效果通常会更稳定。毕竟是生成视频,人物相似度和口型也不一定每次都完全一致。

如果想先看看成片风格,可以在 Rap Duo AI 页面播放示例,再决定要不要上传自己的照片。

如何使用?

使用网址: https://rapduo.app

1. 上传两张照片,第一张是左边的角色,第二张是右边的角色。
2. 选一个场景,填写说唱主题,例如生日祝福或朋友之间的玩笑。
3. 先生成免费预览;觉得合适的话,再按需要选择完整视频的画质和规格。

目前 AI Rap Video Generator 还有不少可以打磨的地方。如果大家试了之后遇到照片识别不理想、唱词不自然,或者有想要的新场景,欢迎直接在评论里告诉我。
Post #236823 2
[Android] 灵光一闪漫画 App 用 GPU shader 做高分缩放,性能直接起飞

本地看漫画一直心念念 Perfect Viewer 的缩放滤镜,无奈相比 GPU 缩放,软件重采样的成本实在是太高了,最简单的 120 帧手机屏幕上双指缩放,每帧都要 CPU 重绘位图,性能和内存占用爆炸。

昨晚睡觉前灵光一闪,可以直接用 GPU shader 缩放,这样不用重绘位图,不用传递 viewport 坐标给解码,不用改图形代码,而且就算是 24MP 以上的位图 120 帧 重绘对 GPU 来说性能也完全可以接受。

两者一结合,现在 LocalViewer 解码用软件降采样或者直接原图输出,然后渲染交给 GPU shader 缩放,效果和性能统统满意。

顺便支持了相机 RAW 直出手机屏幕 HDR 显示,效果一流。

https://github.com/zmz125000/LocalViewer

RAW HDR 样图来自 https://raw.pixls.us/
Post #236822 2
[程序员] 家庭共享的 OneDrive 已死

生效时间:2026.10.08 措施:Microsoft 365 家庭版订阅或 Premium 订阅,每份新增订阅或修改至前述版本的订阅,OneDrive 存储由订阅内每个用户独享 1TB 存储,调整为每个用户共享每份订阅的 2TB 存储;超出的部分须额外购买,且最高不超过 10TB 。

存量 Microsoft 365 家庭版订阅或 Premium 订阅自 2027 年 5 月 2 日或之后生效上述新措施。
Post #236821 2
[问与答] 想问下大家,运行在 wps 里可以调用 js 接口操作编辑文档的 agent 有没有需求

目前做了一个支持 word 的 wps agent ,可以调 wpsjs api 来操作文档,支持接入任意模型 api 后端,甚至还做了个用户 3 层记忆系统。

自己也用了一段时间,也给身边同事装上了试用,但是这段时间下来看后台数据使用率可以说很惨淡,我有点犹豫还要不要继续做下去(本来还规划了 excel 、ppt 的 wps agent ),目前自用可以说没什么问题,但是还有很多细节需要打磨。
Post #236820 2
[微信] 写了个纯离线的微信小程序, 54 个页面,零网络请求 V1.6

小程序叫「口袋百宝集」,纯离线,54 个页面。我自己写的,免费,无广告无内购。发在这儿主要是想听批评,不是来求下载的。

起因

本来就是写给自己用的。我要的东西很杂:算房贷、查农历、记两笔账、临时压一张图,偶尔还想找个短点的句子发朋友圈。这些小事单独装个 App 都不值当,我就全做进一个小程序里。数据只存本机也是因为这个——里面有账本和私密笔记,我不想让它们离开手机。

先说离线这块

因为这块最好验证,也最容易被怀疑。

会打进包里的运行时源文件一共 331 个,扫下面这些 API ,全部 0 命中:

● wx.request
● wx.uploadFile
● wx.downloadFile
● wx.connectSocket
● wx.cloud
● wx.serviceMarket

顺带把 wx.login 、wx.getUserProfile 、wx.checkSession 也扫了,同样是 0 。

所以没有后端、没有云开发、没有账号体系。记账、待办、密码笔记、日记只写 wx.storage ,不出本机。农历和节气用的是内置的农历库,不调任何日期接口。二维码、条形码都是本地算出来的。

内容也全在包里:解梦 3000 多条词条按 10 类拆文件,文案素材 60 条,心理测试 7 套题,笑话 24 条,谜语 29 条,歇后语 30 条,绕口令 33 条。

2MB 主包逼出来的几个决定

主包 2MB 是硬上限,这个数比我想的更早咬人。

第一次上传直接被拒,报 main package source size 11183KB exceed max limit 2048KB 。我以为是依赖装错了,查了半天才发现是 packOptions.ignore 里写的 *.png / *.jpg 这种 glob 只匹配项目根目录,不往下递归。我那几张设计稿放在 assets 的子目录里,一条规则都没命中,整个打包进去。挪走就正常了。

第二件事,分包之间不能互相 require 。我一开始把 rng 和音效两个模块放在分包里,结果 text 分包的编码工具要生成 UUID ,也得用 rng ,就引不到了。最后只能把这类公共模块全部上提到主包,让各个分包各自引主包。为了不改老的引用,原来那个路径留成一个转出口文件,只写一行 require 。音效模块也是这么被拉到主包的。

第三件事,几千条数据不能放主包。解梦和农历两个分包加起来 2.2MB 出头,占全包七成,主包反而压到 169,235 B 。解梦那 3000 多条不可能是手打的,做法是维护一份种子文件加一个生成器脚本,批量跑出来之后先校验,主要查新词条会不会跟已有的词和别名撞车,过了才倒进数据目录。扩量就改种子重跑。

几个不太常见的选择

全程不让用 Math.random(),需要随机的地方一律注入一个可复现的 rng ( xorshift32 )。理由很实际:随机的东西没法写断言。所以转盘抽什么、骰子掷几点、抛硬币正反面,测试里都能用固定种子复现出来,出了问题能回放。

音效是 WebAudio 现场合成的,零音频文件。木鱼的敲击、硬币落桌、转盘的刻度声和最后那声中奖,全是振荡器加包络算出来的。这样包体积不涨,也不请求任何资源。连击的时候还要防削波,敲太快会自动把峰值打折。

转盘的刻度声费了点劲。每根扇区边界被指针跨过的时候响一下,但转速是变速的(一条 cubic-bezier 缓动),刻度又密,JS 里挨个 setTimeout 一定会飘。最后的做法是用跟 wxss 里完全相同的缓动曲线去反解每个边界被跨过的时刻,直接算出相邻两声之间的间隔,再交给一条时间轴排。间隔还刻意不取整,取整会把几十段的误差累到十几毫秒。

汉字转拼音的字典是自动生成的,不是手抄的。基本区汉字按码位偏移存最常用读音,再单独配一份常用多音词组表,查的时候先做最长词组匹配、匹配不到再逐字兜底。所以「的士」这种能查对,但整句的分词没做,多音字只到词这一级,页面上也写明了要自己核对。

编码工具里手写了 MD5 / SHA-1 / SHA-256 ,零依赖。MD5 那张 K 表是按 floor(|sin(i+1)| · 2^32) 现算的,不手抄常量表。写完跟 Node 的 crypto 对拍了 16 组输入,专门覆盖分块边界那几档。

测试是 Jest ,47 套 857 条。

还有一次审核

提审被驳回两次,理由都是运营规范 3.2 条的 UGC 内容安全,指向 security.msgSecCheck ,点名的是图片类功能。

这个产品没有 UGC 。用户选一张图,本地压缩,存回自己相册,全程不上传、不分享,也没有评论区。全仓连一个网络请求都没有。

第一次的处理是给图片页补「仅本机处理」的显式声明,同步改用户协议和后台隐私指引里的权限用途。第二次驳回了具体的图片压缩功能。

最后整体下线了图片工具箱:app.json 里摘掉注册,packOptions.ignore 排掉目录,提审版本只留二维码生成。image 分包从 111,044 B 降到 93,924 B 。

说不上什么感受,就是有点可惜,那功能我自己平时也在用。

局限

提前说清楚,比被人指出来强:

● 只能在微信里用,没有独立 App
● 数据只存本机,换手机或清缓存就没了。这是设计取舍不是 bug ,后面再考虑上服务器
● 不联网的代价是内容没法热更新,加一条词条也得重新发版
● wx.storage 容量有限,不适合塞大量数据
● 房贷、个税、退休、安全期这些是估算,结果仅供参考,站内每条都挂了免责声明

想问的

● 两个分包吃掉全包七成体积,这种数据型分包还有没有更省的做法
● 分包之间不能互相 require 这条,除了往主包上提,还有别的组织方式吗
● 手写摘要算法这种事,你们项目里允许吗,还是宁可多一个依赖

欢迎拍。
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →