Files
Sprinter-SDCC/libbgi/common/_gfx_blit_full_op.c
T
snark13 860468f3c5 libbgi: NOT_PUT тоже через акселератор + изыскания по виду Тени
NOT.  У акселератора нет режима «инвертировать буфер»: буфер меняется
только на ЧТЕНИИ и только опкодами AND/OR/XOR (HL) (драйвер MAME,
update_accel_buffer), а `CPL` автомат вообще не распознаёт — инвертируется
регистр CPU, не буфер.  Зато ~src = src XOR #FF, поэтому NOT собирается из
уже имеющегося: буфер := src, XOR-burst по константному блоку единиц
(common/_bgi_ones256.c), запись.  Ядра _bgi_blit_{rows,cols}_not_raw.c;
между burst'ами меняется HL, поэтому каждая смена — под СТОПом (иначе fetch
операнда перезапустит burst).  В колоночном варианте второй OUT Port_Y не
нужен: op-burst идёт по блоку единиц горизонтально, а Port_Y шагает только
вертикальный.

Наружу — тем же op-параметром (GFX_OP_NOT), диспетчер один раз на вызов, в
цикл по полосам/колонкам не заходит.  putimage лишился попиксельного пути
ЦЕЛИКОМ: все пять операций BGI идут через акселератор и клиппируются
одинаково.  tests/accop дополнен T9/T10 (NOT строками и колонками) —
10/10 PASS в MAME; tests/bgi_img P1/P2 по-прежнему PASS.

tests/convbench (новый) — замер побайтной конвертации атласа
«прозрачный #FF -> 0x00» (источник для XOR-блита): 145.3 такта/байт, то
есть 2.5× от 59 номинальных T-states цикла.  0.11 с на страницу 16 КБ,
3.2 с на все 28 страниц, 1.3 с по фактическому объёму данных (186 КБ).

applications/PoP/docs/shadow_render.md — вид Тени (два блиттера OR+XOR)
ОТЛОЖЕН по решению пользователя: пока рисуем обычной копией атласами Кида.
В документе собрано, почему в лоб не выходит (XOR несовместим с
прозрачностью #FF; операция читает ОЗУ-копию, поэтому два прохода
оригинала вырождаются в один XOR — нужен однопроходный композит
s | bg ^ s(сдвиг)), замер стоимости источника и четыре варианта.  Ключ к
выбору — список кадров, которыми тень реально пользуется; снимать по факту,
когда пойдут уровни 5/6/12.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-08-11 15:41:06 +03:00

95 lines
5.8 KiB
C

/*
* _gfx_blit_full_op — bracket-free ядро блита под-прямоугольника картинки
* getimage-формата ЛОГИЧЕСКОЙ ОПЕРАЦИЕЙ (приёмник = приёмник <op>
* источник). Полный близнец _gfx_blit_full: тот же клип по экрану, та же
* нарезка на полосы ≤256 байт, БЕЗ _bgi_begin/_bgi_end и БЕЗ смены банка
* (вызывающий обязан замапить W3 и выставить банк). Разница одна — вызов
* op-ядра _bgi_blit_rows_op_raw вместо копирующего.
*
* ПОЧЕМУ ОТДЕЛЬНОЕ ТЕЛО, а не флаг в _gfx_blit_full. Копирующий путь —
* горячий (спрайтовый движок гоняет его в batch-цикле); ветка «а не
* операция ли?» тянула бы op-ядро в любую программу с блитом (~+170 Б
* _CODE при нулевой пользе). Клип-математика дублируется сознательно —
* правки вносить в ОБА файла (близнец: common/_gfx_blit_full.c).
*
* ---- ПРОЗРАЧНОСТЬ (главное отличие от копии) ----------------------
* Аппаратная прозрачность (банк 0x58/0x5C: байт #FF не пишется) смотрит на
* РЕЗУЛЬТАТ операции, а не на источник, поэтому достаётся даром не всем:
* GFX_OP_AND — прозрачный #FF нейтрален сам по себе (#FF & bg = bg),
* банк не важен;
* GFX_OP_OR — #FF | bg = #FF, и запись такого байта подавляется банком
* 0x58/0x5C: обычный атлас годится КАК ЕСТЬ. Оговорка:
* подавится и «настоящий» результат, случайно равный #FF;
* GFX_OP_XOR — с прозрачностью #FF НЕ РАБОТАЕТ: #FF ^ bg = ~bg, то есть
* инверсия фона по всему прямоугольнику картинки. Источник
* для XOR обязан хранить прозрачный пиксель как 0x00 —
* нейтральный элемент и для XOR, и для OR (так же, как в
* DOS-оригиналах, где прозрачный индекс = 0).
* Замаскировать #FF внутри операции нельзя в принципе: побитовые AND/OR/XOR
* не умеют «выбрать по условию», а #FF — нейтраль только для AND.
*
* ---- ЧТО ЧИТАЕТ ОПЕРАЦИЯ ------------------------------------------
* Чтение страниц #50..#5F всегда отдаёт ОЗУ-копию экрана
* (memory/sprinter_vram_transparency), поэтому при банке 0x54/0x5C («не
* писать в копию») операция совмещается с ЧИСТЫМ ФОНОМ, а не с тем, что
* уже нарисовано поверх. Нужен результат поверх нарисованного — рисовать
* банком GFX_BANK_NORMAL (0x50), где копия и видео-ОЗУ совпадают; платой
* будет потеря дарового heal из копии.
*
* Цена: три accel-burst'а на строку вместо двух (+50% времени accel);
* подготовка/клип — как у копии.
*/
#include "../_bgi.h"
void _gfx_blit_full_op(int x, int y, const void *img,
int sx, int sy, int w, int h, uint8_t op)
{
const uint8_t *p = (const uint8_t *)img;
const uint8_t *src;
uint16_t dst;
int img_w;
/* img_w — ПОЛНАЯ ширина картинки/ленты из заголовка getimage
* (p[0]=lo, p[1]=hi) = шаг между строками источника (sstride). */
img_w = p[0] | (p[1] << 8);
/* Клип по экрану — только если хоть один край вылезает. */
if (x < 0 || y < 0 || x + w > _bgi_maxx + 1 || y + h > _bgi_maxy + 1) {
if (x < 0) { sx -= x; w += x; x = 0; }
if (y < 0) { sy -= y; h += y; y = 0; }
if (x + w > _bgi_maxx + 1) w = _bgi_maxx + 1 - x;
if (y + h > _bgi_maxy + 1) h = _bgi_maxy + 1 - y;
if (w <= 0 || h <= 0) return;
}
src = p + 4 + sx;
if (sy)
src += (uint16_t)sy * (uint16_t)img_w;
dst = _gfx_addr_base + x;
/* NOT — не операция с приёмником, а инверсия источника, и цепочка у
* неё другая (XOR по блоку единиц вместо чтения приёмника), поэтому
* своё ядро. Ветка одна на вызов, в цикл по полосам не заходит. */
if (op == GFX_OP_NOT) {
while (w > 256) {
_bgi_blit_rows_not_raw(src, (uint8_t *)dst, 0 /* =256 */,
(uint8_t)h, img_w, (uint8_t)y);
src += 256;
dst += 256;
w -= 256;
}
_bgi_blit_rows_not_raw(src, (uint8_t *)dst, (uint8_t)w, (uint8_t)h,
img_w, (uint8_t)y);
return;
}
while (w > 256) {
_bgi_blit_rows_op_raw(src, (uint8_t *)dst, 0 /* =256 */, (uint8_t)h,
img_w, (uint8_t)y, op);
src += 256;
dst += 256;
w -= 256;
}
_bgi_blit_rows_op_raw(src, (uint8_t *)dst, (uint8_t)w, (uint8_t)h,
img_w, (uint8_t)y, op);
}